コンテンツにスキップ

vpm とクラスター状態

vpm は、Customer Edge をテナントに登録し、プラットフォームコンテナを監視するエージェントです。ノードがオンラインにならない場合、その状態を最初に確認する必要があります。

Terminal window
execcli systemctl-status-vpm
● vpm.service - VP Manager service
Loaded: loaded (/etc/systemd/system/vpm.service; enabled; preset: disabled)
Active: active (running) since Tue 2026-07-28 18:07:43 UTC; 2h 36min ago
Main PID: 11329 (docker)
Tasks: 10 (limit: 204889)
Memory: 14.9M
CPU: 496ms
CGroup: /system.slice/vpm.service
└─11329 /usr/bin/docker run --rm --name vpm --net=host --privileged -v /dev:/dev -v /bin/udevadm:/bin/udevadm -v /etc/:/hostetc/:rw -v /opt/:/hostopt/:rw -v /:/hostos/:ro -v /usr/bin/:/hostusr/bin/:ro -v /e…
Jul 28 20:40:47 f5-xc-ce-vm-01 vpm[11329]: etcd.go:123: Holding dictator lock for path /_lock/dictator
Jul 28 20:41:44 f5-xc-ce-vm-01 vpm[11329]: module.go:84: Running intra-cluster, type: node
Jul 28 20:41:44 f5-xc-ce-vm-01 vpm[11329]: pinger.go:38: Stats for connectivity-check: <name: intra-cluster, type: intra-cluster, success: true>
Jul 28 20:42:44 f5-xc-ce-vm-01 vpm[11329]: module.go:84: Running intra-cluster, type: node
Jul 28 20:42:44 f5-xc-ce-vm-01 vpm[11329]: module.go:90: Running intra-cluster, type: fabric
Jul 28 20:42:44 f5-xc-ce-vm-01 vpm[11329]: pinger.go:38: Stats for connectivity-check: <name: fabric, type: fabric, success: true>
Jul 28 20:42:44 f5-xc-ce-vm-01 vpm[11329]: pinger.go:38: Stats for connectivity-check: <name: intra-cluster, type: intra-cluster, success: true>
Jul 28 20:42:50 f5-xc-ce-vm-01 vpm[11329]: etcd.go:123: Holding dictator lock for path /_lock/dictator
Jul 28 20:43:44 f5-xc-ce-vm-01 vpm[11329]: module.go:84: Running intra-cluster, type: node
Jul 28 20:43:44 f5-xc-ce-vm-01 vpm[11329]: pinger.go:38: Stats for connectivity-check: <name: intra-cluster, type: intra-cluster, success: true>

確認すべき点。

  • Active: active (running) since … と経過時間。数時間稼働しているノードで vpm が数分前に再起動していた場合、それはシグナルです — 登録の失敗は、テナントに現れる前に、再起動ループとして先に表れます。
  • Main PIDdocker であること。 vpm はネイティブプロセスではなく、特権 Docker コンテナとして実行されており、--net=host --privileged および //dev/etc を含む多数のホストバインドマウントを使用して起動されます。そのため、vpmdocker-ps には表示されますが、crictl-ps には表示されません — これはまた、CE 上の docker-ps に 3 エントリーしかないことが、症状ではなく完全な状態である理由でもあります。
  • 末尾のジャーナル行。statusreporter.go: Status reporter loop has finished without error, sleeping for 5m… は正常な定常状態です: vpm はおよそ 5 分周期でレポートします。module.go: Running intra-cluster, type: node は、スタンドアロンで実行されているのではなく、クラスターに参加済みであることを確認します。

確認できないこと。 テナントが登録を受け入れたかどうかについては何も示しません。完全に正常な vpm は、拒否しているコントロールプレーンに対して無限にループし続けます — 理由はジャーナル行を参照してください。

Terminal window
execcli systemctl-restart-vpm

このノード上の etcd ポッドから照会された、CE の Kubernetes コントロールプレーンを支える etcd クラスターです。

Terminal window
execcli etcdctl-cluster-member-status
+--------------------------+------------------+---------+---------+-----------+------------+-----------+------------+--------------------+--------+
| ENDPOINT | ID | VERSION | DB SIZE | IS LEADER | IS LEARNER | RAFT TERM | RAFT INDEX | RAFT APPLIED INDEX | ERRORS |
+--------------------------+------------------+---------+---------+-----------+------------+-----------+------------+--------------------+--------+
| https://etcd-0.etcd:2379 | dc946acaf076bc59 | 3.5.11 | 2.8 MB | true | false | 3 | 1981 | 1981 | |
+--------------------------+------------------+---------+---------+-----------+------------+-----------+------------+--------------------+--------+

確認すべき点。 IS LEADERRAFT TERM、および RAFT INDEXRAFT APPLIED INDEX が一致しているかどうか。この 2 つの間に持続的な差異がある場合、そのメンバーはログの適用が遅れていることを意味します。ERRORS が空であることが正常な状態です。