跳到內容

vpm 與叢集狀態

vpm 是將 Customer Edge 註冊至租戶並監管平台容器的代理程式。當節點無法上線時,其狀態是首要確認的事項。

Terminal window
execcli systemctl-status-vpm
● vpm.service - VP Manager service
Loaded: loaded (/etc/systemd/system/vpm.service; enabled; preset: disabled)
Active: active (running) since Tue 2026-07-28 18:07:43 UTC; 2h 36min ago
Main PID: 11329 (docker)
Tasks: 10 (limit: 204889)
Memory: 14.9M
CPU: 496ms
CGroup: /system.slice/vpm.service
└─11329 /usr/bin/docker run --rm --name vpm --net=host --privileged -v /dev:/dev -v /bin/udevadm:/bin/udevadm -v /etc/:/hostetc/:rw -v /opt/:/hostopt/:rw -v /:/hostos/:ro -v /usr/bin/:/hostusr/bin/:ro -v /e…
Jul 28 20:40:47 f5-xc-ce-vm-01 vpm[11329]: etcd.go:123: Holding dictator lock for path /_lock/dictator
Jul 28 20:41:44 f5-xc-ce-vm-01 vpm[11329]: module.go:84: Running intra-cluster, type: node
Jul 28 20:41:44 f5-xc-ce-vm-01 vpm[11329]: pinger.go:38: Stats for connectivity-check: <name: intra-cluster, type: intra-cluster, success: true>
Jul 28 20:42:44 f5-xc-ce-vm-01 vpm[11329]: module.go:84: Running intra-cluster, type: node
Jul 28 20:42:44 f5-xc-ce-vm-01 vpm[11329]: module.go:90: Running intra-cluster, type: fabric
Jul 28 20:42:44 f5-xc-ce-vm-01 vpm[11329]: pinger.go:38: Stats for connectivity-check: <name: fabric, type: fabric, success: true>
Jul 28 20:42:44 f5-xc-ce-vm-01 vpm[11329]: pinger.go:38: Stats for connectivity-check: <name: intra-cluster, type: intra-cluster, success: true>
Jul 28 20:42:50 f5-xc-ce-vm-01 vpm[11329]: etcd.go:123: Holding dictator lock for path /_lock/dictator
Jul 28 20:43:44 f5-xc-ce-vm-01 vpm[11329]: module.go:84: Running intra-cluster, type: node
Jul 28 20:43:44 f5-xc-ce-vm-01 vpm[11329]: pinger.go:38: Stats for connectivity-check: <name: intra-cluster, type: intra-cluster, success: true>

需要關注的項目。

  • Active: active (running) since … 以及已運行時間。若一個已運行數小時的節點上,vpm 在數分鐘前重新啟動,這就是警示訊號——註冊失敗會在租戶端顯現之前,以重啟循環的形式先行出現。
  • Main PIDdocker vpm 以特權 Docker 容器方式執行,而非原生程序,啟動時帶有 --net=host --privileged 以及一長串主機綁定掛載,包含 //dev/etc。因此 vpm 會出現在 docker-ps 中,而不會出現在 crictl-ps 中——這也是為何 CE 上的 docker-ps 顯示三個項目屬於完整狀態,而非異常症狀。
  • 尾端的日誌行。statusreporter.go: Status reporter loop has finished without error, sleeping for 5m… 是健康的穩定狀態:vpm 大約每五分鐘回報一次。module.go: Running intra-cluster, type: node 確認其已加入叢集,而非以獨立模式運行。

其未告知的事項。 無法得知租戶是否接受了該註冊。一個完全健康的 vpm 可能會對拒絕其連線的控制平面無限循環——請閱讀日誌行以了解原因。

Terminal window
execcli systemctl-restart-vpm

支撐 CE 的 Kubernetes 控制平面的 etcd 叢集,從此節點上的 etcd Pod 進行查詢。

Terminal window
execcli etcdctl-cluster-member-status
+--------------------------+------------------+---------+---------+-----------+------------+-----------+------------+--------------------+--------+
| ENDPOINT | ID | VERSION | DB SIZE | IS LEADER | IS LEARNER | RAFT TERM | RAFT INDEX | RAFT APPLIED INDEX | ERRORS |
+--------------------------+------------------+---------+---------+-----------+------------+-----------+------------+--------------------+--------+
| https://etcd-0.etcd:2379 | dc946acaf076bc59 | 3.5.11 | 2.8 MB | true | false | 3 | 1981 | 1981 | |
+--------------------------+------------------+---------+---------+-----------+------------+-----------+------------+--------------------+--------+

需要關注的項目。 IS LEADERRAFT TERM,以及 RAFT INDEXRAFT APPLIED INDEX 是否一致。若兩者之間存在持續性差距,表示該成員的套用進度落後於日誌。ERRORS 為空是健康的狀態。