Questa pagina è rivolta agli amministratori della piattaforma.
In questa pagina viene descritto come verificare lo stato di integrità di nodi, pod di sistema e connettività di rete nel cluster.
Controlla l'integrità del cluster con Actl
Esegui il comando seguente per verificare l'integrità del cluster:
actl clusters baremetal check cluster CLUSTER_NAME --kubeconfig=ADMIN_KUBECONFIG
Il comando controlla quanto segue:
- Integrità dei nodi nel cluster, come lo stato in esecuzione di kubelet, lo stato di container, la capacità del disco e la connettività di mirroring del Registro di sistema. ecc.
- L'integrità dei pod di sistema Bare Metal, come
anthos-cluster-operator
, se il cluster è un cluster di amministrazione. - Connettività di rete tra i nodi, ad esempio connettività L2 tra nodi master.
Ecco un esempio di controllo di integrità superato:
Please check the logs at actl-workspace/user-1/log/check-cluster-20210616-215509/check-cluster.log
[2021-06-16 21:55:16+0000] Waiting for health check job to finish... OK
[2021-06-16 21:55:46+0000] - Validation Category: machines, network, add-ons and kubernetes
[2021-06-16 21:55:46+0000] - [PASSED] add-ons
[2021-06-16 21:55:46+0000] - [PASSED] kubernetes
[2021-06-16 21:55:46+0000] - [PASSED] node-network
[2021-06-16 21:55:46+0000] - [PASSED] 10.200.0.6
[2021-06-16 21:55:46+0000] - [PASSED] 10.200.0.7
[2021-06-16 21:55:46+0000] - [PASSED] 10.200.0.8
[2021-06-16 21:55:46+0000] Flushing logs... OK
Ecco un esempio di errore del controllo di integrità:
Please check the logs at actl-workspace/user-1/log/check-cluster-20210807-001826/check-cluster.log
[2021-08-07 00:18:32+0000] Waiting for health check job to finish... OK
[2021-08-07 00:20:52+0000] - Validation Category: machines, network, add-ons and kubernetes
[2021-08-07 00:20:52+0000] - [FAILED] 10.200.0.6
actl-workspace/user-1/log/check-cluster-20210807-001826/10.200.0.6
[2021-08-07 00:20:52+0000] - [FAILED] 10.200.0.7
actl-workspace/user-1/log/check-cluster-20210807-001826/10.200.0.7
[2021-08-07 00:20:52+0000] - [FAILED] 10.200.0.8
actl-workspace/user-1/log/check-cluster-20210807-001826/10.200.0.8
[2021-08-07 00:20:52+0000] - [PASSED] add-ons
[2021-08-07 00:20:52+0000] - [PASSED] kubernetes
[2021-08-07 00:20:52+0000] - [PASSED] node-network
[2021-08-07 00:20:52+0000] Flushing logs... OK
[2021-08-07 00:20:52+0000] Error waiting for health check job: health check failed
Passaggi successivi
- Scopri come eliminare i cluster.