第 3 章 故障排除所需的常见日志

其中列出了一些用于对 OpenShift Data Foundation 进行故障排除的常用日志,以及用于生成这些日志的命令。

  • 为特定 pod 生成日志:

     $ oc logs <pod-name> -n <namespace>
  • 为 Ceph 或 OpenShift Data Foundation 集群生成日志:

    $ oc logs rook-ceph-operator-<ID> -n openshift-storage
    重要

    目前,rook-ceph-operator 日志不提供有关故障的任何信息,这在故障排除中可作为限制,请参阅为 rook-ceph-operator 启用和禁用 debug 日志

  • 为 cephfs 或 rbd 等插件 pod 生成日志,以检测 app-pod 挂载中的任何问题:

    $ oc logs csi-cephfsplugin-<ID> -n openshift-storage -c csi-cephfsplugin
    $ oc logs csi-rbdplugin-<ID> -n openshift-storage -c csi-rbdplugin
    • 为 CSI pod 中的所有容器生成日志:

      $ oc logs csi-cephfsplugin-<ID> -n openshift-storage --all-containers
      $ oc logs csi-rbdplugin-<ID> -n openshift-storage --all-containers
  • 为 cephfs 或 rbd provisioner pod 生成日志,以检测 PVC 不处于 BOUND 状态的问题:

    $ oc logs csi-cephfsplugin-provisioner-<ID> -n openshift-storage -c csi-cephfsplugin
    $ oc logs csi-rbdplugin-provisioner-<ID> -n openshift-storage -c csi-rbdplugin
    • 为 CSI pod 中的所有容器生成日志:

      $ oc logs csi-cephfsplugin-provisioner-<ID> -n openshift-storage --all-containers
      $ oc logs csi-rbdplugin-provisioner-<ID> -n openshift-storage --all-containers
  • 使用 cluster-info 命令生成 OpenShift Data Foundation 日志:

    $ oc cluster-info dump -n openshift-storage --output-directory=<directory-name>
  • 使用 Local Storage Operator 时,可以使用 cluster-info 命令生成日志:

    $ oc cluster-info dump -n openshift-local-storage --output-directory=<directory-name>
  • 检查 OpenShift Data Foundation 操作器日志和事件。

    • 检查 Operator 日志:

      # oc logs <ocs-operator> -n openshift-storage
      <ocs-operator>
      # oc get pods -n openshift-storage | grep -i "ocs-operator" | awk '{print $1}'
    • 检查 Operator 事件 :

      # oc get events --sort-by=metadata.creationTimestamp -n openshift-storage
  • 获取 OpenShift Data Foundation 操作器版本和渠道。

    # oc get csv -n openshift-storage

    输出示例:

    NNAME                             DISPLAY                       VERSION   REPLACES   PHASE
    mcg-operator.v4.10.0              NooBaa Operator               4.10.0               Succeeded
    ocs-operator.v4.10.0              OpenShift Container Storage   4.10.0               Succeeded
    odf-csi-addons-operator.v4.10.0   CSI Addons                    4.10.0               Succeeded
    odf-operator.v4.10.0              OpenShift Data Foundation     4.10.0               Succeeded
    # oc get subs -n openshift-storage

    输出示例:

    NAME                                                              PACKAGE                   SOURCE             CHANNEL
    mcg-operator-stable-4.10-redhat-operators-openshift-marketplace   mcg-operator              redhat-operators   stable-4.10
    ocs-operator-stable-4.10-redhat-operators-openshift-marketplace   ocs-operator              redhat-operators   stable-4.10
    odf-csi-addons-operator                                           odf-csi-addons-operator   redhat-operators   stable-4.10
    odf-operator                                                      odf-operator              redhat-operators   stable-4.10
  • 确认已创建了安装计划。

    # oc get installplan -n openshift-storage
  • 在更新 OpenShift Data Foundation 后,验证组件的镜像。

    • 检查您要在其上验证镜像运行的组件 pod 的节点。

      # oc get pods -o wide | grep <component-name>

      例如:

      # oc get pods -o wide | grep rook-ceph-operator

      输出示例:

      rook-ceph-operator-566cc677fd-bjqnb 1/1 Running 20 4h6m 10.128.2.5 rook-ceph-operator-566cc677fd-bjqnb 1/1 Running 20 4h6m 10.128.2.5 dell-r440-12.gsslab.pnq2.redhat.com <none> <none>
      
      <none> <none>

      dell-r440-12.gsslab.pnq2.redhat.comnode-name

    • 检查镜像 ID。

      # oc debug node/<node name>

      <node-name>

      是您要验证镜像运行的组件 pod 的节点名称。

      # chroot /host
      # crictl images | grep <component>

      例如:

      # crictl images | grep rook-ceph

      记录 IMAGEID,并将其映射到 Rook Ceph Operator 页面中的 Digest ID。

其它资源