跳转到主内容

ONTAP Data Processing延迟—解决指南

i
Knowledge Base guidance

This article may include metadata, visibility, validation state, and related support guidance.

适用场景

ONTAP 9

问题描述 

  • Data Processing (AIQUM)或数据(命令行界面)实际上不仅包括CPU D-blade延迟、还包括以下内容:
    • CPU D-blade延迟
    • WAFL Suspend延迟
    • WAFL CP延迟
    • 注: 
      • WAFL Suspend延迟和WAFL CP延迟 不如CPU D-blade延迟常见、并且很难进行故障排除。因此、本知识库文章不会讨论这些问题
      • 如果发现Data Processing数据延迟、而此 知识库文章中的内容对此没有帮助、请联系NetApp支持部门进行进一步故障排除
      • NetApp内部工具(例如AIQ PAS)具有更精细的延迟细分、以帮助区分这些WAFL延迟、可从 不同性能监控工具的延迟中心有哪些?中找到不同延迟中心映射
  • 此CPU D-blade延迟 通常如下所示:
    • Active IQ Unified Manager: 以Data Processing为单位显示延迟
    • 命令行 qos statistics volume latency show :  数据列中显示的延迟

示例:

Cluster::>rows 0;date;qos statistics volume latency show
Workload            ID    Latency    Network    Cluster     Data       Disk        QoS      NVRAM
--------------- ------ ---------- ---------- ---------- ----------  ---------  ---------  ---------
-total-              -   136.49ms    99.00us    70.00us   136.17ms   153.00us        0ms        0ms
vserver1_vol1..   4201   206.05ms   130.00us        0ms   205.88ms    44.00us        0ms        0ms
vserver5_vol8..   7704  1309.00us   351.00us     1.00us   834.00us   114.00us        0ms     9.00us
-total-              -   140.29ms   103.00us    75.00us   139.94ms   174.00us        0ms        0ms
vserver1_vol1..   4201   379.03ms   127.00us        0ms   378.73ms   175.00us        0ms        0ms
vserver5_vol8..   7704     2.02ms   309.00us     1.30us  1820.00us   105.00us        0ms     9.00us

注: 这是有关如何对ONTAP 9性能进行故障  排除的第二篇文章、请参见主要的ONTAP 9性能故障排除解决方案指南》

操作步骤

  1. 确定高CPU是否是导致延迟的问题描述
  1. 使用 qos statistics workload resource cpu show  可以:
    • 确定排名前几位的工作负载
    • 查看内部工作负载是否正在运行
    • 将利用率与 User-Default  或用户工作负载进行比较

注: wafltop  也可用于检查此情况

示例:  User-Default 上的CPU最高,因此前端CIFS/FCP/iSCSI/NFS工作负载是发生原因,可在步骤3中通过卷来标识

cluster1::> qos statistics workload resource cpu show -node nodeB Workload ID CPU ------------------ ------ ----- -total- (100%) - 70% User-Default - 42% _SNAPMIRROR - 20% _Efficiency_BestEffort - 8%
  1. 使用 qos statistics volume resource cpu show  可以:
    • 确定排名前几位的工作负载
    • 查看用户工作负载是否正在运行(CIFS/FCP/iSCSI/NFS客户端工作)
    • 比较各个卷的利用率
cluster1::> qos statistics volume resource cpu show -node nodeB Workload ID CPU --------------- ------ ----- -total- (100%) - 71% vs0-wid101 101 22% file-1-wid121 121 11% vol0-wid1002 1002 8%
  1. 减少前几个工作负载
单击可查看更多详细信息
  1. 如果上述步骤均不起作用: