在 140 版中調整嚴重性的問題清單

嚴重性從「嚴重」變更為「警告」的問題清單

  • 頻繁 TCP 失敗
  • Elasticsearch 正在拒絕大量及索引要求
  • 永久 TCP 重新傳輸
  • 常見 TCP 錯誤
  • 系統負載太高
  • 異常高後端確定持續時間 (超過 5 秒)。
  • Snapshot 持續時間異常高 (超過 5 秒)。
  • 開啟檔案描述子的使用非常重要。
  • 正在應用的提案,在最後一分鐘開始下降。
  • 失敗的提案在最後一分鐘開始上升。
  • Redis 正在拒絕連線
  • 執行緒建立失敗。 (清漆)
  • 清漆已超出工作程式執行緒,正在將要求排入佇列。
  • 清除所有已執行的指令。
  • 區域伺服器區塊快取命中率如下: 40%。
  • 已封鎖執行緒儲存區
  • 捨棄的訊息
  • 已排入佇列的要求數大於 500。
  • 用於 Elasticsearch 資料堆的記憶體太多,導致 Lucene 沒有足夠的記憶體
  • Elasticsearch 節點狀態為 RED
  • Elasticsearch 節點已達到容量限制
  • 資料堆使用率超過 95%
  • 在重新定位/重新平衡時, Elasticsearch 節點達到容量限制
  • DL 佇列大小成長中
  • 佇列正在填入
  • RabbitMQ 節點上的 Erlang 處理程序計數嚴重
  • RabbitMQ 節點上的「檔案描述子使用率」非常重要
  • HAProxy 前端階段作業用量大於 95%
  • 資源管理程式正在報告遺失節點
  • Spark 獨立式主節點正在報告已停用的工作者
  • 排程延遲的增加太快,因此應用程式落後
  • 排程延遲太高,應用程式延遲
  • Kafka 要求處理程式執行緒處於高負載狀態
  • Kafka 網路執行緒處於高負載狀態
  • Kafka 未抄寫的分割區
  • 要求延遲上限偏高。 (超過 100ms)。
  • 記憶體回收活動高 (當 GC 時間小於 80% 時)

嚴重性從「警告」變更為「嚴重」的問題清單

  • 此 RDS 實例的 CPU 額度平衡達到零。