CPU 才用三成,為什麼還被 throttle?拆開 CPU limit 的 100ms 配額
RD 回報延遲很高,儀表板上的 CPU 卻很閒。從 cgroup 的 100ms 配額,看 CPU limit 在 Node 上怎麼被執行,以及該怎麼處理。
閱讀文章這裡整理我在 Kubernetes、雲端與自架服務上的學習和實作經驗。可以從主題導覽開始,或往下看最近的文章。
RD 回報延遲很高,儀表板上的 CPU 卻很閒。從 cgroup 的 100ms 配額,看 CPU limit 在 Node 上怎麼被執行,以及該怎麼處理。
閱讀文章用一次性的本機叢集讀出 cpu.max 與 cpu.stat,做出成群請求被 throttle 的服務,再實測 GOMAXPROCS、增加副本、提高 limit、cpu.weight,以及 Node 忙碌時的差別。
閱讀文章用一次性的本機叢集做出「CPU 很閒,新副本卻 Pending」的狀態,讀懂 FailedScheduling,再看每種改法讓 Pod 落到哪裡。
閱讀文章