Skip to main content
Kai liên tục giám sát cụm Amazon EKS của bạn, phát hiện pod được cấp phát thừa, node chưa được tận dụng, và thiếu chính sách autoscaling trước khi chúng gây ra sự cố nghiêm trọng.

Tình huống

Một nhóm platform đang vận hành cụm EKS production trải dài nhiều namespace. Cảnh báo CPU xuất hiện ngắt quãng nhưng điều tra chậm chạp — kỹ sư phải chạy thủ công các lệnh kubectl qua hàng trăm pod để tương quan log, metrics, và event.
Thách thức khi xử lý sự cố Kubernetes thủ công qua các namespace và tài nguyên

Thách thức khi xử lý sự cố Kubernetes thủ công

Nhóm yêu cầu Kai đánh giá toàn diện cụm, xác định lãng phí tài nguyên, và khuyến nghị chính sách autoscaling cho những nơi còn thiếu.

Hướng dẫn từng bước

Điều gì tạo nên hiệu quả

  • Kai truy vấn trực tiếp cluster API, thay thế các phiên kubectl thủ công và chuyển đổi công cụ.
  • Tương quan đa lớp liên kết mức sử dụng pod, dung lượng node, và mẫu lịch trình trong một lượt phân tích duy nhất.
  • #report#chart tạo đầu ra có cấu trúc để Kai suy luận trước khi trình bày phát hiện.
  • #recommend tạo ra các thay đổi chính sách HPA có thể thực thi thay vì chỉ dump metrics thô.
  • CloudKeepers có thể chạy phân tích này theo lịch để phát hiện vấn đề trước khi kỹ sư trực bị gọi.

Tự mình thử

Tài liệu tham khảo agent Kai

Toàn bộ khả năng của Kai, agent Kỹ sư Kubernetes

Kết nối Kubernetes

Hướng dẫn từng bước kết nối CloudThinker với cụm EKS của bạn

Topology Explorer

Vẽ sơ đồ phụ thuộc dịch vụ Kubernetes để phân tích nguyên nhân gốc rễ nhanh hơn

CloudKeepers

Chạy kiểm tra sức khỏe liên tục trên workload Kubernetes của bạn một cách tự động