Elastic(紐約證券交易所代碼:ESTC)近日宣佈推出一項基於代理的Kubernetes調查工作流,以及基於模型上下文協議的可觀測性技能。該功能可在告警觸發的同時自動診斷故障,當站點可靠性工程師(SRE)打開告警時,根因分析、證據鏈和修復建議已準備就緒。
對於大規模運行Kubernetes的團隊而言,從收到告警到找到答案的時間差,不僅延長故障時長、加劇服務中斷影響,也讓值班工程師疲憊不堪。Elastic通過自動啓動調查流程,在工程師被呼叫前就開始工作,有效填補了這一空白。
此項新能力建立在Elastic已有的Kubernetes儀表盤、預製告警模板和機器學習異常檢測之上,提供兩種加速排障的方式:一是當告警觸發時自動運行診斷的智能調查工作流;二是將相同的調查能力集成到工程師日常使用的AI工具和集成開發環境中,如Claude、Cursor、VS Code等。
藉助Elastic Observability MCP應用,SRE可以通過對話方式調查Kubernetes環境。AI代理能實時查詢Elasticsearch中的日誌和指標數據,並直接在工具內呈現交互式視圖,包括集群健康狀態匯總、服務依賴關係圖、異常詳情、終端故障的爆炸半徑分析以及告警規則管理。Elasticsearch憑藉比同類產品高2.5倍的存儲效率,確保工程師在調查事件時能夠訪問完整的運營上下文。
Elastic可觀測性總經理Bahaaldine Azarmi表示:「凌晨3點被叫醒的工程師不想從頭開始調查,他們想要答案。通過本次發布,Elastic在告警觸發的那一刻就啓動了調查流程,讓團隊能夠更快、更有信心地解決問題。而且由於它運行在工程師已使用的工具內部,無需切換上下文,也無需學習新界面。」
Elastic Kubernetes集成(包含儀表盤、告警模板和機器學習異常檢測)目前已向所有Elastic Cloud Hosted、Serverless和自管部署用戶開放。新的Kubernetes調查工作流和MCP應用則處於技術預覽階段。
責任編輯:張俊 SF065