algorithmic-art
Generate deterministic SVG algorithmic artwork. Invoke when the user asks for geometric,…
当监控平台、日志平台、值班对话或变更后异常暴露出某个资源、域名、IP 或业务现象时,围绕告警目标自动展开上下游拓扑,检查同一拓扑内的关联异常并归并根告警、派生告警和噪声告警,输出根因候选、影响范围和结构化诊断摘要。
$ npx -y skills add bytedance/agentkit-samples --skill byted-volcengine-rootcause-analyzer --agent claude-codeHow it fires
How this skill gets triggered: by you, by Claude, or both.
/byted-volcengine-rootcause-analyzerContext preview
The summary Claude sees to decide when to auto-load this skill.
当监控平台、日志平台、值班对话或变更后异常暴露出某个资源、域名、IP 或业务现象时,围绕告警目标自动展开上下游拓扑,检查同一拓扑内的关联异常并归并根告警、派生告警和噪声告警,输出根因候选、影响范围和结构化诊断摘要。
name: byted-volcengine-rootcause-analyzer description: 当监控平台、日志平台、值班对话或变更后异常暴露出某个资源、域名、IP 或业务现象时,围绕告警目标自动展开上下游拓扑,检查同一拓扑内的关联异常并归并根告警、派生告警和噪声告警,输出根因候选、影响范围和结构化诊断摘要。
这个 Skill 是一个**面向故障场景的编排层**。它不把告警当作一条孤立事件处理,而是把告警、资源拓扑、同时间窗异常和运行时证据拼成一个完整的故障上下文。
它的职责是:
这个 Skill 的目标不是“解释某一条告警”,而是把**分散异常收敛成一条业务链路问题**,尽快逼近真正的故障源头。
当前版本重点覆盖以下能力:
以下能力可以作为未来扩展输入,但**当前不是必须步骤,也不能假设一定可用**:
一句话区分:
这个 Skill 依赖以下四个已有 Skill:
职责:
边界:
适合什么时候调用:
职责:
边界:
适合什么时候调用:
职责:
边界:
适合什么时候调用:
职责:
边界:
适合什么时候调用:
当出现以下场景时,应主动触发这个 Skill:
即使用户没有明确说“拓扑”或“告警归并”,只要问题本质是**围绕一个故障现象收敛上下游异常并定位真正根因**,就应该触发。
优先从告警文本、日志摘录或自由描述中提取以下字段:
如果文本里没有显式字段,也要继续识别:
如果缺少资源 ID,也允许从域名、IP 或现象描述反推候选资源,但最终回答必须显式标记不确定性。
先把原始输入整理为结构化对象,例如:
{
"account": "xx",
"policy_name": "xx",
"region_name": "华北2(北京)",
"region_id": "cn-beijing",
"severity": "严重",
"project": "mysite",
"alarm_time": "2026-05-09 17:26:11",
"time_window": "alarm_time +/- 15m",
"product": "clb",
"resource_id": "clb-xxx",
"instance_id": "",
"listener_id": "lsn-xxx",
"domain": "",
"ip": "",
"metric_name": "监听器/后端服务器异常个数",
"current_value": "AVG(xxx)[1m]:1Count",
"symptom": "",
"related_alerts": []
}如果某些字段缺失,要显式标记为“缺失信息”,不要自行脑补。
先判断这次故障的主起点更接近哪一层:
判断原则:
围绕主告警节点获取上下游拓扑。优先级如下:
1. 优先使用工作区中已存在且可复用的拓扑数据 2. 如果现有拓扑不覆盖目标资源,调用 `byted-volcengine-topology-builder` 3. 使用 `byted-volcengine-topology-analyzer` 展开目标节点的上下游、入口链路和受影响资源
这一步的目标不是“画图展示”,而是为后续做告警归并建立一个可分析的故障上下文。
在已展开的拓扑范围内,检查同一时间窗内其他资源是否也有异常信号。
异常来源可以包括:
如果当前无法直接查询告警平台,则应退化为:
拿到同拓扑异常后,至少要分成三类:
归并原则:
当出现以下情况时,按需使用补充能力:
使用原则:
综合以下证据后,再给出根因候选:
最终至少要回答:
最早触发的告警不一定最接近故障源头,可能只是更敏感的入口信号。
如果多条异常路径最终都汇聚到同一个资源、同一层组件或同一个资源组,应优先把它列为高置信候选根因。
例如:
至少满足以下一项,才能高置信归并:
建议按以下级别表达:
输出时优先使用以下结构:
结论: - 当前最可能的根因候选是 ... - 置信度是 ... - 当前优先处理节点是 ... 告警归并结果: - 主告警: ... - 已归并的派生告警: ... - 识别为噪声的告警: ... 拓扑与影响: - 故障入口: ... - 中间链路: ... - 下游关键资源: ... - 当前影响范围: ... 根因候选排序: - 候选 1: ... | 证据: ... - 候选 2: ... | 证据: ... - 候选 3: ... | 证据: ... 事实 / 推断 / 待确认: - 已确认事实: ... - 高置信推断: ... - 待确认项: ... 建议动作: - 先处理 ... - 再验证 ... - 如需升级,交接摘要如下 ...
使用这个 Skill 时,最终输出应尽量覆盖以下内容:
如果用户需要快速升级或交接,至少应给出:
排查建议至少覆盖三类内容:
处理方式:
处理方式:
处理方式:
处理方式:
欢迎来到 AgentKit 代码工坊(Samples)仓库! AgentKit 是火山引擎推出的企业级 AI Agent 开发平台,为开发者提供完整的 Agent 构建、部署和运维解决方案。平台通过标准化的开发工具链和云原生基础设施,显著降低复杂智能体应用的开发部署门槛。 本代码库包含了一系列示例和教程,帮助您理解、实现和集成 AgentKit 的各项功能到您的应用中。
Generate deterministic SVG algorithmic artwork. Invoke when the user asks for geometric,…
Optimize code performance through iterative improvements (max 2 rounds). Benchmark execution…
根据文字描述生成视频,一个生成图片和视频的工作流技能。依赖 skills: byted-web-search, image-generate, video-generate。注意:此…
Manage AgentKit skills, SkillHub/skillhub, skill centers, and skill spaces. Use this skill…
Upload files or directories to TOS-compatible object storage for Volcano Engine or BytePlus…
根据用户的功能需求,完成与 VeADK-Go 相关的功能; 包括:直接根据需求生成 Agent;将Enio Agent转换为VeADK-Go Agent。