AI Agent 告警配置
原名:agent-platform-alert-configuration
为 Agent Engine 等 AI 智能体运行环境规划指标、日志与告警规则。
中文 Skills 技能说明
适合已经运行线上智能体、需要发现错误率、延迟或资源异常的团队。它会从服务目标和实际故障场景设计告警,避免没有处置人的噪声;部署监控配置、通知渠道和 Terraform 变更前,要确认项目、收件人、费用与敏感日志边界。
上游能力依据
上游原始适用说明:Configures best-practice alerting policies for Google Cloud Vertex AI / Agent Platform agents on Agent Runtime. Use when analyzing, writing, or deploying alerting policies to monitor agent latency, error rates, and quality metrics (response quality, tool use, hallucination). Also use when provisioning online monitors for quality evaluation, or analyzing live metrics traffic footprints. NOTE: This skill currently only works for the Agent Runtime. Don''t use for configuring general GCP alert policies or non-agent GCP alerting policies.
上游 SKILL.md 主要章节(保留原文标题):
- Safety & Confirmation Tiers (CRITICAL)
- CRITICAL RULES
- Algorithm Selection & Policy Mapping Process
- Telemetry Metrics and PromQL Examples
- Agent Quality Metrics (Online Monitor)
- Metric Details & Aligners
- Metric Filter Example
- Online Monitor & Telemetry Provisioning
- Execution Plan: Online Monitor Provisioning
- Tooling Scripts
使用边界
先读取项目约定、依赖版本和现有测试,再提出最小改动。写文件、运行脚本、提交代码或发布前应检查差异并保留回退路径。
作者、翻译与许可证
- 原作者
- 中文翻译
- CEOFans翻译
- 许可证
- Apache-2.0
- 上游来源
- https://github.com/google/skills/tree/8db47666a1307cb838f056ac03193f85c42e2c69/skills/cloud/agent-platform-alert-configuration
适用范围
平台:linux、macos、windows;标签:Google Cloud、Agent、Platform、Alert
安全提示
基础静态扫描不等于绝对安全。技能可能调用命令、浏览器、云服务或本地文件,请在最小权限环境中使用,高风险操作必须人工确认。
如发现侵权、许可证或安全问题,可在本页前台提交投诉,管理员复核后可立即下架。