agent-platform-alert-configuration
Agent Platform Alert Configuration — официальный skill Google для подготовки best-practice alerting policies AI-агентов на метриках OpenTelemetry. Он предназначен для случаев, когда нужно настроить наблюдение за надёжностью, качеством, затратами, безопасностью и security-сигналами агента, а результатом должны быть конфигурационные Terraform-файлы. Для reliability, cost, safety и security обязательна телеметрия OTel: если агент её не эмитит, политика не получит поток данных для оценки. Для quality alerts источник отдельно указывает зависимость от Vertex AI Online Monitors. До генерации конфигурации навык требует строгого discovery. Пользователь должен явно указать целевой Google Cloud Project; нельзя выбрать проект из окружения или прошлых запросов. Сначала запускается gather_agent_info.py с project-id и agent-name, чтобы определить runtime агента, telemetry, metric scopes и связанные данные. При неполном результате выполняется fallback: проверяется metric scope через gcloud или Terraform-ресурсы google_monitoring_monitored_project, а при неоднозначности требуется уточнить scoping project. Затем в целевом каталоге сканируются существующие агрегированные policies, чтобы не создать дубликаты для тех же метрик. По инструкции набор reliability состоит ровно из пяти политик: anomaly latency, fast-burn error rate на окне 1 час, slow-burn error rate на окне 3 дня, model call error rate и tool call error rate через SQL-based Observability Analytics Alerting. Quality содержит три политики — final response quality, tool use quality и hallucination — и требует Vertex AI Online Monitors. Для cost предусмотрена одна политика rapid token burn rate, для safety — одна политика высокой частоты Model Armor safety trigger, для security — одна политика высокой частоты IAM permission denied trigger. Такой перечень задаёт проверяемый минимум и не разрешает скрыто пропустить поддерживаемый тип мониторинга. Конфигурация пишется только в .tf файлы; SQL-based alerting требует provider version с поддержкой condition_sql. По умолчанию policies должны быть динамическими и охватывать ресурсы группировкой, без жёсткой привязки к одному agent ID или имени, если пользователь явно не попросил обратное. Notification channels нельзя угадывать или брать из найденных файлов без подтверждения. После генерации выполняются cleanup фоновых задач и config linting. Навык также требует пояснить обычным языком, какую величину измеряет каждая политика, как работает алгоритм и что означает trigger. Ограничения существенны: без подтверждённого project ID, telemetry, metric scope и каталога существующих policies безопасная конфигурация невозможна; сам skill готовит Terraform и проверяет структуру, но deployment и каналы уведомлений требуют отдельного разрешения и явных данных.
Для чего подходит
- Настройка алертов для AI-агента
- Мониторинг latency, ошибок и token usage
- Контроль качества через Vertex AI Online Monitors
Установка
Сначала прочитайте SKILL.md и scripts в исходном репозитории. Затем выполните команду в каталоге проекта:
npx skills add https://github.com/google/skills/tree/main/skills/cloud/agent-platform-alert-configuration