eks-operation-review
eks-operation-review — это комплексная проверка операционной готовности Amazon EKS по AWS EKS Best Practices Guide. Навык используется для аудита или оценки кластера, его безопасности, надёжности, стоимости, сети, масштабирования и готовности к обновлению. В начале нужно определить целевые кластеры: принять конкретные имена и регионы либо область вроде всех кластеров в выбранных регионах. Без этой границы нельзя честно выдавать общий результат за аудит всей инфраструктуры. При сборе данных приоритет у Kubernetes API, если он доступен через подключённый MCP или прямые инструменты: это наиболее актуальное состояние кластера. AWS API и CloudWatch используются как fallback и для сведений, которых нет в Kubernetes API. Для каждого кластера собираются версия и platform version EKS, журналы control plane, шифрование secrets, доступ endpoint и режим аутентификации; узлы, capacity, conditions, managed node groups, Karpenter NodePools и EC2NodeClasses; версии add-ons; VPC CNI, CoreDNS, NetworkPolicy, services, VPC, подсети и NAT; RBAC, access entries, aws-auth, Pod Identity или IRSA, security context и Pod Security Standards; workloads, probes, requests/limits, HPA, PDB, topology spread; StorageClass, PV/PVC, quotas и limits. Отдельный блок observability охватывает последние семь дней. Проверяются Container Insights, control-plane и EC2-метрики, включая CPU, память, filesystem, количество узлов, failed nodes, рестарты контейнеров, задержку API, throttling, pending pods и webhook rejections. Дополняются CloudWatch Logs с паттернами ERROR, 429, OOMKilled, FailedScheduling и Evicted, CloudTrail-события конфигурации и доступа, а также EKS Upgrade Insights для готовности к обновлению и misconfiguration. Анализ организуется по разделам best-practices: security, reliability, Karpenter, Cluster Autoscaler, EKS Auto Mode, networking, scalability, data-plane scaling, upgrades и cost optimization. Для каждого найденного факта назначается CRITICAL, HIGH, MEDIUM, LOW или INFO; рекомендации должны быть связаны с собранным состоянием, а не с предположением. Навык отдельно смотрит на least privilege, privileged containers, encryption, log coverage, multi-AZ, probes, PDB, resource utilization, Spot и Graviton, gp2/gp3, subnet IP headroom, CoreDNS и версии add-ons. Результат зависит от предоставленного доступа к Kubernetes, AWS APIs, CloudWatch и CloudTrail; сам SKILL.md не исправляет кластер и не создаёт наблюдаемость. Если источник данных недоступен, это ограничение проверки нужно сохранить в отчёте. Поэтому eks-operation-review полезен как воспроизводимая карта сбора evidence и классификации рисков, но не заменяет доступ к live-состоянию, семь дней метрик, AWS Best Practices Guide или ручное решение владельца перед изменениями и upgrade.
Для чего подходит
- Аудит EKS по best practices
- Проверка security, reliability и cost optimization
- Оценка networking, масштабирования и upgrade readiness
Установка
Сначала прочитайте SKILL.md и scripts в исходном репозитории. Затем выполните команду в каталоге проекта:
npx skills add https://github.com/aws-samples/sample-devops-agent-tools/tree/main/skills/eks-operation-review