azure-ai-vision
Azure AI Vision — это справочный skill для разработки решений на Azure AI Vision, собранный из материалов Microsoft Learn. В исходном SKILL.md его область охватывает принятие решений, ограничения и квоты, конфигурацию, интеграции, шаблоны вызова и deployment. В описании прямо названы Image Analysis, Read OCR containers, smart-crop thumbnails, удаление фона и анализ кадров видео. Навык не предназначен для Azure AI Custom Vision, Azure AI Video Indexer, Azure AI Document Intelligence или Azure AI Immersive Reader: для этих продуктов источник указывает использовать отдельные навыки. В разделе Decision Making собраны ссылки для выбора пути миграции Azure Vision Image Analysis, перехода на контейнер Read OCR v3.x и обновления приложений с Read v2.x на API v3.0. Это делает карточку полезной до написания кода: сначала можно определить, какой продуктовый путь и версия API соответствуют существующему приложению, а затем перейти к нужной процедуре. Источник не обещает универсальную совместимость и, наоборот, направляет агента к конкретным страницам документации Microsoft Learn. Раздел Limits & Quotas посвящён проверяемым ограничениям. В нём перечислены taxonomy categories Azure Vision, ограничения таксономии категоризации изображений, интерпретация scores для adult-content detection, пределы object detection, ограничения Image Analysis 4.0, особенности people detection и поддерживаемые языки OCR. Эти ссылки важны для production-сценариев: выбор функции должен учитывать не только название API, но и поддерживаемые языки, доступные категории, пределы функции и смысл возвращаемых оценок. Не следует выдумывать значения квот или порогов, если они не прочитаны на актуальной странице Microsoft Learn. В Configuration источник направляет к настройке Read OCR containers и к конфигурации Azure Blob Storage для получения изображений. В Integrations & Coding Patterns перечислены domain-specific models, анализ живых видеокадров, вызовы Image Analysis 3.2 и 4.0, Azure Vision Read v3.2 API, мультимодальные embeddings для image retrieval и клиентские библиотеки OCR. Такой набор покрывает как обычный image analysis, так и OCR, поиск по изображениям, видео и специализированные модели; конкретный вариант нужно выбирать по задаче и соответствующей официальной документации. Раздел Deployment ограничен установкой, конфигурацией и запуском Azure Vision Read OCR container локально или on-premises, включая prerequisites, runtime settings и deployment steps. Это важное ограничение области: карточка помогает разобраться с deployment контейнера Read, но не является общей инструкцией по развёртыванию любого Azure-сервиса или любого Vision workload. В frontmatter источника также указана зависимость от сетевого доступа: предпочтительный способ — использовать `mcp_microsoftdocs:microsoft_docs_fetch` с параметром `from=learn-agent-skill`, а запасной — получить Markdown через `fetch_webpage` с `from=learn-agent-skill&accept=text/markdown`. У skill есть Category Index с диапазонами строк и таблицами официальных URL. Агенту предлагается сначала найти нужную категорию, а затем прочитать указанный диапазон или связанную reference-страницу. В метаданных исходника указаны дата генерации 2026-06-21 и генератор docs2skills/1.0.0; сам файл рекомендует, если версия старше трёх месяцев, предложить загрузить актуальный вариант из репозитория. Поэтому карточка подходит для навигации по официальным материалам, выбора API, проверки лимитов и подготовки конфигурации, но фактические значения, поддерживаемые возможности и процедуры нужно подтверждать свежими страницами Microsoft Learn во время конкретной работы.
Для чего подходит
- Выбор Azure AI Vision API под задачу
- Настройка Image Analysis и OCR
- Проверка квот, интеграций и deployment
Установка
Сначала прочитайте SKILL.md и scripts в исходном репозитории. Затем выполните команду в каталоге проекта:
npx skills add https://github.com/MicrosoftDocs/Agent-Skills/tree/main/skills/azure-ai-vision