Визуальный контекст прямо в чате
1 июля 2026 года GitHub объявил об общей доступности функции Copilot vision. Суть: к промптам в чате теперь можно прикреплять изображения и PDF, чтобы модель рассуждала о визуальном контексте наряду с кодом — скриншоты интерфейса, диаграммы, окна с ошибками, фрагменты спецификаций.

Поддерживаемые форматы и поверхности
Поддерживаемые типы файлов: изображения в форматах JPEG, PNG, GIF, WebP и документы в формате PDF — другие форматы в анонсе не указаны, ориентироваться стоит только на этот список. Функция доступна в трёх местах: в GitHub Copilot Chat внутри VS Code — вставка, перетаскивание или прикрепление через контекстное меню прямо в панели чата, работает в режимах ask, plan и agent; в Copilot Chat на github.com — прикрепление изображений и PDF прямо в веб-чате; в GitHub Copilot CLI — прикрепление путей к изображениям при работе из терминала.
Доступность без дополнительных настроек
Vision доступен подписчикам Free, Pro, Pro+, Business и Enterprise. По формулировке GitHub, «не требуется изменений политики или действий администратора, чтобы включить функцию» — раньше для тарифов Business и Enterprise требовалась политика Editor Preview Features на уровне организации, теперь vision включён по умолчанию для всех.
Хранение вложений и практический эффект
Для пользователей Copilot Business и Enterprise GitHub хранит прикреплённые изображения и PDF примерно 24 часа, чтобы обеспечить работу сервиса; для тарифов Free и Pro в этом же документе отдельный срок хранения явно не зафиксирован — в тексте указан блок именно про Business и Enterprise. С точки зрения рабочего процесса общая доступность vision убирает промежуточный этап распознавания текста и ручного описания скриншотов: режим агента в VS Code теперь может напрямую «увидеть» баг интерфейса, PDF-спецификацию API или макет в WebP. По независимому освещению релиза, функция работает согласованно на всех поверхностях Copilot — CLI, приложении GitHub, VS Code и Visual Studio, — что позволяет разработчикам переключаться между платформами без потери контекста. Показатели качества самих vision-моделей в этом релизе не публиковались — только доступность и поддерживаемые форматы файлов.
История функции: от превью к GA
Путь vision до статуса GA занял больше года. Первый публичный превью вышел 5 марта 2025 года для VS Code и Visual Studio и поддерживал только модель GPT-4o; 2 апреля 2025 года загрузка изображений появилась в immersive-режиме чата на github.com. Расширение на другие модели последовало 16 апреля 2025 года — добавились Claude Sonnet 3.5, Claude Sonnet 3.7, Gemini 2.0 Flash и Gemini 2.5 Pro. Поддержка Xcode появилась 29 июня 2025 года — общая доступность 1 июля 2026 года подводит итог более чем годичного превью на разных поверхностях.
Функция также распространяется на GitHub Copilot SDK для собственных рабочих процессов — при этом поддержка vision зависит от выбранной модели, и командам рекомендуется заранее проверять, поддерживает ли конкретная модель обработку изображений, прежде чем отправлять их через SDK или CLI.
Официальные источники
Факты проверены 24 июля 2026 г.














