| На вход можно передать больше деталей, что особенно полезно для мелкого текста, сложного UI и насыщенных документных макетов. |
| Фокус на скриншотах, артефактах и документах | Anthropic отдельно отмечает, что рост разрешения важен для computer use и понимания screenshots, artifacts, documents. | Это не абстрактное улучшение для фотографий вообще: обновление прямо относится к рабочим изображениям, интерфейсам и документам. |
| Low-level perception | В числе улучшенных задач названы pointing, измерение, подсчёт и похожие операции. | Полезно, когда нужно не только прочитать изображение, но и ответить о положении, количестве или мелких деталях. |
| Image localization | Anthropic говорит об улучшении локализации, включая bounding box и обнаружение объектов на естественных изображениях. | Подходит для задач, где нужно выделить кнопку, поле ввода, область графика или конкретный объект. |
| Координаты пиксель в пиксель | Возвращаемые моделью координаты теперь соответствуют реальным пикселям изображения 1:1. | В сценариях автоматизации меньше ручной возни с пересчётом масштаба между ответом модели и исходным скриншотом. |
Ключевой эффект — модель может принять изображение с более высоким пределом детализации. Если раньше скриншот или страница документа сильно уменьшались перед отправкой в модель, мелкий текст, подписи, иконки и элементы интерфейса могли теряться ещё до анализа. При лимите 2576 px / 3,75 Мп у изображения больше шансов сохранить важные детали в одном запросе.
Важно не переоценивать это обновление. Более высокий лимит не превращает размытый скан, пережатую картинку или плохую фотографию в идеальный источник данных. Наибольшая польза появляется там, где исходное изображение достаточно чёткое, но слишком плотное по информации для старого порога разрешения.
Скриншот почти всегда плотнее обычной фотографии: рядом находятся кнопки, меню, иконки, поля ввода, таблицы, сообщения об ошибках, боковые панели и подписи к графикам. Anthropic прямо указывает, что поддержка более высокого разрешения в Opus 4.7 особенно важна для computer use и понимания скриншотов.
Для автоматизации не менее важна новая работа с координатами. Если модель возвращает координаты 1:1 с реальными пикселями изображения, их проще напрямую использовать для клика, выделения области, проверки положения элемента или передачи в другой инструмент. Раньше в подобных сценариях часто приходилось учитывать, что картинку могли масштабировать, а координаты нужно пересчитывать обратно к оригиналу.
Документ или слайд — это не только текст. Там могут быть таблицы, диаграммы, подписи мелким кеглем, заголовки, колонтитулы, несколько колонок и визуальные блоки. Anthropic относит documents и artifacts к тем типам контента, для которых обновление Vision в Opus 4.7 особенно важно.
Страница продукта Claude Opus 4.7 у Anthropic также описывает модель в контексте улучшенного vision и профессиональных результатов вроде interfaces, slides и docs. Поэтому сценарии вроде чтения скриншотов презентаций, анализа макета документа или проверки содержимого в изображении документа — разумные кандидаты для практического теста на собственных данных.
Для многих задач с изображениями недостаточно понять, что именно находится на экране. Нужно ещё определить, где это находится. Anthropic говорит об улучшениях image localization, включая bounding box, обнаружение объектов, а также низкоуровневые задачи восприятия — pointing, измерение и подсчёт.
В контексте UI и документов это может быть принципиально. Например, модель должна не просто сообщить, что на экране есть нужная кнопка, а указать её область; не просто распознать график, а локализовать сам график или конкретную точку на нём. Именно такие задачи ближе всего к тому направлению улучшений, которое Anthropic описывает для Opus 4.7.
В использованных официальных материалах Anthropic не приводит отдельный публичный benchmark вида: распознавание текста на скриншотах стало лучше на определённый процент, а OCR документов — на другой процент. Поэтому корректнее формулировать осторожно: Vision в Opus 4.7 получил более высокий лимит разрешения, улучшения perception и localization, а Anthropic отдельно связывает эти изменения со скриншотами, артефактами и документами.
Иными словами, есть основания ожидать лучшей работы с плотными изображениями там, где узким местом было разрешение. Но пока нет открытого числа, которое можно честно перенести на любой тип скриншота, PDF-страницы или скана.
Если вы рассматриваете Opus 4.7 для продукта, внутренней автоматизации или анализа документов, лучше проверять не на одной удачной картинке, а на наборе типовых случаев:
Самая практичная часть обновления Claude Opus 4.7 Vision — работа с более детальными изображениями и более точной локализацией. Три пункта стоит запомнить: лимит вырос до 2576 px / 3,75 Мп, улучшены perception и image localization, а координаты ответа теперь соответствуют пикселям изображения 1:1.
Для скриншотов, документов, артефактов и сценариев computer use это заметное инженерное улучшение. Но если цель — промышленное OCR или надёжная автоматизация интерфейсов, итоговый вывод всё равно должен опираться на benchmark на ваших собственных данных, а не только на сам факт роста разрешения.