Иными словами, публичная картина асимметрична: у Claude сейчас проще увидеть API-специфику, длинный контекст и нюансы ценообразования; у GPT-5.5 лучше документирован сценарий ChatGPT с инструментами и есть подробная вендорская история про бенчмарки.
inference_geo действует множитель 1,1× на категории токенов.| Критерий | Claude Opus 4.7 | GPT-5.5 | Что это значит на практике |
|---|---|---|---|
| Публичные источники | Есть страница Anthropic, Claude API docs, Cloudflare Docs и listing в OpenRouter. | Есть релиз OpenAI и статья OpenAI Help Center про GPT-5.5 Thinking в ChatGPT. | У обеих моделей есть источники, но они раскрывают разные стороны продукта. |
| API и цена | В Claude API docs явно упомянуты Opus 4.7, категории token pricing и 1,1× множитель для US-only inference. | В доступных OpenAI API/pricing источниках GPT-5.5 token pricing не раскрыт так же явно; фрагмент OpenAI developer docs показывает Latest: GPT-5.4. | |
| Контекстное окно | Claude API docs указывают full 1M token context window at standard pricing для Opus 4.7. | В этих источниках нет столь же явной API-спецификации по context/output для GPT-5.5; параметры GPT-5 нельзя автоматически переносить на GPT-5.5. | |
| Инструменты ChatGPT | Источники по Claude в основном про модель, API, провайдеров и routing. | ||
| Бенчмарки | WaveSpeed как сторонняя страница приводит SWE-bench Pro 64,3% и CursorBench 70% для Claude Opus 4.7. | OpenAI приводит в релизе 84,9% на GDPval и другие сравнения в пользу GPT-5.5. | Сравнивать нужно осторожно: источники и методики подачи данных разные. |
Для команды, которая покупает API или строит платформу поверх LLM, главный вопрос обычно не в названии модели. Важнее другое: сколько стоит миллион токенов, какой контекст доступен, есть ли региональные настройки инференса, как считается кэш и что произойдёт при длинных запросах.
По Claude Opus 4.7 это описано заметно конкретнее. Claude API docs указывают, что для Claude Opus 4.7, Opus 4.6 и более новых моделей параметр inference_geo с US-only inference добавляет множитель 1,1× ко всем token pricing categories: входным токенам, выходным токенам, cache writes и cache reads. Там же сказано, что Claude Mythos Preview, Opus 4.7, Opus 4.6 и Sonnet 4.6 включают full 1M token context window at standard pricing.
Если нужен грубый ориентир по долларам, сторонний агрегатор CloudPrice указывает для Claude Opus 4.7 starting at $5.00 за 1 млн входных токенов и $25.00 за 1 млн выходных токенов, а также 1.0M context window и up to 128K output tokens. Но это именно сторонний агрегатор: для закупки, контракта и production-развёртывания всё равно нужно сверяться с Anthropic или вашим фактическим провайдером.
С GPT-5.5 ситуация менее прозрачна именно в API/pricing части. Релиз OpenAI и Help Center подтверждают модель и её сценарии в ChatGPT, но в доступных OpenAI API/pricing источниках GPT-5.5 token pricing не указан так же ясно. Важно не подменять это данными по GPT-5: страница GPT-5 у OpenAI показывает 400K context length, 128K max output tokens и цены за 1 млн токенов, но эти параметры относятся к GPT-5, а не к GPT-5.5.
Если ваша нагрузка — это большие кодовые базы, длинные договоры, исследовательские подборки, документация на сотни страниц или многошаговые агентные процессы, контекстное окно влияет не только на качество ответа. Оно меняет архитектуру: нужно ли резать документы, строить retrieval, делать промежуточные summaries, сколько будет стоить один прогон и сколько раз модель придётся переспрашивать.
Здесь Claude Opus 4.7 выглядит понятнее: Claude API docs прямо указывают full 1M token context window at standard pricing. CloudPrice дополнительно перечисляет для Claude Opus 4.7 1.0M context window и up to 128K output tokens, но эту часть лучше воспринимать как справочную информацию стороннего сервиса, а не как замену официальным лимитам вашего провайдера.
Для GPT-5.5 релиз OpenAI и Help Center дают позиционирование, бенчмарки и сведения о поддержке инструментов ChatGPT, но не дают столь же ясной API-спецификации по context window и max output в рамках этих источников. Поэтому, если главный критерий — длинный контекст в API, Claude Opus 4.7 сейчас проще закладывать в технический дизайн и оценку рисков.
Другая ситуация — когда вы не строите собственный API-слой, а работаете внутри ChatGPT: исследуете тему, анализируете файлы, пишете документы, используете встроенные инструменты и ожидаете, что модель будет переключаться между действиями без ручной сборки пайплайна.
Здесь у GPT-5.5 есть прямое подтверждение. OpenAI Help Center пишет, что GPT-5.3 Instant и GPT-5.5 Thinking поддерживают каждый текущий инструмент ChatGPT, то есть могут использовать текущие функции ChatGPT без ограничения, с учётом указанной GPT-5.5 Pro exception.
По Claude Opus 4.7 доступные источники говорят о другом: продуктовая страница Anthropic, API docs, Cloudflare Docs и OpenRouter listing описывают модель, API, провайдеров, routing и доступность через платформы. Это полезно для разработчиков и платформенных команд, но не является аналогом справки OpenAI о поддержке инструментов внутри ChatGPT.
OpenAI в релизе GPT-5.5 приводит несколько сравнений с Claude Opus 4.7. Эти данные стоит читать как вендорскую публикацию OpenAI, а не как окончательный независимый рейтинг всех моделей.
| Бенчмарк | GPT-5.5 | Claude Opus 4.7 | Как читать результат |
|---|---|---|---|
| Terminal-Bench 2.0 | 82,7% | 69,4% | В таблице OpenAI engineering/terminal-сценарии выглядят сильнее у GPT-5.5. |
| GDPval | 84,9% | 80,3% | GDPval проверяет способность агентов выполнять хорошо заданную knowledge work по 44 профессиям; OpenAI указывает 84,9% для GPT-5.5. |
| Toolathlon | 55,6% | 48,8% | В сравнении OpenAI задачи на tool-use также в пользу GPT-5.5. |
| CyberGym | 81,8% | 73,1% | OpenAI показывает преимущество GPT-5.5 и отдельно говорит о safeguards для такого уровня cyber capability. |
OpenAI также пишет, что GPT-5.5 заметно улучшился по сравнению с GPT-5.4 на GeneBench — eval для многоэтапного анализа научных данных в genetics и quantitative biology.
У Claude Opus 4.7 тоже есть публичные benchmark-сигналы, но они приходят из другого типа источника. WaveSpeed указывает для Claude Opus 4.7 64,3% на SWE-bench Pro, 70% на CursorBench и 3x more production tasks resolved. Эти цифры полезны как ориентир по coding-сценариям, но их нельзя просто сложить в одну «нейтральную таблицу» с данными релиза OpenAI: разные площадки, разные наборы тестов, разная логика презентации.
Начните с Claude Opus 4.7. Не потому, что он обязан выиграть любой тест, а потому что публичная документация лучше помогает сделать первичный расчёт: 1M context, 1,1× множитель для US-only inference и категории токенов описаны в Claude API docs.
Сначала попробуйте GPT-5.5, если он доступен в вашем плане и регионе. Главное доказательство здесь — статья OpenAI Help Center: GPT-5.5 Thinking поддерживает текущие инструменты ChatGPT, с оговоркой про GPT-5.5 Pro exception.
Тестируйте обе модели. У OpenAI есть сильные цифры по Terminal-Bench, Toolathlon и CyberGym для GPT-5.5. У WaveSpeed есть отдельные coding-метрики для Claude Opus 4.7, включая SWE-bench Pro и CursorBench. Для реального выбора важнее прогнать ваши собственные репозитории, CI, баги, migration-задачи, лимиты latency и стоимость ручной проверки.
Пока преимущество в публичной спецификации у Claude Opus 4.7: в Claude API docs прямо указано full 1M token context window at standard pricing. Сторонний CloudPrice также приводит 1.0M context window и up to 128K output tokens, но перед production-запуском эти ограничения нужно перепроверить у фактического провайдера.
anthropic/claude-opus-4.7; для GPT-5.5 нужно отдельно проверять доступность, официальный model ID и pricing в том слое продукта OpenAI, которым вы пользуетесь.inference_geo.Если нужен короткий практический ответ: Claude Opus 4.7 сейчас лучше подходит для команд, которым важны понятные API-документы, 1M context и предварительно просчитываемое развёртывание; GPT-5.5 выглядит сильнее для пользователей, уже работающих в ChatGPT/OpenAI-экосистеме и рассчитывающих на инструментальные agent-сценарии. Эти выводы опираются не на абстрактное «кто умнее», а на то, какие именно сведения доступны в источниках: у Claude лучше раскрыты API и длинный контекст, у GPT-5.5 — ChatGPT tool support и вендорские benchmark-сравнения.
Поэтому объявлять абсолютного победителя рано. Разумная схема выбора такая: для API, бюджета и длинного контекста — сначала Claude Opus 4.7; для ChatGPT workflow — сначала GPT-5.5; для сравнения качества — собственный eval на реальных задачах, а не только чтение benchmark-таблиц.
| Для предварительного бюджета и spreadsheet-модели Claude сейчас проще считать. |
| Для длинных документов, больших repo и long-running agents публичные данные сильнее у Claude. |
| GPT-5.5 Thinking, по Help Center, поддерживает все текущие инструменты ChatGPT с оговоркой про Pro exception. |
| Для работы в интерфейсе ChatGPT GPT-5.5 ближе к нужному сценарию. |