Cursor Composer 2.5: как новая модель для кода конкурирует с Claude Opus 4.7 и GPT‑5.5
Cursor выпустила модель Composer 2.5 (18 мая 2026). В бенчмарке SWE‑Bench Multilingual она набрала 79,8%, почти сравнявшись с Claude Opus 4.7 (80,5%) и опередив GPT‑5.5 (77,8%).
ОпубликовалОтредактировано с помощью GPT-5.5Изображения созданы с помощью GPT Image 2
Cursor выпустила модель Composer 2.5 (18 мая 2026). В бенчмарке SWE‑Bench Multilingual она набрала 79,8%, почти сравнявшись с Claude Opus 4.7 (80,5%) и опередив GPT‑5.5 (77,8%).
Стоимость значительно ниже многих конкурентов: примерно $0,50 за миллион входных токенов и $2,50 за миллион выходных, что важно для длительных агентных задач разработки.
Модель построена на чекпойнте Kimi K2.5 и дополнительно обучена на большом количестве синтетических задач программирования и reinforcement learning.
Cursor Composer 2.5: Benchmarks, Pricing, and How It Stacks Up to Claude Opus 4.7 and GPT‑5.5Cursor’s Composer 2.5 aims to deliver frontier‑level coding performance while dramatically lowering the cost of running AI coding agents.
Промпт ИИ
Create a landscape editorial hero image for this Studio Global article: Cursor Composer 2.5: Benchmarks, Pricing, and How It Stacks Up to Claude Opus 4.7 and GPT‑5.5. Article summary: Cursor’s Composer 2.5 is an in‑house coding model released May 18, 2026 that scores about 79.8% on SWE‑Bench Multilingual and 69.3% on Terminal‑Bench 2.0—roughly matching Claude Opus 4.7 on some benchmarks while costi.... Topic tags: cursor, ai coding, developer tools, ai models, benchmarks. Reference image context from search candidates: Reference image 1: visual subject "Composer 2.5 matches Opus 4.7 and GPT-5.5 on CursorBench 3.1 but costs less than a dollar per task - compared to up to eleven dollars for the competition. | Image: Cursor" source context "Cursor's Composer 2.5 matches Opus 4.7 and GPT-5.5 benchmarks ..." Reference image 2: visual subject "Composer 2.5 vs Opus | The Results Are Brutal Merv
openai.com
Что такое Cursor Composer 2.5
Composer 2.5 — это новая специализированная модель для программирования от компании Anysphere, разработчика популярной среды разработки Cursor IDE. Она стала доступна 18 мая 2026 года и ориентирована на полноценные рабочие процессы разработки, а не только на генерацию отдельных фрагментов кода.
В отличие от обычных AI‑ассистентов, Composer 2.5 предназначен для так называемой agentic‑разработки — когда модель может выполнять многошаговые действия: анализировать репозиторий, планировать изменения, редактировать несколько файлов, запускать команды в терминале и повторно прогонять тесты.
Studio Global AI
Продолжайте свое исследование
На этой странице есть ответ, подтвержденный источником, который вы можете продолжить внутри Studio Global.
Каков краткий ответ на вопрос «Cursor Composer 2.5: как новая модель для кода конкурирует с Claude Opus 4.7 и GPT‑5.5»?
Cursor выпустила модель Composer 2.5 (18 мая 2026). В бенчмарке SWE‑Bench Multilingual она набрала 79,8%, почти сравнявшись с Claude Opus 4.7 (80,5%) и опередив GPT‑5.5 (77,8%).
Какие ключевые моменты необходимо проверить в первую очередь?
Cursor выпустила модель Composer 2.5 (18 мая 2026). В бенчмарке SWE‑Bench Multilingual она набрала 79,8%, почти сравнявшись с Claude Opus 4.7 (80,5%) и опередив GPT‑5.5 (77,8%). Стоимость значительно ниже многих конкурентов: примерно $0,50 за миллион входных токенов и $2,50 за миллион выходных, что важно для длительных агентных задач разработки.
Что мне делать дальше на практике?
Модель построена на чекпойнте Kimi K2.5 и дополнительно обучена на большом количестве синтетических задач программирования и reinforcement learning.
По словам разработчиков, новая версия стала заметно лучше справляться с длительными задачами, более стабильно следует сложным инструкциям и удобнее работает в режиме совместной разработки внутри IDE.
Результаты бенчмарков: сравнение с Opus 4.7 и GPT‑5.5
По опубликованным результатам тестов Composer 2.5 находится примерно в той же категории производительности, что и ведущие модели для программирования.
Эти результаты показывают несколько важных нюансов:
В SWE‑Bench Multilingual — тесте, где модели должны исправлять реальные баги в проектах GitHub — Composer 2.5 почти догоняет Claude Opus 4.7 и даже опережает GPT‑5.5 в приведённом сравнении.
В Terminal‑Bench 2.0, который проверяет работу агентных моделей в терминале (сборка, команды, тестирование), модель Cursor практически сравнялась с Opus 4.7, но заметно уступает GPT‑5.5.
По сравнению с предыдущей версией прогресс значительный: например, результат в SWE‑Bench вырос с 73,7% до 79,8%.
В целом это означает, что Composer 2.5 способен конкурировать с ведущими моделями на части задач программирования, хотя не лидирует во всех типах тестов.
Почему цена может изменить рынок
Одним из самых обсуждаемых аспектов релиза стала стоимость использования.
Тариф стандартной версии Composer 2.5:
$0,50 за миллион входных токенов
$2,50 за миллион выходных токенов
Также есть ускоренная версия:
$3,00 за миллион входных токенов
$15,00 за миллион выходных токенов
Для сравнения, по оценкам ряда публикаций, модели семейства Claude Opus могут стоить около $5 за миллион входных токенов и $25 за миллион выходных.
Это имеет большое значение, потому что агентные задачи разработки потребляют огромное количество токенов. Один рабочий цикл может включать:
поиск по репозиторию
планирование изменений
редактирование файлов
компиляцию
запуск тестов
Каждый шаг требует дополнительных запросов к модели. Чем дешевле токены, тем больше итераций можно выполнять без резкого роста затрат.
На чем построена модель и как она обучалась
Composer 2.5 основана на открытом чекпойнте Kimi K2.5 от Moonshot AI, который команда Cursor использовала как базовую модель и затем значительно дообучила.
Сообщается, что в процессе обучения использовались:
примерно в 25 раз больше синтетических задач программирования, чем в предыдущем поколении
распределение вычислительных ресурсов, где около 85% бюджета ушло на дополнительное обучение и reinforcement learning, а не только на базовую модель
Синтетические задачи позволяют моделям многократно тренироваться на типичных сценариях разработки — например, планировании изменений в коде, исправлении ошибок и повторном запуске тестов.
Стратегия Cursor: меньше зависимости от крупных AI‑провайдеров
Выпуск Composer 2.5 также отражает стратегический поворот в развитии Cursor.
Ранее IDE активно использовала сторонние модели от OpenAI, Anthropic и Google для работы своих функций.
Разработка собственных моделей дает несколько преимуществ:
снижение стоимости инференса
меньшая зависимость от внешних API
больший контроль над поведением модели внутри IDE
Это особенно важно на фоне конкурентов вроде Claude Code, где Anthropic объединяет собственную модель и инструмент разработки в единую систему.
Создавая собственную линейку моделей Composer, Cursor фактически превращается из компании‑разработчика IDE в компанию, которая также развивает собственные AI‑модели для программирования.
Итог
Composer 2.5 не становится абсолютным лидером во всех бенчмарках: GPT‑5.5 остаётся впереди в некоторых тестах агентных систем, а Claude Opus 4.7 остаётся крайне сильным конкурентом.
Однако сочетание почти фронтирного уровня программирования и значительно более низкой стоимости делает эту модель заметным событием на рынке.
Если Cursor продолжит улучшать свои модели при сохранении такого ценового преимущества, это может заметно изменить экономику использования AI‑ассистентов для разработки — особенно в сценариях с длительными агентными задачами внутри IDE.