Composer 2.5 в Cursor
Умнее на длинных задачах, дешевле флагманов — разбор для вайбкодинга и автоматизации контента
Composer 2.5 — собственная агентная модель Cursor для кода и инструментов в IDE. В мае 2026 команда представила заметный апгрейд поверх Composer 2: модель лучше держит длинные сессии, точнее следует сложным инструкциям и приятнее в диалоге — не только по цифрам бенчмарков, но и по «поведению в бою».
Для аудитории Kovcheg это не абстрактная новость про ML: это инструмент, которым вы уже пользуетесь в вайбкодинге, контент-заводе и автоматизации. Ниже — что изменилось, сколько стоит и когда имеет смысл переключиться.
Что такое Composer 2.5 и чем он отличается от Composer 2
Composer — линейка моделей Cursor, заточенных под агентную работу в редакторе: правки файлов, терминал, вызов инструментов, длинные цепочки шагов. Версия 2.5 — эволюция Composer 2, а не «другой продукт с нуля».
Базовый чекпоинт тот же: открытая Kimi K2.5 от Moonshot. Cursor накладывает поверх неё своё дообучение и обучение с подкреплением (RL). По их графику на базу приходится порядка 15% вычислений, остальное — собственный стек тренировки.
Для кого эта модель
- Разработчик и вайбкодер — рефакторинг, тесты, многофайловые правки.
- Маркетолог / контент — скрипты, лендинги, интеграции Make и MCP без «классического» бэкграунда.
- Владелец продукта — быстрые прототипы и автоматизация рутины в Cursor как единой среде.
Главные улучшения: длинные задачи, инструкции и стиль
Cursor прямо говорит: часть прогресса не ловится стандартными бенчмарками — важны калибровка усилий (effort), стиль общения и устойчивость на длинных траекториях. На практике это значит меньше «срывов» посередине большого ТЗ и более предсказуемый тон ответа.
Когда переключаться с Composer 2
Имеет смысл, если вы регулярно упираетесь в обрыв длинной сессии, путаете модель сложным промптом или платите за внешние флагманы там, где хватило бы своей модели Cursor. Для коротких вопросов разница может быть незаметна.
Визуальный блок · не hero
Цена и бенчмарки в одном кадре
- Terminal-Bench 2.5 ≈ уровень Opus при заметно меньшей цене за задачу.
- На длинных агентных сценариях выигрывает стабильность, не «магия одной цифры».
- Сравнивайте свой реальный пайплайн, а не только таблицу вендора.
Как устроено обучение: обратная связь и синтетика
В блоге Cursor разобраны три технических слоя — без них 2.5 не «чуть умнее», а по-другому учится на ошибках.
Targeted RL с текстовой подсказкой
На длинных траекториях (сотни тысяч токенов) общая награда в конце — шумный сигнал: непонятно, какой шаг сломал задачу. Решение — короткая текстовая подсказка в момент ошибки (например, неверный tool call), затем on-policy distillation: «учитель» с подсказкой и «ученик» без неё сближаются по распределению токенов.
Синтетические задачи в 25 раз чаще
Когда модель начинает «закрывать» обычные coding-задачи, тренировку усложняют синтетикой на реальных кодовых базах. Пример — feature deletion: агент удаляет код так, чтобы тесты проходили, но фича исчезла; задача — восстановить фичу. Такой подход масштабируют, но требует мониторинга «хаков» награды.
Отдельно упоминают Sharded Muon и dual mesh HSDP — это про масштаб инфраструктуры обучения MoE-моделей, а не про настройки в вашем Cursor. Для читателя Kovcheg важен вывод: 2.5 — продукт тяжёлой инженерии, а не косметический апдейт.
База Kimi K2.5 и планы Cursor со SpaceXAI
Composer 2.5 остаётся на открытом чекпоинте Kimi K2.5 — важно для прозрачности и споров весны 2026 про «свою» vs «чужую» модель. Параллельно Cursor строит более крупную модель с нуля вместе со SpaceXAI (xAI): заявлено 10× compute и кластер Colossus 2. Это будущий скачок; 2.5 — сильный промежуточный релиз на текущей базе.
Что это значит для доверия к «своей» модели
Смотрите на поведение в ваших задачах: стабильность tool use, качество диффов, цену за сессию. Бенчмарки — ориентир, не приговор.
Бенчмарки и цена: где выгодно, а где лучше другая модель
По публичным оценкам (в т.ч. пересказу на Habr): Terminal-Bench 2.0 у Composer 2.5 около 69.3% — близко к Claude Opus 4.7 и ниже GPT-5.5 на том же тесте. На SWE-Bench Multilingual картина сопоставимая с топом. Главный аргумент Cursor — стоимость: на CursorBench ~$1 за задачу против ~$7 у Opus при схожем качестве.
Fast-вариант и двойной лимит на первую неделю
API: $0.50 / M input и $2.50 / M output; fast с той же «интеллектуальностью» — $3 / $15. В продукте по умолчанию fast. Первую неделю после релиза — удвоенный included usage.
Подробности — в документации Cursor.
Попробовать Cursor с бонусом по реферальной программе можно по этой ссылке — удобно, если вы только подключаете AI-IDE к своему стеку.
Практика в Cursor: сценарии для вайбкодинга
Длинный рефакторинг
Многофайловые правки, миграция API, выравнивание стиля — сильная сторона 2.5. Дайте чёткий чеклист и границы «не трогать».
Контент-завод
Скрипты публикации, PHP-шаблоны темы, MCP Wordstat, сценарии Make — связка, которую мы используем в Kovcheg Office. Composer 2.5 снижает цену длинных агентных прогонов.
Системно освоить автоматизацию и вайбкодинг помогает обучение по Make на kv-ai.ru — логичное продолжение, если вы переводите эксперименты в Cursor в устойчивые пайплайны.
Как включить Composer 2.5 и не сжечь лимиты
- Обновите Cursor до актуальной версии.
- В выборе модели укажите Composer 2.5 (fast — по умолчанию).
- Для длинных задач заранее разбейте ТЗ на этапы и зафиксируйте критерии готовности.
- Следите за usage в первую неделю — действует удвоенный лимит, но привычки лучше заложить сразу.
- Сравните 2.5 с внешней моделью на 3–5 типовых задач вашего бизнеса, а не на абстрактном «напиши сортировку».
FAQ
Composer 2.5 заменяет Claude в Cursor?
Нет. Это отдельная модель в списке; Claude и GPT остаются для задач, где они сильнее по вашим критериям.
Нужна ли подписка Pro?
Composer входит в экосистему Cursor; на индивидуальных планах есть отдельный пул usage для Composer. На team/enterprise тарификация ближе к API-ценам из документации.
Чем 2.5 лучше для не-программиста?
Лучше держит длинное ТЗ и вежливее калибрует «усилие» — меньше лишней теории, если вы просили конкретный результат.
Где первоисточник?
Блог Cursor о релизе Composer 2.5 и страница модели в документации — главные официальные материалы.