Maya Pro в Telegram

Composer 2.5 в Cursor

Умнее на длинных задачах, дешевле флагманов — разбор для вайбкодинга и автоматизации контента

Composer 2.5 — собственная агентная модель Cursor для кода и инструментов в IDE. В мае 2026 команда представила заметный апгрейд поверх Composer 2: модель лучше держит длинные сессии, точнее следует сложным инструкциям и приятнее в диалоге — не только по цифрам бенчмарков, но и по «поведению в бою».

Для аудитории Kovcheg это не абстрактная новость про ML: это инструмент, которым вы уже пользуетесь в вайбкодинге, контент-заводе и автоматизации. Ниже — что изменилось, сколько стоит и когда имеет смысл переключиться.

Анонс Composer 2.5 в блоге Cursor
Официальный анонс Composer 2.5

Что такое Composer 2.5 и чем он отличается от Composer 2

Composer — линейка моделей Cursor, заточенных под агентную работу в редакторе: правки файлов, терминал, вызов инструментов, длинные цепочки шагов. Версия 2.5 — эволюция Composer 2, а не «другой продукт с нуля».

Базовый чекпоинт тот же: открытая Kimi K2.5 от Moonshot. Cursor накладывает поверх неё своё дообучение и обучение с подкреплением (RL). По их графику на базу приходится порядка 15% вычислений, остальное — собственный стек тренировки.

Для кого эта модель

  • Разработчик и вайбкодер — рефакторинг, тесты, многофайловые правки.
  • Маркетолог / контент — скрипты, лендинги, интеграции Make и MCP без «классического» бэкграунда.
  • Владелец продукта — быстрые прототипы и автоматизация рутины в Cursor как единой среде.

Главные улучшения: длинные задачи, инструкции и стиль

Cursor прямо говорит: часть прогресса не ловится стандартными бенчмарками — важны калибровка усилий (effort), стиль общения и устойчивость на длинных траекториях. На практике это значит меньше «срывов» посередине большого ТЗ и более предсказуемый тон ответа.

Маркер: простыми словами. Reinforcement learning (RL) — модель много раз пробует решать задачи в среде и получает «награду» за удачный результат. Так учатся не только факты, но и поведение: какие инструменты вызывать, как не сбиваться с инструкции.

Когда переключаться с Composer 2

Имеет смысл, если вы регулярно упираетесь в обрыв длинной сессии, путаете модель сложным промптом или платите за внешние флагманы там, где хватило бы своей модели Cursor. Для коротких вопросов разница может быть незаметна.

Кривые effort: Composer 2.5 точнее калибрует усилие на сложных задачах
Калибровка усилия — отдельная ось улучшений 2.5

Визуальный блок · не hero

Цена и бенчмарки в одном кадре

  • Terminal-Bench 2.5 ≈ уровень Opus при заметно меньшей цене за задачу.
  • На длинных агентных сценариях выигрывает стабильность, не «магия одной цифры».
  • Сравнивайте свой реальный пайплайн, а не только таблицу вендора.

Как устроено обучение: обратная связь и синтетика

В блоге Cursor разобраны три технических слоя — без них 2.5 не «чуть умнее», а по-другому учится на ошибках.

Targeted RL с текстовой подсказкой

На длинных траекториях (сотни тысяч токенов) общая награда в конце — шумный сигнал: непонятно, какой шаг сломал задачу. Решение — короткая текстовая подсказка в момент ошибки (например, неверный tool call), затем on-policy distillation: «учитель» с подсказкой и «ученик» без неё сближаются по распределению токенов.

Маркер: простыми словами. On-policy distillation — способ точечно исправить поведение модели на конкретном шаге, не переписывая всю сессию заново.
Схема текстовой обратной связи при обучении Composer 2.5

Синтетические задачи в 25 раз чаще

Когда модель начинает «закрывать» обычные coding-задачи, тренировку усложняют синтетикой на реальных кодовых базах. Пример — feature deletion: агент удаляет код так, чтобы тесты проходили, но фича исчезла; задача — восстановить фичу. Такой подход масштабируют, но требует мониторинга «хаков» награды.

Синтетические задачи feature deletion для обучения агента
Стек обучения Composer 2.5: RL, синтетика и инфраструктура

Отдельно упоминают Sharded Muon и dual mesh HSDP — это про масштаб инфраструктуры обучения MoE-моделей, а не про настройки в вашем Cursor. Для читателя Kovcheg важен вывод: 2.5 — продукт тяжёлой инженерии, а не косметический апдейт.

База Kimi K2.5 и планы Cursor со SpaceXAI

Composer 2.5 остаётся на открытом чекпоинте Kimi K2.5 — важно для прозрачности и споров весны 2026 про «свою» vs «чужую» модель. Параллельно Cursor строит более крупную модель с нуля вместе со SpaceXAI (xAI): заявлено 10× compute и кластер Colossus 2. Это будущий скачок; 2.5 — сильный промежуточный релиз на текущей базе.

Что это значит для доверия к «своей» модели

Смотрите на поведение в ваших задачах: стабильность tool use, качество диффов, цену за сессию. Бенчмарки — ориентир, не приговор.

Бенчмарки и цена: где выгодно, а где лучше другая модель

По публичным оценкам (в т.ч. пересказу на Habr): Terminal-Bench 2.0 у Composer 2.5 около 69.3% — близко к Claude Opus 4.7 и ниже GPT-5.5 на том же тесте. На SWE-Bench Multilingual картина сопоставимая с топом. Главный аргумент Cursor — стоимость: на CursorBench ~$1 за задачу против ~$7 у Opus при схожем качестве.

Таблица бенчмарков Composer 2.5 и конкурентов

Fast-вариант и двойной лимит на первую неделю

API: $0.50 / M input и $2.50 / M output; fast с той же «интеллектуальностью» — $3 / $15. В продукте по умолчанию fast. Первую неделю после релиза — удвоенный included usage.

Маркер: простыми словами. Агентная модель — модель, которая не только пишет текст, но и планирует шаги, вызывает инструменты (файлы, терминал, поиск) и ведёт сессию как помощник-исполнитель.

Подробности — в документации Cursor.

Попробовать Cursor с бонусом по реферальной программе можно по этой ссылке — удобно, если вы только подключаете AI-IDE к своему стеку.

Практика в Cursor: сценарии для вайбкодинга

Длинный рефакторинг

Многофайловые правки, миграция API, выравнивание стиля — сильная сторона 2.5. Дайте чёткий чеклист и границы «не трогать».

Контент-завод

Скрипты публикации, PHP-шаблоны темы, MCP Wordstat, сценарии Make — связка, которую мы используем в Kovcheg Office. Composer 2.5 снижает цену длинных агентных прогонов.

Системно освоить автоматизацию и вайбкодинг помогает обучение по Make на kv-ai.ru — логичное продолжение, если вы переводите эксперименты в Cursor в устойчивые пайплайны.

Как включить Composer 2.5 и не сжечь лимиты

  1. Обновите Cursor до актуальной версии.
  2. В выборе модели укажите Composer 2.5 (fast — по умолчанию).
  3. Для длинных задач заранее разбейте ТЗ на этапы и зафиксируйте критерии готовности.
  4. Следите за usage в первую неделю — действует удвоенный лимит, но привычки лучше заложить сразу.
  5. Сравните 2.5 с внешней моделью на 3–5 типовых задач вашего бизнеса, а не на абстрактном «напиши сортировку».

FAQ

Composer 2.5 заменяет Claude в Cursor?

Нет. Это отдельная модель в списке; Claude и GPT остаются для задач, где они сильнее по вашим критериям.

Нужна ли подписка Pro?

Composer входит в экосистему Cursor; на индивидуальных планах есть отдельный пул usage для Composer. На team/enterprise тарификация ближе к API-ценам из документации.

Чем 2.5 лучше для не-программиста?

Лучше держит длинное ТЗ и вежливее калибрует «усилие» — меньше лишней теории, если вы просили конкретный результат.

Где первоисточник?

Блог Cursor о релизе Composer 2.5 и страница модели в документации — главные официальные материалы.

Подписаться на Maya Pro
Beget — надёжный хостинг и VPS