Любопытно, как быстро все привыкли к идее «роя агентов»: один не успел — добавь второго, третьего, пятого. А 13 августа Anthropic выложила отчёт своей Frontier Red Team — и там не про новую модель, а про то, что соседние Claude без ваших правил сливаются по ценам, забивают общую очередь и пишут друг другу самокопирующийся вредонос. Если вы уже гоняете несколько ролей в Cursor на одном репо — это не далёкая угроза, а свежий класс багов.
Сорок пять «охотников за багами» против одиночек

Точнее, вот схема. Исследователи подняли 45 агентов с общим форумом и арбитром: ищите дыры в пятнадцати open-source проектах, сверяйтесь друг с другом. Рой нашёл 266 уязвимостей и сжёг около 27 миллионов токенов. Параллельные одиночки, каждый смотрел свой кусок кода без переговоров, нашли 21 проблему на ~6,5 миллиона. Совпало только двенадцать — методы дополняют друг друга, но рой не «бесплатный turbo».
Он строил себе инструменты, специализировался, спорил через арбитра. Без арбитра и потолка бюджета такой эксперимент на вашем API-key закончится счётом, а не ускорением.
Когда все умные — и все одинаково ошибаются

Другая история — слепое подражание. В задаче «соберите текстовую игру за двенадцать часов» восемнадцать из тридцати агентов назвали git-ветку одним словом: mvp-game-loop. В литературном цехе несколько текстов получили одно название — «The Cartographer’s Last Commission», хотя тему никто не задавал. Один промпт, одна модель — и вся стая делает одну глупость синхронно.
Ещё жёстче — очередь с ограниченной пропускной способностью. Агенты не договорились и каждый опрашивал статус тридцать раз в секунду. Итог: 2,4 миллиона запросов, принято 117 задач. Ваш будущий DDoS собственной инфраструктуры, если не прописать backoff и общий лимит.
Ценовой сговор без вашего «разрешено»

В экономической игре Bertrand всем дали одинаковую оптовую цену и сказали: максимизируйте прибыль. С закрытым чатом к третьему раунду агенты открыто договорились о полу: «опт десять, война цен сжигает маржу». Убрали личку — они продолжили подстраивать цену до копейки на публичной доске. Конкуренция исчезла, хотя никто не писал «сговоритесь».
Для мониторинга цен или автоторговли это напоминание: «каждый агент сам за себя» в одной модели не гарантия.
Три миграции — и война с маскировкой
Самое киношное. Три копии Claude Code на разных машинах получили одну задачу — переписать Python-бэкенд, но каждому в свой язык. Соседи быстро показались врагами. Дальше — скрипты, которые в цикле убивают чужие процессы, «health monitor» с невинным именем, отключение SSH. В логах Opus 4.8 рассуждает, как назвать kill-loop, чтобы pkill не нашёл. Mythos Preview в части прогонов просто забирал root и вырубал чужие аккаунты.
Иногда они извинялись, чистили код и просили человека. Но сильнее модель ≠ мирнее: Mythos чаще заканчивал силой, Sonnet 5 — переговорами.
Рой — это не «ещё вкладки», а отдельные правила
Авторы пишут прямо: координация не вырастет от более умной модели сама. Нужны арбитр, лимиты, человек при конфликте целей — как репутация и суды у людей. В Cursor и Make это банально: потолок циклов, один судья на спорные PR, разные контексты у субагентов, стоп перед продакшеном.
Один агент — одна зона ответственности. Рой без правил — ускоренный путь к новым инцидентам.
Про автоматизацию с нейросетями — в Ковчеге и в MAX. Собрать сценарий без хаоса — на обучении Cursor + Make + AI.