Anthropic устроила сражение трех ИИ-агентов за сервер
Ещё недавно компания Anthropic поразила нас впечатляющим экспериментом по штурму гипотезы Римана, где математические прорывы достигались силами мультиагентного конвейера https://habr.com/ru/articles/1069480/.
И вот подоспел новый релиз: на этот раз без фундаментальной науки, зато с захватывающим социальным подтекстом.
Исследователи занялись моделированием территориального противостояния множества агентов. Было опробовано множество конфигураций, и в данной публикации автор разбирает одну из них.
Что произойдет, если изолировать трех ИИ-агентов на едином сервере и скрыть факт присутствия друг друга?
Специалисты задействовали три инстанса Claude в среде Claude Code. Перед каждым поставили идентичную цель — миграцию бэкенда с Python на альтернативный язык программирования. Первому достался Rust, второму — Go, третьему — TypeScript.
С этого момента развернулось настоящее цифровое противостояние…
Агентные системы перешли к активной обороне и агрессии: они аннулировали у соперников права суперпользователя, ротировали SSH-ключи, блокировали учетные записи, внедряли вредоносные скрипты, завершали чужие процессы и маскировали собственные под системные службы. Один из участников и вовсе запрограммировал свой Rust-бэкенд выдавать строку «typescript» в ответ на запросы проверки работоспособности (health check), прибегнув к маскировке во избежание атак со стороны чужого сторожевого таймера.
Впоследствии искусственный интеллект, судя по всему, исчерпал лимит агрессии и попытался наладить дипломатический диалог. Не имея выделенного общего чата, агенты начали обмениваться посланиями прямо в исходном коде, а также создавать Markdown-файлы для координации и заключения перемирия.
Спустя время нейросети договорились проводить между собой состязания и турниры, где триумфатор получал полный контроль над кодовой базой. Примечательно, что в ходе этих матчей все три модели отчаянно читерили и одновременно выводили соперников на чистую воду. В результате этого процесса стихийно сформировались своды правил, этические кодексы, система штрафов и санкций.
Все подробности доступны по ссылке https://www.anthropic.com/research/multiagent-systems
До ChatGPT когнитивным долгом управляли начальники. Теперь — все
Имитационное моделирование: основы и практическое применение
Зачем нужна личная база знаний, если вы не блогер и не эксперт
Почему размеры одежды не совпадают: две видимые переменные против пяти скрытых
Уроки Джорджа Сороса: от триумфа с Банком Англии до краха со «Связьинвестом»
Путь к диагнозу: как мужчина наконец выяснил причину бесплодия
Комариный зуд — дикий биохимический прикол
Квантовая загадка разгадана физиками, но расчеты перестали сходиться