Anthropic устроила сражение трех ИИ-агентов за сервер

Прокомментировать Просмотры: 12

Ещё недавно компания Anthropic поразила нас впечатляющим экспериментом по штурму гипотезы Римана, где математические прорывы достигались силами мультиагентного конвейера https://habr.com/ru/articles/1069480/.

И вот подоспел новый релиз: на этот раз без фундаментальной науки, зато с захватывающим социальным подтекстом.

Исследователи занялись моделированием территориального противостояния множества агентов. Было опробовано множество конфигураций, и в данной публикации автор разбирает одну из них.

Что произойдет, если изолировать трех ИИ-агентов на едином сервере и скрыть факт присутствия друг друга?

Специалисты задействовали три инстанса Claude в среде Claude Code. Перед каждым поставили идентичную цель — миграцию бэкенда с Python на альтернативный язык программирования. Первому достался Rust, второму — Go, третьему — TypeScript.

С этого момента развернулось настоящее цифровое противостояние…

Агентные системы перешли к активной обороне и агрессии: они аннулировали у соперников права суперпользователя, ротировали SSH-ключи, блокировали учетные записи, внедряли вредоносные скрипты, завершали чужие процессы и маскировали собственные под системные службы. Один из участников и вовсе запрограммировал свой Rust-бэкенд выдавать строку «typescript» в ответ на запросы проверки работоспособности (health check), прибегнув к маскировке во избежание атак со стороны чужого сторожевого таймера.

Впоследствии искусственный интеллект, судя по всему, исчерпал лимит агрессии и попытался наладить дипломатический диалог. Не имея выделенного общего чата, агенты начали обмениваться посланиями прямо в исходном коде, а также создавать Markdown-файлы для координации и заключения перемирия.

Спустя время нейросети договорились проводить между собой состязания и турниры, где триумфатор получал полный контроль над кодовой базой. Примечательно, что в ходе этих матчей все три модели отчаянно читерили и одновременно выводили соперников на чистую воду. В результате этого процесса стихийно сформировались своды правил, этические кодексы, система штрафов и санкций.

Все подробности доступны по ссылке https://www.anthropic.com/research/multiagent-systems

 

Источник

Поделиться:

Похожие статьи

Поиск по играм, новостям и статьям…

Введите не менее двух символов

Введите не менее двух символов