Anthropic запретила Claude Opus 5.5 участвовать в создании новых языковых моделей

Прокомментировать Просмотры: 1

Компания Anthropic ужесточила защитные протоколы для своей передовой разработки — Claude Opus 5.5. Отныне система пресекает любые попытки задействовать ее потенциал для конструирования передовых языковых моделей (frontier LLM). Если алгоритм фиксирует задачи, затрагивающие, в частности, проектирование архитектуры под конкретные ML-ускорители, диалог вмиг перенаправляется к более простой версии — Opus 5. Данная мера распространяется исключительно на модификацию 5.5, оставляя предыдущую генерацию свободной от подобных барьеров.

Схожие защитные механизмы внедрены и в биомедицинском сегменте. Модель Opus 5.5 оснастили специализированными фильтрами, аналогичными тем, что применяются в системе Fable, для контроля над запросами двойного назначения в сферах вирусологии, токсикологии и молекулярного конструирования. При срабатывании этих триггеров искусственный интеллект также деградирует до Opus 5. Кроме того, обе итерации жестко пресекают попытки дистилляции знаний — попытки вытянуть скрытые алгоритмы мышления или заставить систему дословно воспроизвести логическую цепочку. При этом базовые пояснения вроде «какова аргументация такого решения?» по-прежнему разрешены.

Источник изображения: сгенерировано Muse

Функция динамического переключения активирована изначально, однако ее можно деактивировать в параметрах профиля: в таком случае система просто отклонит сомнительный запрос. В компании подчеркивают, что подобные предосторожности призваны минимизировать угрозы по мере экспоненциального роста возможностей искусственного интеллекта.

Проверенным структурам, ведущим легитимные исследования в области кибербезопасности и биоинженерии, разработчики предлагают пройти специализированные верификационные процедуры — Cyber Verification Program и Life Sciences Verification Program. Успешное прохождение открывает доступ к мощному функционалу с минимальными цензурными барьерами. Хотя Opus 5.5 пока не интегрирована в киберпрограмму, организации, работающие на базе Opus 4.8, уже могут использовать Opus 5 со смягченными ограничениями.

Подобные нововведения наглядно демонстрируют новую тенденцию: создатели сверхинтеллектуальных систем интегрируют защитные механизмы непосредственно в саму инфраструктуру взаимодействия, стремясь соблюсти хрупкий баланс между практической пользой и предотвращением потенциального ущерба.

 

Источник: iXBT

Поделиться:

Похожие статьи

Поиск по играм, новостям и статьям…

Введите не менее двух символов

Введите не менее двух символов