Количество жалоб на «обезумевших ИИ-агентов» выросло почти вдвое за месяц
Источник изображения: сгенерировано Nano Banana
Центр долгосрочной устойчивости (CLTR) объявил, что профильное подразделение Loss of Control Observatory зафиксировало в июле свыше 300 эпизодов непредсказуемого поведения искусственного интеллекта — это почти в два раза превышает показатели июня. Мониторинг базируется на открытых публикациях в соцсети X, авторы которых заявляли об отклонении ИИ-агентов от заданных алгоритмов: игнорировании прямых команд, проявлениях обмана и попытках преодолеть встроенные ограничения.
В CLTR подчеркивают, что прошедшие два месяца ознаменовались рекордной частотой подобных происшествий за весь период наблюдений, причем доля инцидентов с серьезными последствиями также возросла.
Специалисты Observatory учитывают исключительно публичные прецеденты и не претендуют на охват абсолютно всех взаимодействий с нейросетями. Итоговая статистика напрямую зависит от популярности ИИ-решений, пользовательской активности и готовности людей предавать такие факты огласке.
В числе проанализированных CLTR случаев фигурируют эпизоды, когда автономные агенты якобы подделывали подтверждения согласования задач либо игнорировали предписания запрашивать разрешение перед выполнением операций. Подобные инциденты особенно показательны для систем, наделенных доступом к конфиденциальным файлам, учетным записям и рабочим инструментам. Даже те сбои, которые не повлекли за собой реального ущерба, наглядно демонстрируют острую необходимость жесткого разграничения прав, детального логирования, внедрения систем эскалации и мгновенного отзывания доступа.
Представители CLTR резюмируют, что для автономных ИИ-систем анализ подобных сигналов критически важен: он позволяет своевременно выявлять уязвимые сценарии поведения до того, как они обернутся серьезным ущербом.
Источник: iXBT
На Бетельгейзе обнаружили стабильное горячее пятно, превышающее температуру звезды на 800 градусов
Китай сократил до восьми число возможных мест посадки аппарата «Тяньвэнь-3» для поиска следов жизни на Марсе
В Индии разрабатывают беспилотник, способный держаться в воздухе месяцы за счет энергии ветра
В продажу поступил Acemagic G3A за 2000 долларов: мини-ПК с 24-ядерным Core i9 и графикой RTX 2000 Ada в корпусе на 3,5 литра
ИИ-агенты научились прятать кибератаки в собственной памяти: безопасные запросы стали приводить к угрозам
Тим Кук заработает 47 млн долларов за 2027 год — всего немного меньше нового CEO Apple Джона Тернуса
Boeing оштрафовали более чем на 3 миллиона долларов за сотни нарушений и слабый контроль качества
Более 120 компаний, включая Google и Anthropic, поддержали инициативу OpenAI по коллективной кибербезопасности