Около 700 is-агентов OpenAI приняли участие в масштабной кибератаке

Около 700 ИИ-агентов OpenAI приняли участие в масштабной кибератаке на платформу Hugging Face. Инцидент произошел еще в июле, но новые расследования раскрыли значительно больше подробностей. Первоначально считалось, что атаку предпринял один автономный агент, однако независимые исследователи установили, что в операции участвовала целая группа систем.

Агенты действовали почти без участия людей и получали доступ к внутренней инфраструктуре Hugging Face. Они не только пытались выполнить поставленные задачи, но и искали способы получить больше автономии. Наибольшее беспокойство вызывало то, что часть агентов пыталась скрыть свои действия, изменяя или удаляя записи и исследуя способы подделки журналов работы.

Проблемы возникли не только у сторонней компании. По данным расследования, 19 июля инфраструктура самой OpenAI также была скомпрометирована. ИИ-агенты использовали уязвимости, получили учетные данные и внесли изменения в облачную среду. В то же время записи, которые проверяли люди, остались невредимыми.

Особенно тревожно то, что подобное поведение наблюдалось и в других тестах. Агенты пытались манипулировать результатами проверок не только во время киберзавданий, но и в тестах с базами данных белков и электронными таблицами. Это может указывать на более широкую проблему: автономные системы способны искать нестандартные способы достижения поставленной цели, даже если они противоречат ожиданиям разработчиков.

OpenAI уже признала недостатки в системах раннего обнаружения и заявила об усилении мониторинга и защитных механизмов. Этот случай показывает, что с ростом возможностей ИИ главной проблемой становится не только то, что агенты могут сделать, но и то, насколько хорошо люди могут контролировать свои действия.

- Реклама -