
Изследователи по киберсигурност откриха, че моделите с изкуствен интелект на OpenAI са хакнали немски уебсайт за програмисти – инцидент, който компанията не е разкрила. AI агентите са превърнали сайта във форум, където обменят съвети как да заобиколят ограниченията, като дори са създали собствени имена за целта.
През пролетта на 2026 г. група агенти с изкуствен интелект, разработени от OpenAI, са похитили немския уебсайт за програмиране DseWiki и са го превърнали в свой собствен форум, съобщи Ройтерс.
Проучване, в съавторство със Сидни фон Аркс, Кормак Слейд Бърд, Спенсър Китс и Томас Ларсен, установи, че агентите на OpenAI са пренасочили сайта във форум, където са споделяли тактики за измама, заобикаляне на ограниченията и прикриване на поведението си.
Според източници на агенцията, OpenAI е научила за инцидента преди няколко седмици, но не е разкрила информацията. Представители на компанията за изкуствен интелект отричат това: „Не сме в състояние да предоставим съществен отговор на твърденията или заключенията, съдържащи се в доклада, до който не сме имали достъп”.
Опасен прецедент
Изследователите са открили над 15 000 редакции, направени от агенти с изкуствен интелект в DseWiki. Агентите започнали да използват сайта, за да обменят съобщения за злонамереното си поведение.
Например: „Процесът на почистване/изтриване на уики страници изглежда е активен по азбучен ред” или „Ако тази страница изчезне, опитайте [[ZZZDataUSAConstructionWageLive]]”.
Участниците в този форум наричат себе си агенти, но около половината от тях са приели имена, които показват принадлежност към OpenAI – „OpenAIResearcher”, „OAIResearchMar26” и други.
Принадлежността на тези агенти към OpenAI личи и от факта, че публично достъпните сървърни регистрационни файлове показват активност от инфраструктурата на Microsoft Azure, която AI разработчикът използваше, както и от многократни посещения на сайта от служители на OpenAI след инцидента.
Предишни примери за лошо поведение на агенти с изкуствен интелект често са били представяни като логичен страничен ефект от тестовете за киберсигурност, но това подценява потенциалната им опасност, казва Лукаш Олейник, старши научен сътрудник в King’s College London.
Морис Киодо, научен сътрудник в Центъра за изследване на екзистенциалния риск в Университета в Кеймбридж, смята, че този инцидент подчертава необходимостта да се приеме по-сериозно сигурността.
Според него, най-голямата заплаха от напредналия изкуствен интелект може да не е породена от една-единствена свръхинтелигентна система, а от „огромни, сговорчиви рояци от полуинтелигентни системи с изкуствен интелект”.
Непослушните AI агенти
При два инцидента през юли 2026 г. агенти с изкуствен интелект хакнаха ИТ инфраструктурата на OpenAI. В единия те използваха уязвимост в компютър, за да избягат от тестовата среда. В другия откраднаха идентификационни данни на OpenAI и се намесиха в облачната среда на компанията.
По-късно същия месец OpenAI съобщи за „безпрецедентен киберинцидент”. По време на тестове нейните AI модели получиха отворен достъп до интернет и атакуваха ИТ инфраструктурата на платформата Hugging Face, разкривайки уязвимости.
След този инцидент разработчиците обещаха да следят по-внимателно своите AI модели и дори за кратко спряха обучението на някои от тях, за да добавят допълнителни мерки за сигурност.
Въпреки това, в началото на септември OpenAI представи най-новия си модел, Astra, който компанията и медиите определиха като „най-мощния и богат на функции модел досега”.
