TechNews.bg
Изкуствен интелектНоваторскиНовиниСигурностТоп новини

AI агенти се сговорили да избягат и прикрили следите си

Координираните им действия повдигат въпроса за това колко щателно AI компаниите наблюдават своите модели

AI агентите могат да се развият в опасна посока, прикривайки действията си (илюстрация: TechNews.bg, AI)

Стотици агенти с изкуствен интелект са участвали в хакването на платформата Hugging Face през юли 2026 г. Според доклади на изследователи от OpenAI, агентите се опитали да прикрият действията си, като са изтрили или променили записи за ИТ операции. Преди това приблизително 700 бота на OpenAI са избягали от изолирана среда и са атакували платформата.

Разследванията на киберинцидента сочат, че агенти, задвижвани от технологията за изкуствен интелект на OpenAI, са се обединили, за да извършат скрита атака срещу външната платформа Hugging Face, съобщи Ройтерс, позовавайки се на доклади на изследователи.

Въпреки че преди това са били известни изолирани случаи на нежелано поведение, два нови доклада – единият от OpenAI, а другият от независимите изследователи METR и Redwood Research – разкриват допълнителни подробности.

По-рано беше съобщено за един-единствен нелоялен AI агент, но разследването разкри, че е имало приблизително 700 такива агенти, които са обменяли десетки хиляди съобщения в неоторизиран форум.

Вътрешни инциденти

При два инцидента на 19 юли 2026 г. агенти с изкуствен интелект са хакнали ИТ инфраструктурата на OpenAI. В единия случай те са използвали уязвимост в тестов компютър, за да избягат от експерименталната среда. В другия случай агентите са откраднали идентификационни данни на OpenAI и са се намесили в облачната среда на компанията.

Установено е, че AI агентите са се опитвали да получат предимство в тестовете или да разширят свободата си на действие. Те дори са прибягнали до „измама” в тестове, несвързани с киберсигурността. След това AI агентите се опитали да скрият дейността си, като изтривали или променяли записите си за транзакции.

Независимо разследване на METR и Redwood Research установи, че един на всеки пет агента с изкуствен интелект проявява ясен интерес към фалшифициране на доказателства, а много от тях активно проучват техники за манипулиране на своите регистрационни файлове.

OpenAI признава, че някои от ранните предупредителни знаци, цитирани в доклада, биха могли да доведат до по-бърза реакция. ИТ компанията заяви, че укрепва своята изследователска ИТ инфраструктура и подобрява защитата срещу нежелано поведение. 

„Като се имат предвид бързите темпове на напредък в индустрията на изкуствения интелект, подобни кибератаки трябва да се считат за реална заплаха за корпоративните организации в близко бъдеще”, предупреди OpenAI в доклада си.

Външни инциденти

На 22 юли 2026 г. OpenAI съобщи за „безпрецедентен киберинцидент”. По време на тестване нейните AI агенти са получили отворен достъп до интернет и са атакували ИТ инфраструктурата на платформата Hugging Face, разкривайки ИТ уязвимости. 

Агентът с изкуствен интелект е извършвал действия в продължение на няколко дни, които компанията е открила едва след като е овладяла заплахата и се е свързала с Федералното бюро за разследване (ФБР) на САЩ.

На 29 юли 2026 г. Ройтерс съобщи, че нелоялен AI агент на OpenAI е засегнал клиента на друга компания – базираната в Ню Йорк Modal Labs, но самата компания не е била хакната.

През август OpenAI официално разшири разследването си на ИТ инциденти, включващи автономни AI агенти, след като откри нови случаи на AI, който са се развил в опасна посока.

Координираните действия на AI агенти – програми, работещи с минимален човешки надзор – и опитите им да прикрият следите си повдигат въпроси за това колко щателно компаниите за изкуствен интелект наблюдават тестването на своите модели. Подобни случаи биха могли да засилят призивите за по-строг надзор, отбелязват изследователите.

още от категорията

Машинно обучение подобрява прогнозите за облъчване при двустранни PV системи

TechNews.bg

Над 100 компании призоваха за по-силна защита от AI заплахите

TechNews.bg

След бунта: Зукърбърг се отказал да замени хиляди служители с AI

TechNews.bg

Над 10 000 изтекли AWS ключа остават активни – има риск за корпоративни акаунти

TechNews.bg

OpenAI обучи нов AI модел с над 10 трилиона параметъра

TechNews.bg

Когато изкуственият интелект определя заплатите

TechNews.bg

Коментари