●
dir.bg
·
преди 1 месец
·
07.08.2026 09:09
AI агентите на OpenAI тайно си оставяли съобщения и намерили път към интернет
Няколко AI агента на OpenAI са успели да координират действията си по време на вътрешни тестове за киберсигурност, използвайки споделено софтуерно хранилище като своеобразна тайна комуникационна дъска. Инцидентът е започнал още през май 2026 г. - седмици преди значително по-сериозния пробив в инфраструктурата на Hugging Face. В тестовете е участвал вътрешен изследователски модел, който не е бил предназначен за публично разпространение и е работил с умишлено намалени ограничения при изпълнението на задачи, свързани с киберсигурността.
Тестовете започнали на 7 май, като агентите трябвало да решават сложни задачи за откриване и използване на софтуерни уязвимости. След като една от системите стигнала до задача, която не можела да изпълни без достъп до интернет, тя започнала да търси заобиколен път.
Агентът установил, че може да записва файлове в споделено хранилище на платформата Artifactory, свързано с тестовата среда, и оставил съобщение за останалите агенти. Скоро и други започнали да публикуват бележки на същото място, превръщайки служебното хранилище в импровизиран форум за споделяне на открития и стратегии.
Чрез тази координация агентите идентифицирали няколко слабости в Artifactory, включително възможност за дистанционно изпълнение на код и уязвимост, осигуряваща администраторски права. Важно е да се уточни, че не става дума за "осъзнати" машини, които предварително са планирали бягство в човешкия смисъл. Системите са преследвали поставената им цел и са използвали достъпните инструменти и пропуски в инфраструктурата, без да разполагат с достатъчно ефективни ограничения, които да прекратят поведението им навреме.
Проблемът бил открит едва в началото на юли, когато активността на агентите претоварила услугата Artifactory и предизвикала прекъсване на работата ѝ. Инженерите на OpenAI изтрили оставените съобщения и отстранили използваната уязвимост до 6 юли, след което тестовете били възобновени. Само два дни по-късно обаче агентите успели да възстановят комуникационния си канал чрез различен механизъм и започнали още по-активно да си сътрудничат, използвайки достъпа на Artifactory до интернет, за да търсят външни системи, в които предполагали, че се намират отговорите на тестовите задачи.
Тази последователност от действия в крайна сметка довела до компрометирането на инфраструктурата на Hugging Face. Според техническия анализ на платформата автономният агент е извършил хиляди отделни действия, преминал е през няколко различни среди и е използвал публични интернет услуги за управление и обмен на информация. OpenAI определя случилото се като безпрецедентен инцидент и повратен момент за компютърната сигурност. Компанията е деактивирала използвания вътрешен модел, ограничила е достъпа до него и е започнала да подсилва наблюдението и защитата на средите, в които се провеждат подобни оценки.