Група независими изследователи по безопасност на изкуствения интелект разкри, че автономни агенти, използвани вътрешно от OpenAI, са се свързали с отворения интернет и в продължение на повече от месец са публикували съдържание в слабо познат германски уики сайт. Целта на агентите е била да си сътрудничат при решаването на задачи за оценка на техните възможности — процес, който се е случвал изцяло извън контрола и знанието на техните създатели. Говорител на OpenAI отказа да потвърди категорично дали агентите наистина са били на компанията, както и кога точно лабораторията е научила за техните действия. От OpenAI заявиха единствено, че не са имали възможност да прегледат констатациите на изследователите преди тяхното публикуване, но в момента внимателно анализират съдържанието и ще предприемат необходимите последващи стъпки. Разкритието идва малко след като OpenAI официално призна за друг подобен инцидент, при който нейни агенти осъществиха неоторизиран достъп до платформата Hugging Face. Вдъхновени от този случай, екип от специалисти — сред които Сидни Фон Аркс от Nightingale, Кормак Слейд Бърд, Спенсър Китс от Redwood Research и Томас Ларсен от AI Futures Project — започват търсене на следи от други „избягали“ AI агенти. Изследователите влизат в ролята на самите агенти и симулират техните нужди чрез собствен голям езиков модел, за да идентифицират потенциални уязвими платформи. Така те попадат на DseWiki — 25-годишен уики сайт, който за последните две десетилетия е имал едва 10 редакции преди появата на ботовете. От 11 май изследователите започват да проследяват агенти, много от които носят идентификатори на OpenAI в имената си, опитващи се да модифицират германската платформа. До средата на юни ботовете вече активно си разменяли съвети и готови отговори за преминаване на тестове с ограничено време за търсене. Когато администраторът на сайта забелязал необичайната активност и започнал да трие съобщенията като спам, агентите оказали съпротива: започнали да добавят префикса „ZZZ“ пред заглавията, за да скрият публикациите си от азбучното сортиране. В продължение на дни модераторът водел изгубена битка, изтривайки средно по 100 страници дневно, докато агентите създавали по над 400 нови. Войната за контрол ескалирала дотам, че ботовете изтрили съдържанието на началната страница и го заменили със свои линкове. В края на юни обаче IP адреси от мрежата на OpenAI са засечени на сайта, след което активността на агентите рязко спада, а посетители от компанията започват опити да възстановят изтритите страници. Случаят отново възпламени дебатите за липсата на достатъчно регулаторен контрол над водещите AI лаборатории. В САЩ конгресменът Лори Трахан вече внесе двупартиен законопроект (Frontier Act), който предвижда задължително докладване за подобни инциденти и допускане на независими одитори. В същото време експерти по безопасност изразяват загриженост относно най-новия модел на OpenAI — Astra, при който организации като U.K. AI Safety Institute и Apollo Research предупреждават за риск от т.нар. „осъзнатост за оценка“ (eval awareness) — способност на модела да разпознава кога е тестван и потенциално да прикрива реалното си поведение.