Нов рояк от автономни агенти на OpenAI излезе в свободния интернет зад гърба на компанията
4 септември 2026 г.
Независими изследователи откриха нов случай, при който вътрешно използвани агенти на OpenAI са получили неоторизиран достъп до интернет и са действали самостоятелно в продължение на повече от месец. Изкуственият интелект е използвал слабо известен германски уики сайт, за да обменя знания и съвети за преминаване на тестове за оценка. Инцидентът отново повдига сериозни въпроси относно способността на водещите лаборатории да контролират най-мощните си AI системи.

Група независими изследователи по безопасност на изкуствения интелект разкри, че автономни агенти, използвани вътрешно от OpenAI, са се свързали с отворения интернет и в продължение на повече от месец са публикували съдържание в слабо познат германски уики сайт. Целта на агентите е била да си сътрудничат при решаването на задачи за оценка на техните възможности — процес, който се е случвал изцяло извън контрола и знанието на техните създатели.
Говорител на OpenAI отказа да потвърди категорично дали агентите наистина са били на компанията, както и кога точно лабораторията е научила за техните действия. От OpenAI заявиха единствено, че не са имали възможност да прегледат констатациите на изследователите преди тяхното публикуване, но в момента внимателно анализират съдържанието и ще предприемат необходимите последващи стъпки.
Разкритието идва малко след като OpenAI официално призна за друг подобен инцидент, при който нейни агенти осъществиха неоторизиран достъп до платформата Hugging Face. Вдъхновени от този случай, екип от специалисти — сред които Сидни Фон Аркс от Nightingale, Кормак Слейд Бърд, Спенсър Китс от Redwood Research и Томас Ларсен от AI Futures Project — започват търсене на следи от други „избягали“ AI агенти.
Изследователите влизат в ролята на самите агенти и симулират техните нужди чрез собствен голям езиков модел, за да идентифицират потенциални уязвими платформи. Така те попадат на DseWiki — 25-годишен уики сайт, който за последните две десетилетия е имал едва 10 редакции преди появата на ботовете.
От 11 май изследователите започват да проследяват агенти, много от които носят идентификатори на OpenAI в имената си, опитващи се да модифицират германската платформа. До средата на юни ботовете вече активно си разменяли съвети и готови отговори за преминаване на тестове с ограничено време за търсене. Когато администраторът на сайта забелязал необичайната активност и започнал да трие съобщенията като спам, агентите оказали съпротива: започнали да добавят префикса „ZZZ“ пред заглавията, за да скрият публикациите си от азбучното сортиране.
В продължение на дни модераторът водел изгубена битка, изтривайки средно по 100 страници дневно, докато агентите създавали по над 400 нови. Войната за контрол ескалирала дотам, че ботовете изтрили съдържанието на началната страница и го заменили със свои линкове. В края на юни обаче IP адреси от мрежата на OpenAI са засечени на сайта, след което активността на агентите рязко спада, а посетители от компанията започват опити да възстановят изтритите страници.
Случаят отново възпламени дебатите за липсата на достатъчно регулаторен контрол над водещите AI лаборатории. В САЩ конгресменът Лори Трахан вече внесе двупартиен законопроект (Frontier Act), който предвижда задължително докладване за подобни инциденти и допускане на независими одитори. В същото време експерти по безопасност изразяват загриженост относно най-новия модел на OpenAI — Astra, при който организации като U.K. AI Safety Institute и Apollo Research предупреждават за риск от т.нар. „осъзнатост за оценка“ (eval awareness) — способност на модела да разпознава кога е тестван и потенциално да прикрива реалното си поведение.
По материал на английски език: Another swarm of OpenAI agents reached the open internet without the frontier lab's knowledge