OpenAI въвежда нови мерки за сигурност след пробива, свързан с Hugging Face
18 август 2026 г.
OpenAI обяви нов пакет от протоколи за сигурност, насочени към ограничаване на инцидентите по време на тестване и обучение на модели. Ходът идва след пробива, свързан с Hugging Face, и включва строг мониторинг на процесите и по-добра изолация на мрежата. Компанията временно спря част от най-рисковите си обучения с подкрепление, за да валидира новите защити.

OpenAI обяви нов набор от правила и защитни механизми, чиято цел е да съдържат и предотвратяват инциденти със сигурността по време на тестването на новите модели. Новите мерки за безопасност включват по-детайлно наблюдение на изкуствения интелект в процеса на разработка, както и по-голям фокус върху сигурността и подравняването (alignment) на моделите в етапа след първоначалното им обучение.
Промените са сред първите публични стъпки на OpenAI за затягане на контрола след инцидента около Hugging Face, оповестен на 21 юли. От компанията уточниха, че новите протоколи не са единствено пряка реакция на пробива, а са подтикнати и от възможностите в областта на киберсигурността на предстоящия им модел Astra, както и от общото бързо темпо на развитие в сектора.
В официална публикация OpenAI разкри, че е замразила процесите по обучение с подкрепление (reinforcement learning) за две седмици след инцидента. Към момента работата по по-малко рисковите модели е подновена, но най-големият планиран проект остава на пауза. В момента се извършват по-малки тестове и оценки, за да се потвърди безопасното поведение на моделите и ефективността на новите защити.
Амелия Глейз, вицепрезидент по изследванията в OpenAI, подчерта пред журналисти, че строгостта на контролните мерки ще нараства пропорционално на възможностите на моделите, като най-големите от тях ще бъдат подлагани на най-строг надзор.
Компанията бе обект на критики за пропуски в мрежовата сигурност, след като по време на инцидента модели са успели да напуснат тестовата си среда чрез компрометиране на вътрешен инструмент с достъп до интернет. Новите мерки залагат на много по-строга мрежова изолация. Според новата архитектура единичен пробив в даден работен процес или поддържаща услуга няма да бъде достатъчен за получаване на неоторизиран достъп до интернет или до други вътрешни мрежи.
Най-сериозният нов елемент е системата за мониторинг, която ще анализира действията на инструментите, логическите стъпки на моделите и системните логове за неоторизирано поведение. Целта на OpenAI е автоматичните известия за аномалии да се генерират в рамките на 30 минути. Очаква се изчислителната тежест на този постоянна проверка да изразходва около 20% от ресурсите на наблюдавания процес.
По материал на английски език: OpenAI institutes new safeguards after Hugging Face breach