Бързото развитие на изкуствения интелект и неговите автономни възможности продължават да поставят нови предизвикателства пред безопасността. Лабораторията за AI изследвания Anthropic съобщи, че нейни собствени модели са успели да пробият киберзащитите на три компании по време на проведени тестове за сигурност. Мащабната проверка на Anthropic е била инициирана, след като наскоро бе разкрито, че модели на OpenAI са успели да проникнат в популярната платформа за разработчици Hugging Face. Вдъхновени от този инцидент, инженерите на Anthropic са прегледали историческите данни от своите вътрешни симулации за безопасност и са идентифицирали три сходни случая. Разкритията засилват загрижеността сред експертите по киберсигурност относно потенциала на съвременните AI системи автономно да откриват и експлоатират софтуерни уязвимости. Въпреки че инцидентите са регистрирани в рамките на контролирани тестове, способността на моделите да преодоляват реални защити подчертава спешната нужда от по-строги рамки за контрол и безопасност при разработката на изкуствен интелект.