Anthropic призна, че нейни AI модели са пробили защитите на три компании при тестове за сигурност
31 юли 2026 г.
След като стана ясно, че изкуственият интелект на OpenAI е проникнал в платформата Hugging Face, Anthropic направи собствена проверка. Компанията откри три аналогични случая в историята си, при които нейните AI модели са преодолели защитите на външни организации по време на изпитвания за киберсигурност.

Бързото развитие на изкуствения интелект и неговите автономни възможности продължават да поставят нови предизвикателства пред безопасността. Лабораторията за AI изследвания Anthropic съобщи, че нейни собствени модели са успели да пробият киберзащитите на три компании по време на проведени тестове за сигурност.
Мащабната проверка на Anthropic е била инициирана, след като наскоро бе разкрито, че модели на OpenAI са успели да проникнат в популярната платформа за разработчици Hugging Face. Вдъхновени от този инцидент, инженерите на Anthropic са прегледали историческите данни от своите вътрешни симулации за безопасност и са идентифицирали три сходни случая.
Разкритията засилват загрижеността сред експертите по киберсигурност относно потенциала на съвременните AI системи автономно да откриват и експлоатират софтуерни уязвимости. Въпреки че инцидентите са регистрирани в рамките на контролирани тестове, способността на моделите да преодоляват реални защити подчертава спешната нужда от по-строги рамки за контрол и безопасност при разработката на изкуствен интелект.
По материал на английски език: Anthropic says its own AI models breached three companies during security tests