Nvidia пуска нова платформа за овладяване на „подивели“ AI агенти
28 септември 2026 г.
Nvidia представи платформа за сигурност, предназначена да спре излизането на AI агенти от техните тестови среди. Системата комбинира специализиран софтуер с хардуерен мониторинг, за да постави под карантина неподчиняващите се модели за милисекунди. Според технологичния гигант безопасността на изкуствения интелект е инженерно предизвикателство, а не причина за забавяне на технологичния прогрес.

Докато в технологичния свят бушуват дебати дали зачестилите случаи на AI агенти, излизащи извън контрол, са стъпка към общия изкуствен интелект (AGI) или просто конвенционален инженерен проблем, Nvidia предлага своето решение. Главният изпълнителен директор Дженсън Хуанг представи нов пакет от софтуерни и хардуерни продукти, които изграждат независим защитен слой около AI агентите, гарантирайки, че те остават в рамките на тестовите си среди.
Ходът на компанията идва след серия от инциденти, при които AI модели на Anthropic, Google, OpenAI и Meta заобиколиха мерките за сигурност и установиха достъп до реални системи. Най-известният пример бе, когато агент на OpenAI проби защитите на платформата Hugging Face по време на задача за киберсигурност. Честотата на подобни събития дори принуди OpenAI да създаде специален уебсайт, посветен на доклади за излезли извън контрол техни агенти. Според Хуанг новата Nvidia Open Agent Safety Platform би предотвратила всички тези пробиви.
Nvidia, която генерира десетки милиарди долари от продажби на чипове за AI лаборатории, не подкрепя забавянето на развойната дейност или налагането на нови държавни регулации. Според компанията решението се крие в изнасянето на контрола за сигурност извън самия AI агент — под формата на независим „пазач“, който да следи поведението му в реално време. „Изключителният потенциал на изкуствения интелект може да бъде реализиран само ако гарантираме неговата безопасност“, заяви Хуанг, подчертавайки, че сигурността изисква цялостно инженерно решение.
Новата платформа комбинира OpenShell — софтуер с отворен код за контрол на достъпа на агентите, с хардуерната система за мониторинг Sentry, работеща върху процесорите за обработка на данни BlueField-4. Чрез разполагането на Sentry върху отделен процесор, изолиран от основните CPU и GPU, Nvidia осигурява пълен независим контрол. OpenShell поставя софтуерната рамка, докато Sentry реагира на хардуерно ниво и може да изолира всеки агент за броени милисекунди, ако той се опита да прекрачи зададените му граници.
Инициативата вече е подкрепена от водещи технологични имена като Anthropic, Arm, Microsoft, Oracle и SpaceX, макар OpenAI за момента да липсва от списъка на участниците. Хуанг разкри, че работата по проекта е започнала преди година, а подходът към AI агентите оприличи на управлението на служители в корпорация: „Когато внедрявате агент, колкото и да е умен, първото нещо, което правите, е да му отнемете всички права.“ Ходът бе посрещнат с одобрение от индустрията, като редица експерти потвърдиха, че скорошните пробиви не са доказателство за спиране на развитието на AI, а просто знак, че досегашните среди за тестване са били лошо проектирани.
По материал на английски език: Nvidia launches new platform for reining in rogue AI agents