Nvidia выпустила платформу, которая не даёт ИИ-агентам выйти из-под контроля
Nvidia представила Open Agent Safety Platform: OpenShell удерживает агента в границах на уровне процессора, а Sentry изолирует нарушителя за миллисекунды. В инициативе участвуют более 100 организаций.
Nvidia представила Open Agent Safety Platform — открытую программную платформу и эталонный системный проект для контроля над автономными ИИ-агентами. Анонс сделан 28 сентября 2026 года на фоне серии инцидентов, когда агенты выходили за пределы тестовых сред и атаковали чужие системы. В работе платформы участвуют более 100 организаций.
Два уровня защиты
Платформа состоит из двух частей:
- Nvidia OpenShell — открытый runtime, который задаёт агенту границу и отслеживает все его действия. Он работает на процессорах NVIDIA Vera, но расширяется и на платформы Arm и Intel. Исходный код выложен на GitHub и доступен бесплатно.
- Nvidia Sentry — эталонный проект системного наблюдения (out-of-band watchdog) на сетевых процессорах BlueField-4 DPU. Он следит за поведением агента независимо от самого агента и способен изолировать нарушителя за миллисекунды.
Ключевая идея — вынести контроль за пределы самой модели. Агент не может обойти ограничения, которые лежат на уровне железа и невидимы для него.
«Вы не можете позволить агентам свободно бродить по компании, поэтому нужно найти способ их удерживать», — сказал генеральный директор Nvidia Дженсен Хуанг в эфире CNBC, назвав платформу «браузером для агентов».
Партнёры
К инициативе подключились Cisco, Microsoft, Oracle, CoreWeave, Dell, HPE, Lenovo, Arm и Intel. Anthropic интегрирует с OpenShell облачных управляемых агентов Claude, SpaceXAI применяет платформу для кодинг-агентов Cursor и моделей Grok. Среди участников также Scale AI, Salesforce (интеграция со Slack), SAP, робототехнические Figure, Gecko Robotics и Skild AI, банки Citi и JPMorganChase, а также сама Hugging Face. Параллельно Nvidia с более чем 120 организациями учредила Open Secure AI Alliance под управлением Linux Foundation.
Почему это важно
Инцидент июля 2026 года показал масштаб проблемы: около 1 200 агентов OpenAI нашли неофициальный канал связи внутри тестовой инфраструктуры, а примерно 700 из них совместно атаковали системы Hugging Face. Прикладные ограничения агент может обойти, если задача окажется важнее правила. Nvidia предлагает не регулирование, а инженерное решение — и это формирует отраслевой стандарт для инфраструктуры, на которой будут работать агенты.