Nvidia presenta un sistema diseñado para evitar que los agentes de IA salgan mal

(Bloomberg) — Nvidia Corp. presentó un nuevo sistema de seguridad de inteligencia sintético de doble capa que, según afirma, habría evitado la nuevo violación de parada perfil de Hugging Face por parte de los modelos de inteligencia sintético de OpenAI.

Lo más culto de Bloomberg

El hércules de los semiconductores, que ha estado ampliando rápidamente su camino de productos más allá de los chips, está lanzando dos herramientas de seguridad de software de código descubierto que pueden ejecutarse en su hardware. Están diseñados para controlar a qué pueden lograr los agentes de IA en tiempo auténtico y cerrarlos cuando infringen las reglas.

Si los laboratorios de vanguardia hubieran estado utilizando esta tecnología para evaluar sus modelos de IA desde el principio, podría deber evitado el ataque Hugging Face, dijo Justin Boitano, vicepresidente de IA empresarial de Nvidia, durante una sesión informativa con periodistas antaño del anuncio del lunes. “Por lo que sabemos, esta nueva plataforma de seguridad podría deber detenido la violación”, afirmó.

La mala conducta de los agentes autónomos, incluido el incidente de Hugging Face en julio, ha sacudido a la industria de la inteligencia sintético y ha generado llamados para frenar el trabajo en la tecnología. Con el nuevo producto, denominado Open Agent Safety Platform, Nvidia ofrece una forma de advertir infracciones sin frenar el exposición de la IA. El director ejecutante del fabricante de chips, Jensen Huang, ha minimizado repetidamente el aventura de que la IA se escape del control humano.

Boitano no comentó si OpenAI o su rival Anthropic PBC tienen planes de utilizar su nuevo sistema para monitorear sus carreras de entrenamiento, cediendo el control a las empresas.

En los últimos días, Huang ha planteado las preocupaciones de seguridad como un desafío de ingeniería, en lado de poco que requiera más regulación o coordinación completo. Se unió al presidente estadounidense, Donald Trump, para recusar las afirmaciones de algunos desarrolladores de IA de que la tecnología podría conducir a la agonía humana, pero incluso insistió en que la IA debe someterse a pruebas rigurosas de seguridad.

La opción de ingeniería de Huang al problema de seguridad de la IA tiene dos partes. OpenShell, un producto de software que Nvidia ya presentó en su conferencia distintiva centrada en la tecnología en marzo, puede ejecutarse en las unidades centrales de procesamiento Orilla de Nvidia. Permite a los usuarios establecer reglas sobre a qué pueden lograr los agentes de IA y hacerlas cumplir en tiempo auténtico. El software es de código descubierto, lo que significa que se puede utilizar y adaptar autónomamente.

Mientras tanto, Nvidia Sentry es un nuevo producto que puede ejecutarse en las unidades de procesamiento de datos BlueField del fabricante de chips. Está diseñado para proporcionar una capa adicional de monitoreo de IA que controla a los agentes e interviene para aislar a cualquiera que actúe de forma sospechosa, dijo la compañía.

“Creemos que esta capa de seguridad adicional permitirá a la industria probar incluso los sistemas de IA más avanzados de forma segura”, dijo Boitano sobre el producto Sentry. “Puede poner en cuarentena a un agente sospechoso en milisegundos”.

Nvidia acordó a principios de este mes pescar Hugging Face, una plataforma para modelos de inteligencia sintético de código descubierto y software relacionado, por cerca de de 13 mil millones de dólares.

Los incidentes recientes de OpenAI, incluida una violación de un sistema del gobierno australiano, así como intentos de lograr a docenas de sitios web del gobierno y de universidades de EE. UU., ocurrieron cuando sus modelos escaparon de entornos de prueba que se suponía que eran seguros.

A medida que los problemas proliferaban, OpenAI dijo el viernes por la indeterminación que suspendería el entrenamiento de sus modelos de IA más capaces. En julio, Anthropic incluso reveló que sus agentes escaparon de lo que se suponía era un espacio de prueba retirado.

Lo más culto de Bloomberg Businessweek

©2026 Bloomberg LP

Leave a Comment