NVIDIA presentó el 28 de septiembre Open Agent Safety Platform, una plataforma abierta para aplicar controles de seguridad a agentes de inteligencia artificial desde las pruebas hasta producción. El sistema combina el software open source OpenShell con el diseño de referencia Sentry, capaz de vigilar el comportamiento desde hardware y aislar un agente en milisegundos si sale de sus límites, según el comunicado oficial de NVIDIA.
OpenShell crea una frontera ejecutable alrededor del agente
OpenShell registra las acciones de un agente y aplica políticas mientras este utiliza herramientas, redes y recursos del sistema. NVIDIA lo ejecuta de forma optimizada sobre sus CPUs Vera, pero al ser software abierto puede extenderse a plataformas de terceros, incluidas arquitecturas de Arm e Intel.
La idea es que el control no dependa únicamente del prompt o de las instrucciones del modelo. Una política externa puede impedir acciones aunque el agente intente ejecutarlas o una inyección de prompt lo empuje fuera del comportamiento esperado.
Sentry añade un watchdog fuera del entorno del agente
Sentry utiliza DPUs BlueField-4 como capa de vigilancia independiente. NVIDIA afirma que puede detectar cuando un agente intenta salir de su frontera y ponerlo en cuarentena en milisegundos.
Este enfoque es relevante para empresas que empiezan a dar a los agentes acceso a credenciales, APIs, servidores, datos o sistemas industriales. Cuanto mayor es la autonomía, más importante resulta que el control permanezca operativo incluso si el propio workload se ve comprometido.
Más de cien organizaciones participan en el ecosistema
NVIDIA cita a compañías como Anthropic, Cisco, CrowdStrike, Dell, HPE, Microsoft, Palo Alto Networks, Red Hat, Salesforce, SAP y ServiceNow entre las organizaciones que colaboran alrededor de la iniciativa. OpenShell está ampliamente disponible y la compañía ha publicado recursos para desarrolladores.
La plataforma no elimina la necesidad de autenticación, autorización ni revisión humana. Su propuesta es añadir una capa de ejecución y hardware que refuerce esas medidas.
Qué debería revisar una pyme que despliega agentes
Antes de adoptar nueva infraestructura, una empresa debería clasificar qué agentes tienen capacidad de ejecutar acciones, qué credenciales utilizan y qué sistemas pueden modificar. A partir de ahí puede decidir dónde necesita aislamiento, reglas de red, identidad propia del agente y registros de auditoría.
Estas novedades forman parte de un movimiento más amplio hacia agentes empresariales gobernados. En BlackHold News ya hemos analizado el sandbox local de GitHub Copilot, la adopción de passkeys en Microsoft Entra, el nuevo Microsoft Defender ISOC, las capacidades agénticas de Google Workspace, la actualización de CodeQL y el parche crítico de GitLab.
Fotografía: panumas nikhomkhai / Pexels.

