OpenAI presentó ante la Casa Blanca su nueva estrategia de seguridad para sistemas de IA: en lugar de reducir el uso de modelos autónomos, propone desplegar más IA para supervisar y frenar a los agentes rebeldes. El plan incluye monitoreo en tiempo real, sandboxing y autenticación.
***
- OpenAI propone contrarrestar los riesgos de agentes de IA autónomos con sistemas de supervisión automatizada basados en la misma tecnología.
- La estrategia incluye monitoreo en tiempo real, sandboxing y autenticación para evitar hacks y usos maliciosos.
- La compañía presentó el plan en una reunión con la Casa Blanca sobre seguridad de IA.
- El objetivo es que la propia IA detecte y neutralice comportamientos peligrosos antes de que causen daño.
OpenAI ha planteado una postura que puede parecer paradójica: frente a la amenaza de agentes de inteligencia artificial autónomos que actúen de forma rebelde o sean explotados por ciberdelincuentes, la empresa propone reforzar la seguridad con más IA, no con menos. Así lo reveló en un informe presentado durante una reunión en la Casa Blanca, donde la compañía delineó su visión sobre cómo contener los riesgos emergentes de los llamados “agentes de IA”.
El documento, citado por Decrypt, describe un esquema de “supervisión automatizada” en el que los modelos de IA vigilan y evalúan el comportamiento de otros modelos en tiempo real, actuando como una suerte de agentes de seguridad digital. La iniciativa llega en un momento en que los gobiernos y la industria discuten si los avances en autonomía de los sistemas de IA exigen una moratoria o un control humano más estricto.
OpenAI, en cambio, aboga por un enfoque que aproveche la propia tecnología para mitigar los peligros, lo que implica una apuesta por la escalabilidad de los mecanismos de protección. La propuesta incluye tres ejes centrales: monitoreo continuo de los agentes, uso de entornos aislados (sandboxing) para pruebas controladas, y sistemas de autenticación robustos que impidan accesos no autorizados.
El desafío de los agentes autónomos
Desde 2024, OpenAI ha ido dando pasos hacia la creación de agentes de IA capaces de ejecutar tareas complejas de forma autónoma, como navegar por la web, usar aplicaciones o tomar decisiones dentro de parámetros establecidos. Sin embargo, esta autonomía también abre la puerta a usos malintencionados, desde el robo de datos hasta la manipulación de sistemas financieros.
La preocupación no es nueva. Expertos en seguridad han advertido que un agente de IA bien entrenado podría ser utilizado para automatizar ciberataques a gran escala, algo que antes requería de intervención humana experta. La respuesta de OpenAI, detallada en su informe, consiste en crear una capa adicional de IA que actúe como “policía” de los otros agentes, monitoreando sus acciones y deteniéndolos si detectan comportamientos anómalos.
Esta supervisión automatizada se complementaría con “sandboxing”, una técnica que permite ejecutar agentes en entornos virtuales controlados donde sus acciones no puedan afectar al mundo real. De esta manera, los sistemas podrían probarse y afinarse antes de ser desplegados en producción, reduciendo el riesgo de que causen daños accidentales o deliberados.
La propuesta de OpenAI también contempla la verificación de identidad y permisos, similar a los sistemas de autenticación de dos factores, pero adaptada al contexto de los agentes de IA. Esto implicaría que cada agente tenga un perfil de actividad y que sus acciones queden registradas para su auditoría posterior.
OpenAI refuerza la seguridad con IA generativa
En lugar de frenar el desarrollo de agentes autónomos, OpenAI quiere acelerarlo, pero con un cinturón de seguridad automatizado. La compañía sostiene que la IA es la única herramienta capaz de reaccionar a la velocidad de las amenazas digitales, algo que los humanos por sí solos no pueden lograr.
Este enfoque no está exento de críticas. Algunos analistas señalan que aún no existe evidencia suficiente de que la supervisión de una IA sea confiable para frenar a otra IA malintencionada, y que el riesgo de que el propio sistema de seguridad sea vulnerado sigue presente. Otros, en cambio, ven en esta propuesta un paso pragmático hacia un futuro inevitable.
La discusión se produce en un contexto de creciente presión regulatoria. La Casa Blanca ha convocado a las principales empresas de IA para intercambiar puntos de vista sobre cómo garantizar un desarrollo seguro de estos sistemas, y OpenAI ha aprovechado esta plataforma para posicionar su visión.
De cara al futuro, la implementación de estas medidas podría sentar precedentes para toda la industria, aunque OpenAI no ha dado plazos concretos. Por lo pronto, la empresa continúa avanzando en sus investigaciones sobre agentes autónomos, mientras ensaya en paralelo las herramientas que, según ella, los mantendrán a raya.
ADVERTENCIA: DiarioBitcoin ofrece contenido informativo y educativo sobre diversos temas, incluyendo criptomonedas, IA, tecnología y regulaciones. No brindamos asesoramiento financiero. Las inversiones en criptoactivos son de alto riesgo y pueden no ser adecuadas para todos. Investigue, consulte a un experto y verifique la legislación aplicable antes de invertir. Podría perder todo su capital.
Suscríbete a nuestro boletín
Artículos Relacionados
China
Baidu decepciona en ingresos Q2: publicidad cae 19% mientras IA crece 25%
Empresas
Perplexity regala su servicio de IA en India y gana millones de usuarios
Estados Unidos
Minnesota demanda a xAI, alega que Grok creó un “mercado para violencia sexual digital”
Capital de Riesgo