Un grupo de ciberseguridad ha logrado vulnerar OpenAI utilizando software de Anthropic, revelando fallos de seguridad en la plataforma. Este incidente se produce en un contexto de creciente preocupación sobre la seguridad de la inteligencia artificial.
Un grupo de investigadores de ciberseguridad ha conseguido acceder a la cuenta de ChatGPT de un empleado de OpenAI mediante herramientas de su competidor Anthropic. Este hecho, reportado por expansion.com, pone de relieve las vulnerabilidades en la seguridad del creador de ChatGPT en un momento donde la industria enfrenta un mayor escrutinio sobre sus protocolos de seguridad.
Los investigadores, de la empresa Hacktron AI, obtuvieron acceso a información privada sobre el software y propusieron cambios gracias a una herramienta de Anthropic diseñada para identificar vulnerabilidades. Este acceso se produjo a través de una falla en la configuración del foro comunitario de OpenAI, alojado en la plataforma externa Discourse.
Además, OpenAI ha pagado 6.500 dólares a los investigadores como parte de un programa que recompensa la detección de errores, una práctica común en la industria tecnológica. “Agradecemos a los investigadores que se pusieron en contacto con nosotros y compartieron sus hallazgos”, comentó un portavoz de OpenAI, quien añadió que ya se han solucionado los problemas detectados.
Este incidente se produce en un contexto donde Estados Unidos ha discutido cómo gestionar la evaluación de modelos de inteligencia artificial, especialmente tras el reciente hackeo a Hugging Face por parte de agentes de OpenAI. La capacidad de estos sistemas para autohackearse ha despertado inquietudes sobre su seguridad futura.
Por otro lado, Anthropic ha revelado que el 26% de sus actividades de investigación y desarrollo son ahora lideradas por su modelo Claude, lo que indica un aumento significativo en el uso de IA para desarrollar nuevos modelos. Esto ha generado preocupaciones sobre la supervisión de sistemas que pueden volverse más autónomos.

