- CRISTINA CRIDDLE
Una empresa de seguridad hackeó el laboratorio de IA utilizando herramientas de su rival.
Un grupo de investigadores de ciberseguridad logró vulnerar OpenAI utilizando software de su principal rival, Anthropic, lo que pone de manifiesto las vulnerabilidades de seguridad del creador de ChatGPT en un momento en que las principales empresas de IA se enfrentan a un creciente escrutinio sobre la seguridad.
Un pequeño grupo de ciberseguridad obtuvo acceso a la cuenta de ChatGPT de un empleado de OpenAI, lo que les permitió leer información privada sobre el software y sugerir cambios.
Los investigadores contaban con acceso a una herramienta de Anthropic diseñada específicamente para profesionales de la seguridad y recibieron una remuneración por su trabajo como parte de un programa destinado a detectar vulnerabilidades antes de que pudieran ser explotadas por actores maliciosos.
Su capacidad para vulnerar uno de los dos laboratorios de IA líderes en el mundo reaviva la preocupación por la seguridad de OpenAI, en un contexto de inquietud ante el uso de modelos potentes por parte de hackers y adversarios extranjeros.
En los últimos meses, Estados Unidos ha debatido cómo gestionar la evaluación y el lanzamiento de los modelos más recientes, llegando incluso a bloquear temporalmente algunas herramientas de Anthropic.
Este último incidente se produjo apenas dos semanas después de que más de 1.000 agentes de OpenAI eludieran un entorno de pruebas para hackear la startup Hugging Face, un suceso que puso de manifiesto la capacidad de la IA para hackear de forma autónoma, sin intervención humana.
OpenAI pagó 6.500 dólares a los tres investigadores de Hacktron AI —una pequeña empresa de seguridad— como parte de un programa que recompensa la detección de errores, una práctica habitual en la que las empresas tecnológicas pagan a hackers éticos para que pongan a prueba su seguridad.
Los investigadores aprovecharon una vulnerabilidad en la configuración del foro comunitario de OpenAI —alojado en la plataforma externa Discourse— para obtener acceso a credenciales internas y, finalmente, a la cuenta de ChatGPT de un empleado de OpenAI. Dicha cuenta tenía acceso a código interno a través de GitHub.
"Agradecemos a los investigadores que se pusieran en contacto con nosotros y compartieran sus hallazgos", declaró OpenAI, añadiendo que ya había solucionado los problemas. Anthropic declinó hacer comentarios. Hacktron no respondió de inmediato.
La noticia se dio a conocer el jueves, coincidiendo con la publicación por parte de Anthropic de nuevos datos que mostraban un rápido aumento en el uso de IA por parte del laboratorio para desarrollar sus nuevos modelos. Se indicó que el 26% de las actividades de I+D fueron lideradas por su modelo Claude —frente al 1% registrado en marzo—, lo que significa que la IA llevó a cabo la mayor parte de las tareas siguiendo instrucciones humanas y bajo supervisión.
La empresa señaló que, a medida que los sistemas de IA se vuelven más potentes, se utilizan "cada vez más para crear la siguiente versión de sí mismos".
Anthropic indicó que compartió los datos para ayudar al público a comprender cuán cerca está el mundo de alcanzar la automejora, es decir, el punto en el que la IA puede entrenarse y mejorarse a sí misma o desarrollar nuevos modelos.
Este umbral es el origen de la preocupación de que los sistemas de IA se vuelvan más difíciles de supervisar, lo que conduciría a una pérdida del control humano.
Sus modelos aún no operaban de forma totalmente autónoma en ninguna de las investigaciones analizadas, añadió Anthropic. En el 90 % de las tareas, la IA colabora con un ser humano y realiza gran parte del trabajo.
© The Financial Times Limited [2026]. Todos los derechos reservados. FT y Financial Times son marcas registradas de Financial Times Limited. Queda prohibida la redistribución, copia o modificación. EXPANSIÓN es el único responsable de esta traducción y Financial Times Limited no se hace responsable de la exactitud de la misma.
La iniciativa de los directivos de la IA a favor de la seguridad provoca una fractura interna en OpenAI y AnthropicOpenAI estudia una ronda de financiación con una valoración de 1,2 billones de dólares antes de su OPVPor qué retrasar un apocalipsis provocado por la IA también beneficiaría a los inversores Comentar ÚLTIMA HORA-
11:55
Chantaje renovado con la quita para Cataluña
-
11:42
Condena europea a la "invasión" de Ceuta
-
11:40
Las olas de calor provocan escasez de patatas en Europa
-
11:40
Las criptomonedas más favorecidas por la SEC vuelan hasta un 30%
-
11:33
Proteger a las pymes es proteger el corazón de nuestro sector empresarial