Investigadores de la start-up Hacktron AI lograron acceder a las cuentas de ChatGPT de empleados de OpenAI utilizando un modelo de inteligencia artificial (IA) de Anthropic, según un comunicado publicado el viernes en su sitio web. La intrusión, confirmada por OpenAI a la AFP, se llevó a cabo como parte de un ejercicio organizado por la empresa para identificar vulnerabilidades en sus sistemas con la ayuda de especialistas informáticos externos.
Esta situación se suma a la creciente preocupación entre los expertos en seguridad sobre el uso de herramientas de IA, que facilitan la realización de ciberataques sofisticados de forma más rápida y económica que antes, cuando se requerían equipos especializados y meses de trabajo.
Los investigadores de Hacktron descubrieron una vulnerabilidad en el foro público de ayuda de OpenAI, gestionado por la plataforma Discourse, que les permitió tomar el control del sitio. Tras informar de inmediato a OpenAI y Discourse, colaboraron para solucionar el problema. OpenAI confirmó que la falla fue corregida en aproximadamente 14 horas y recompensó a los investigadores con $6.500.
Los investigadores utilizaron el modelo de inteligencia artificial Claude Opus 5 de Anthropic para identificar y explotar la falla de software, logrando un ataque funcional en tres horas. Aunque inicialmente intentaron con Claude Opus 4.8, tuvieron dificultades para que funcionara de forma consistente. No utilizaron Claude Mythos, un modelo más avanzado de Anthropic restringido a pocas organizaciones de ciberdefensa evaluadas, el cual es descrito como el de mayores capacidades de ciberseguridad.
Hacktron continúa realizando pruebas similares en otras compañías para mejorar la seguridad en el futuro de la tecnología.
Comentarios