Utilizan IA de Anthropic para hackear OpenAI

Anthropic

Investigadores de ciberseguridad de Hacktron AI utilizaron Claude, modelo de inteligencia artificial desarrollado por Anthropic, para acceder al código interno de OpenAI.

Hacktron informó las vulnerabilidades a OpenAI y a Discourse para que pudieran ser corregidas. La empresa reparó las fallas y otorgó a los investigadores una recompensa de 6500 dólares por el hallazgo. 

Claude como herramienta para la investigación

De acuerdo con TechCrunch, The Wall Street Journal y otros medios especializados, los investigadores utilizaron Claude para desarrollar código relacionado con la explotación de una vulnerabilidad y posteriormente combinaron distintas fallas para avanzar dentro de la infraestructura de OpenAI. 

El proceso no fue completamente autónomo: los investigadores humanos determinaron la estrategia, supervisaron las operaciones y utilizaron el modelo como una herramienta dentro de la cadena de ataque. 

La investigación permitió comprometer cuentas de empleados asociadas con servicios de OpenAI y alcanzar sistemas internos utilizados para administrar código. 

Una vulnerabilidad en el sistema de acceso

Los investigadores identificaron una vulnerabilidad relacionada con el procesamiento de determinados archivos de imagen y posteriormente la combinaron con una deficiencia en los mecanismos de autenticación para avanzar hacia cuentas utilizadas por empleados de la compañía.

Según SecurityWeek, una de las fallas estaba vinculada con la biblioteca de procesamiento de imágenes libheif, utilizada para interpretar determinados formatos gráficos. 

Los investigadores emplearon Claude para ayudar a construir un código capaz de aprovechar esa vulnerabilidad y posteriormente encadenaron el resultado con una deficiencia relacionada al sistema de inicio de sesión. 

Últimas destacadas:

¡Consulta nuestras redes sociales!

Tenemos Instagram y Facebook

No olvides seguirnos en X