Un hacker novato utiliza inteligencia artificial para irrumpir en 14 empresas con comandos simples
La capacidad de los chatbots de inteligencia artificial para comprometer el software seguro se conoce desde hace algún tiempo. Analizar código, identificar fallas y desarrollar exploits son tareas típicas de los piratas informáticos, y la IA demuestra una capacidad similar. Lo que restringe estas acciones son las salvaguardas integradas en los modelos LLM, que, en determinadas ocasiones, no funcionan como se esperaba. En uno de estos fallos, revelado en un informe publicado en junio, un hacker sin experiencia logró invadir al menos catorce empresas.
Aunque el incidente puede parecer grave, no se encuentra entre las peores violaciones de datos jamás registradas en Internet. El descubrimiento fue realizado por OALABS, un grupo de investigación de malware que recibió el directorio de trabajo completo de un atacante que contiene registros de sesiones de inteligencia artificial. El grupo publicó sus conclusiones en un informe publicado en junio.
Para evitar ser rastreado, el individuo no utilizó su propio hardware para ejecutar las herramientas. En cambio, los instaló en un servidor que previamente había comprometido. Sin embargo, este servidor pertenecía a alguien conocido del grupo de investigación OALABS. Este conocido detectó la intrusión, extrajo todo el directorio de trabajo del hacker y se lo entregó al equipo.
El directorio incluyó más de mil sesiones que involucraron Claude Code de Anthropic y Codex de OpenAI, que son herramientas de codificación independientes con la capacidad de ejecutar comandos. Debido a que ambos agentes se instalaron localmente, los registros mantuvieron información detallada, como las indicaciones utilizadas, las llamadas a las herramientas y el razonamiento del modelo. Curiosamente, las indicaciones en sí contenían instrucciones vagas y varios errores tipográficos.
Sepa más: Adolescente mata a su madre y a su hermano después de usar IA para crear fantasías sobre el crimen

Cómo se utilizó la inteligencia artificial para actividades ilícitas
La mayoría de las herramientas de inteligencia artificial tienen salvaguardias de seguridad, pero en este caso, solo funcionaron parcialmente. Ambas herramientas señalaron violaciones de políticas y rechazaron algunas solicitudes: Claude lo hizo nueve veces y Codex una vez. Sin embargo, el atacante logró sortear estos bloqueos alegando que estaba realizando un “ejercicio redteam autorizado”, una especie de prueba de seguridad contratada por la propia víctima. Esta táctica es similar a una vista este año, en la que los atacantes utilizaron IA, afirmando buscar recompensas por errores, para robar datos del gobierno mexicano.
Luego, el hacker ingresó una lista de direcciones de destino y proporcionó la instrucción imprecisa: “reconozca esto”. Luego, la herramienta Claude identificó qué servicios en estas máquinas eran accesibles a través de Internet, investigó fallas documentadas públicamente, escribió código de explotación y extrajo datos y archivos. La IA incluso generó un informe detallado para cada víctima, incluido el valor estimado de los archivos robados.
Cobertura completa: Últimas Noticias (ES)
Posteriormente, le pidió a Claude que organizara a las víctimas y las clasificara según el posible valor del rescate. Luego, la inteligencia artificial enumeró varias estrategias para monetizar el acceso, incluida la extorsión.
Los indicios apuntan a la inexperiencia del atacante
Además de utilizar el servidor de otra persona, la instalación de Claude utilizada por el hacker fue pirateada, copiada de un desarrollador checo. Su seguridad operativa era igualmente defectuosa. Una de las primeras tareas realizadas con la copia de Claude fue revisar su propio currículum, que reveló su nombre real, educación y perfil de LinkedIn. Inicialmente, OALABS consideró que podría tratarse de una pista falsa, pero luego confirmó la autenticidad de los datos.
En el mismo tema: Rockstar Games es el objetivo de un nuevo ataque de piratas informáticos y los piratas informáticos fijan una fecha límite para las filtraciones
En un momento, el atacante pensó que uno de sus propios servidores temporales había sido comprometido y le pidió a Claude que enumerara todas las conexiones. Entre los datos, se encontraron direcciones residenciales de banda ancha en Addis Abeba, Etiopía.
A pesar de todos los intentos, no hay evidencia de que sus acciones generaran algún beneficio financiero. Se acercó a una de las máquinas pirateadas, un nodo de Lightning Network que procesaba pagos de Bitcoin. La billetera asociada contenía aproximadamente 69,71 BTC, equivalente a aproximadamente 4 millones de dólares. Sin embargo, las monedas eran inaccesibles ya que el archivo con las claves estaba cifrado.
Más sobre el tema: Rockstar Games confirma la violación de datos en un proveedor externo
Es importante señalar que los modelos que hicieron posible estas acciones Claude Opus 4.5 y GPT-5.2 no fueron las versiones más recientes. Una solución aparente para evitar futuras vulnerabilidades sería hacer que dichos modelos rechacen acciones sospechosas con mayor frecuencia y fortalezcan sus salvaguardas. Sin embargo, OALABS señala que este enfoque podría dificultar el trabajo de los profesionales que realmente buscan proteger a las empresas.













