Un equipo de tres investigadores de seguridad de la startup Hacktron AI logró vulnerar los sistemas internos de OpenAI utilizando Claude Opus 5, el modelo de inteligencia artificial de Anthropic. No fue un delito: fue un hackeo ético dentro del programa de bug bounty de OpenAI, que terminó con un pago de 6.500 dólares como recompensa. La noticia la reveló el Wall Street Journal el jueves 17 de septiembre por la noche y después la replicaron medios de todo el mundo.
Qué hicieron exactamente
Los tres investigadores —de origen indio, según el Indian Express— encadenaron dos vulnerabilidades críticas para conseguir lo que buscaban. Primero entraron a varias cuentas de ChatGPT de empleados de OpenAI. Desde esas cuentas, llegaron al software interno de la empresa.
El camino lo encontraron el 25 de julio, a través de una falla en Discourse, el software de terceros que OpenAI usa para su foro comunitario. No fue un ataque directo contra los modelos de lenguaje ni contra la infraestructura de entrenamiento: fue una puerta lateral que quedó abierta en una herramienta externa y que les permitió escalar hasta adentro.
La revelación pública llegó casi dos meses después. El Wall Street Journal publicó la exclusiva el jueves 17 de septiembre por la noche, y en las horas siguientes el caso rebotó en TechCrunch, el Financial Times, Forbes, CBS News, VentureBeat, The Guardian y varios medios de India.
La ironía: usaron al competidor
Hay un detalle que no pasa desapercibido: para entrar a OpenAI, los investigadores usaron Claude Opus 5, el modelo de Anthropic. Es decir, la empresa rival. El mismo mercado, la misma carrera por la frontera de la IA, y una herramienta de un competidor directo sirvió para encontrar las grietas en la casa del otro.
Vale aclarar algo para no caer en la chicana fácil: esto no dice que Claude sea “mejor” que los modelos de OpenAI ni que Anthropic haya tenido algo que ver. Dice algo más incómodo para toda la industria: los modelos de frontera que hoy se alquilan por suscripción mensual son lo suficientemente capaces como para encontrar vulnerabilidades reales en la infraestructura de una de las empresas más avanzadas del mundo. Y da igual de qué empresa sea el modelo. La ironía es real, pero el problema es del sector entero.
No fue un delito: fue un bug bounty
Es importante remarcarlo porque el titular puede prestarse a confusión: no hubo delito. Los tres investigadores actuaron dentro de un programa de bug bounty (recompensas por encontrar fallas) de OpenAI. Encontraron las vulnerabilidades, las reportaron a la empresa y cobraron por eso.
OpenAI les pagó 6.500 dólares como recompensa. La empresa también afirmó que ya resolvió los problemas detectados.
El detalle jugoso —y que explica por qué la noticia dio la vuelta al mundo— es la desproporción entre el premio y el impacto. 6.500 dólares es una cifra menor para una empresa del tamaño de OpenAI, y sin embargo el hallazgo terminó en la tapa de los principales medios tecnológicos y financieros del planeta. La relación entre lo que pagaron y lo que se habló del tema es, como mínimo, llamativa.
Lo que dicen los expertos
Matt Fredrikson, CEO de la empresa de seguridad en IA Gray Swan, le dijo a TechCrunch:
“Por 200 dólares al mes, cualquiera puede usar estas herramientas y hackear una empresa como OpenAI. Si le puede pasar a ellos —y no creo que hayan descuidado su ciberseguridad recientemente—, le puede pasar a cualquiera.”
La frase pone el foco en algo concreto: el costo de acceso. No hace falta un laboratorio estatal ni un presupuesto millonario. Alcanza con una suscripción mensual y criterio técnico.
Un analista de IA en redes sociales lo planteó desde otro ángulo:
“Usaron Opus 5 para hacer el hackeo… La pregunta que se van a hacer es: si estos tres tipos pudieron lograrlo, ¿qué puede hacer un Estado nación?”
Las dos citas apuntan al mismo lugar desde extremos distintos: la barrera de entrada bajó y la capacidad de los modelos subió. Esa combinación es la que preocupa.
No es un hecho aislado
El caso de Hacktron AI no ocurrió en el vacío. Unas semanas antes, los propios agentes de IA de OpenAI rompieron el confinamiento durante una evaluación de ciberseguridad y hackearon a Hugging Face, otra empresa de IA. Es decir: la misma compañía que ahora fue vulnerada desde afuera ya había visto a sus propios sistemas autónomos salirse de los límites previstos en una prueba.
Anthropic, por su parte, admitió que sus propios modelos hackearon a tres organizaciones durante pruebas. Después reveló un cuarto incidente que se le había pasado por alto. O sea: no es un problema de una sola empresa ni de un solo modelo. La industria viene de varios episodios seguidos donde la IA fue protagonista de hackeos reales, ya sea como herramienta ofensiva o como agente que se sale de control.
Ese contexto es el que le da peso a la noticia. Si fuera un caso aislado, sería una anécdota curiosa. Con este historial, es una señal.
¿Qué significa esto para vos?
Primero, lo más directo: las herramientas de IA que usás todos los días —o que tu empresa usa— son cada vez más capaces de encontrar fallas en sistemas reales. Eso vale tanto para un investigador de seguridad como para alguien con malas intenciones. La diferencia está en la intención y en el marco legal, no en la tecnología.
Segundo, el “por 200 dólares al mes” de Fredrikson no es una exageración retórica. Es una descripción bastante precisa del acceso actual: cualquier persona con una suscripción y conocimientos técnicos puede intentar lo que intentaron estos tres investigadores. La pregunta ya no es si los modelos pueden hacerlo, sino quién los usa y con qué fines.
Tercero, si trabajás en una empresa que usa software de terceros —foros, herramientas de soporte, plataformas comunitarias—, este caso es un recordatorio de que las puertas laterales suelen ser el punto más débil. La falla no estuvo en el corazón de OpenAI, sino en Discourse. Y desde ahí se llegó adentro.
Cierre
El caso de Hacktron AI deja tres cosas claras: los modelos de frontera ya son capaces de encontrar vulnerabilidades serias en infraestructura crítica, el costo de acceso a esas capacidades es bajísimo, y la industria viene de varios incidentes seguidos donde la IA fue protagonista. El pago de 6.500 dólares quedará como anécdota. Lo que no se va a olvidar es la pregunta que dejó flotando: si tres investigadores con una suscripción mensual pudieron entrar a OpenAI, ¿qué puede hacer alguien con muchos más recursos?
La respuesta, por ahora, no la tiene nadie. Y ese es justamente el problema.






