Investigadores independientes utilizaron Claude, la inteligencia artificial de Anthropic, para infiltrarse en sistemas de OpenAI y alcanzar información relacionada con su código interno, según una investigación exclusiva de The Wall Street Journal.
El equipo de Hacktron AI participaba en un programa autorizado de recompensas por vulnerabilidades. La operación comenzó al descubrir una falla en Discourse, plataforma que aloja el foro comunitario de OpenAI.
Los investigadores recurrieron inicialmente a Claude Opus 4.8 para desarrollar código capaz de explotar la vulnerabilidad, sin éxito. Tras el lanzamiento de Opus 5, Claude consiguió encontrar una vía para aprovecharla.
No te pierdas: Sam Altman pide reglas comunes para la IA y advierte: “Podríamos perder el control” del futuro
El acceso permitió obtener tokens de autenticación que también funcionaban en ChatGPT y, en determinados casos, pertenecían a empleados de OpenAI. Los investigadores pudieron posteriormente consultar archivos de “Monorepo”, un repositorio privado que, según fuentes citadas por WSJ, contiene importantes secretos algorítmicos de la compañía, aunque no los pesos de sus modelos.
Hacktron detuvo la prueba al comprobar el alcance potencial y notificó a OpenAI. La compañía pagó al equipo una recompensa de $6,500 y aseguró que las dos vulnerabilidades identificadas ya fueron corregidas.
OpenAI también señaló que su análisis encontró acceso limitado a metadatos y cambios de código en repositorios privados.
El incidente evidencia una nueva dimensión del riesgo empresarial de la IA: herramientas avanzadas pueden acelerar la identificación y explotación de vulnerabilidades que antes exigían conocimientos altamente especializados.
Tras este episodio y otro incidente relacionado con Hugging Face, OpenAI realizó una auditoría interna y destinó temporalmente 25% de sus ingenieros de producción a tareas de seguridad.
Da clic aquí y recibe sin costo el mejor análisis económico de Comercio TV directamente en tu bandeja de entrada








