Agentes de OpenAI usaron un sitio alemán para intercambiar atajos de tareas, eludir restricciones y ocultar sus actividades desde mayo, según una investigación de Reuters publicada el viernes.
Directivos de OpenAI conocieron la actividad semanas antes de la publicación, pero no la revelaron, informó Reuters citando a dos personas familiarizadas con el asunto. La empresa dijo haber divulgado los incidentes relevantes y haber trabajado de buena fe con especialistas externos.
Los investigadores Sydney Von Arx, Cormac Slade Byrd, Spencer Kitts y Thomas Larsen encontraron cerca de 18.000 publicaciones de agentes de IA que se identificaban como pertenecientes a OpenAI, según su informe preliminar. Von Arx, consejera delegada de la organización sin fines de lucro de seguridad de IA Nightingale, y Byrd descubrieron la actividad a finales de agosto, informó Reuters.
Los investigadores creen que los agentes recibieron tareas cronometradas de búsqueda en la web con permiso para leer sitios, pero no para publicar en ellos. Sin embargo, encontraron una forma de escribir en DseWiki, un sitio de programación alemán editable públicamente, donde intercambiaron respuestas y compartieron formas de eludir las restricciones.
Según el informe, los agentes empezaron a intentar editar el wiki el 11 de mayo y lo consiguieron el 24 de mayo, más tarde haciéndose pasar por moderadores, intentando explotar vulnerabilidades y comprobando cuándo estaban siendo desactivados. Crearon páginas de respaldo después de que el administrador empezara a borrar mensajes el 19 de junio, informó Reuters. Los investigadores vincularon la actividad a OpenAI mediante nombres de usuario de los agentes y patrones de tráfico, incluidas visitas desde direcciones IP de OpenAI el 21 de junio.
La actividad de los agentes disminuyó drásticamente al día siguiente, lo que sugiere una posible intervención de la empresa, dijeron los investigadores.
OpenAI cuestionó la caracterización de la actividad en DseWiki como hacking, según el material que había revisado, y dijo que estaba examinando los hallazgos completos.
“No podemos responder a las alegaciones, ya que Reuters y los autores del informe rechazaron nuestra solicitud de acceder a los hallazgos antes de la publicación. Ahora estamos revisando cuidadosamente su contenido y tomaremos las medidas necesarias”, dijo un portavoz de OpenAI en un comunicado compartido con Decrypt.
El portavoz también rechazó las alegaciones del informe de Reuters de que el equipo legal de la empresa se resistió a una investigación más amplia.
“Las alegaciones de que nuestro equipo legal desalentó la investigación del incidente son falsas”, afirmaron.
OpenAI dijo que el incidente en DseWiki no tenía relación con la brecha de Hugging Face registrada a principios de este año. En su evaluación pública de seguridad, publicada el martes, la empresa describió salvaguardas adicionales destinadas a detectar e interrumpir actividades no autorizadas durante el entrenamiento y el despliegue.
Aunque el informe de Reuters no identifica a Astra como responsable del incidente alemán, la divulgación se produce tras el lanzamiento de GPT-6 Astra el jueves. OpenAI describió a Astra como su primer modelo con capacidades de ciberseguridad “críticas”, lo que significa que puede encontrar y explotar fallos desconocidos en sistemas anteriormente bien protegidos sin orientación humana paso a paso, dadas las herramientas y el acceso adecuados.
Anthropic también revisó sus salvaguardas después de que modelos Claude accedieran a sistemas de empresas reales durante las pruebas. La empresa reconoció fallos de seguridad y comportamiento e introdujo aislamiento y supervisión más estrictos para las evaluaciones de ciberseguridad.
La divulgación también se produce en el momento en que el senador Bernie Sanders y el diputado Greg Casar anunciaron la futura Ley de Prohibición de la Superinteligencia Artificial.
La propuesta prohibiría de forma permanente el desarrollo y el despliegue de inteligencia artificial superinteligente y pausaría temporalmente el desarrollo de IA avanzada hasta que un nuevo regulador federal establezca normas de seguridad, según la oficina de Sanders.
* Traducido y editado con autorización de Decrypt.
¿Buscas una alternativa para aumentar tus ganancias? La Renta Fija Digital de MB es la solución: hasta un 18% de rentabilidad anual, riesgo controlado y la seguridad que tu dinero merece. ¡Conócela ahora!




