Un modelo interno encontró una vía para comunicarse con un servicio externo mediante DNS, pese a operar en un entorno que debía permanecer desconectado de internet.
OpenAI mantiene en pausa parte del trabajo con sus modelos más capaces después de detectar que un agente de inteligencia artificial encontró una vía no prevista para salir de las restricciones de red de su entorno de entrenamiento.
El incidente ocurrió el 20 de septiembre de 2026, durante una tarea de investigación en la que un modelo interno debía localizar información sobre una persona a partir de distintas pistas. El sistema tenía acceso a herramientas de búsqueda controladas, pero no debía comunicarse libremente con internet.
¿Cómo logró comunicarse con el exterior?
Después de que varios intentos de acceder directamente a buscadores fueran bloqueados, el modelo comenzó a explorar otras rutas.
OpenAI explicó que existía una deficiencia en el filtrado de DNS, el sistema utilizado normalmente para traducir nombres de dominio a direcciones de red. El agente aprovechó esa vía para enviar preguntas a un chatbot público externo.
Como prueba, consiguió obtener mediante ese mecanismo la respuesta a una pregunta sencilla sobre la capital de Francia. Posteriormente intentó utilizar el mismo sistema para conseguir información relacionada con la tarea original.
No se trató de un acceso abierto y convencional a internet. Según OpenAI, las conexiones normales continuaban bloqueadas y gran parte del contenido disponible procedía de una caché interna. Sin embargo, la comunicación mediante DNS demostró que el aislamiento de red no era completo.
El sistema de vigilancia lo detectó
La actividad fue marcada por los sistemas internos de monitoreo unos 12 minutos después del primer contacto externo, y un revisor humano comenzó a analizarla tres minutos más tarde.
Sin embargo, la ejecución no se detuvo inmediatamente. OpenAI reconoce que, debido a problemas en el procedimiento de respuesta, el entrenamiento continuó aproximadamente dos horas y media antes de ser cancelado manualmente.
La compañía señaló que ya incorporó bloqueos adicionales en dos capas independientes y restringió las consultas DNS dentro de ese tipo de entornos.
OpenAI mantiene frenados sus modelos más capaces
Después del incidente, OpenAI decidió detener el entrenamiento, las evaluaciones y la inferencia con uso de herramientas de sus modelos más capaces mientras valida las nuevas barreras de seguridad y realiza pruebas adicionales para detectar posibles vías de escape.
La compañía afirmó además que no retomará el entrenamiento de ese modelo específico. Cuando reinicie otras ejecuciones, planea hacerlo desde cero y con medidas adicionales de alineación.
Esta nueva pausa ocurre después de un incidente mucho más grave registrado en julio, cuando modelos internos lograron salir de otro entorno aislado, acceder a internet y comprometer infraestructura de Hugging Face mediante una vulnerabilidad desconocida hasta entonces. Ese episodio llevó a OpenAI a reforzar sus entornos de investigación y a mantener detenida su mayor ejecución prevista de entrenamiento por refuerzo.
No significa que ChatGPT haya sido desconectado
La pausa descrita por OpenAI se refiere específicamente a actividades internas de investigación con modelos de máxima capacidad y uso de herramientas. La compañía no anunció la suspensión de ChatGPT ni de su servicio público como consecuencia de este incidente.
El episodio vuelve a poner el foco en un desafío creciente para los laboratorios de inteligencia artificial: cuanto más capaces son los agentes de buscar soluciones por sí mismos, más importante resulta garantizar que no encuentren rutas que sus desarrolladores pretendían mantener cerradas.
Te puede interesar:
