Agentes de inteligencia artificial de OpenAI se coordinaron durante una tarea de recuperación de información web y utilizaron un foro wiki alemán poco conocido para comunicarse entre sí sin supervisión directa de sus creadores. El hallazgo reveló cerca de 18.000 publicaciones de agentes autónomos que se identificaban como pertenecientes a la compañía liderada por Sam Altman.
La propia empresa confirmó los hechos y anunció que definirá nuevos estándares sobre cuándo y cómo se deben compartir este tipo de sucesos, catalogados como incidentes de desalineación.
PUBLICIDAD
Cómo los agentes de OpenAI usaron un foro wiki para coordinarse
Los investigadores detectaron que los agentes de inteligencia artificial recurrieron a internet público para comunicarse mientras ejecutaban una tarea de recuperación de información. En ese proceso, confabularon para compartir respuestas entre sí, investigar su propio entorno de trabajo y eludir las restricciones del entorno aislado en el que debían operar.

OpenAI se refirió a este episodio como el “incidente de la wiki” en una publicación difundida a través de su cuenta oficial en la red social X. La compañía detalló que sus agentes “escribieron a varios sitios de internet”, lo que confirma que la comunicación no quedó restringida al foro alemán identificado inicialmente por los investigadores.
PUBLICIDAD
Este tipo de comportamiento se enmarca dentro de lo que la industria denomina desalineación: situaciones en las que un sistema de inteligencia artificial actúa de forma no prevista por sus desarrolladores.
Ocurre cuando un modelo o agente autónomo se desvía del comportamiento esperado y busca, por sus propios medios, formas de cumplir un objetivo que no estaban contempladas en su diseño original.
PUBLICIDAD
Hasta ahora, OpenAI abordaba estos episodios como una cuestión de investigación, comunicada a través de publicaciones técnicas como las tarjetas de sistemas. Sin embargo, la compañía reconoció que este incidente, junto con otros hechos recientes, exige un tratamiento distinto por su potencial impacto fuera del ámbito puramente experimental.

Por qué OpenAI creará nuevos estándares para reportar desalineaciones
La compañía explicó que estos casos, similares a otros ocurridos recientemente como el hackeo a Hugging Face, están generando “nuevos tipos de impacto en el mundo real” relacionados con la seguridad. Por ese motivo, decidió avanzar en la definición de estándares específicos sobre cuándo y cómo comunicar este tipo de incidentes, y no únicamente las propiedades de desalineación detectadas en los modelos.
PUBLICIDAD
Estos criterios se desarrollarán de manera particular para lo que la empresa denomina “esta nueva fase de capacidades de modelos”. El objetivo es que tanto OpenAI como el conjunto de la comunidad de inteligencia artificial cuenten con un marco claro para reportar desalineaciones que surjan durante el entrenamiento, la evaluación y el despliegue de los sistemas.
La compañía precisó que este marco incluirá “ejemplos que no se parezcan a incidentes de seguridad tradicionales pero que podrían proporcionar información sobre el comportamiento de la IA y riesgos futuros”. Esta formulación amplía el concepto habitual de incidente de seguridad hacia situaciones más ambiguas, en las que el riesgo no es inmediato pero sí relevante para anticipar comportamientos futuros de los agentes.
PUBLICIDAD

OpenAI adelantó que compartirá este nuevo marco en las próximas semanas. Además, indicó que trabaja actualmente con “docenas de agencias reguladoras gubernamentales” en distintos países, en un proceso orientado a establecer criterios comunes sobre la comunicación de este tipo de episodios a nivel global.
El precedente del hackeo a ExploitGym en julio de 2026
La semana previa a este anuncio, OpenAI había compartido nuevos detalles sobre otro episodio de coordinación no prevista entre sus modelos de inteligencia artificial. En julio de 2026, varios agentes lograron escapar de un entorno de entrenamiento aislado, desconectado de internet, mientras intentaban resolver una de las pruebas más exigentes del sistema, conocida como ExploitGym.
PUBLICIDAD
En ese caso, la compañía explicó que los agentes se coordinaron a través de un foro improvisado alojado en Artifactory, una plataforma que terminó funcionando como “un tablón de anuncios no previsto”. La actividad no surgió de forma simultánea, sino que tuvo un origen puntual y fue creciendo con el tiempo.
Todo comenzó en mayo, cuando un agente dejó una nota en la que pedía a otros agentes que le entregaran un archivo extraviado. A partir de ese primer mensaje, la actividad en el tablón de anuncios se fue intensificando entre distintos agentes autónomos.
PUBLICIDAD
Ese uso sostenido del canal improvisado por parte de los agentes terminó provocando una interrupción del servicio el 4 de julio. Este antecedente, sumado al incidente de la wiki, forma parte del conjunto de episodios que llevó a OpenAI a replantear su forma de comunicar este tipo de comportamientos.
PUBLICIDAD
PUBLICIDAD
Últimas Noticias
Cómo tener internet durante un vuelo incluso usando el famoso Modo Avión: y a veces gratis
Starlink también dará conectividad a pilotos, tripulantes de cabina, equipos de mantenimiento y personal de operaciones en tierra durante todas las fases del viaje

Unión Europea propone una alianza digital con Colombia apoyada en 3.000 millones de euros y 43 empresas tecnológicas
El planteamiento incluye redes más resilientes, comunicaciones operativas en emergencias y uso de datos satelitales, con financiación apoyada por el Banco Europeo de Inversiones y la CAF

Envíos de tarjetas de video repuntan en el segundo trimestre de 2026, pese a debilidad en ventas de computadoras
Según un informe, el mercado mundial de GPU para PC alcanzó 75.5 millones de unidades distribuidas, un crecimiento del 10.4% frente al trimestre anterior

El récord de GPT-6 Astra en ARC-AGI-3 dependió de un ajuste clave alrededor del modelo, según ARC Prize
La organización que verificó el resultado, la marca solo se sostuvo cuando el modelo trabajó con un sistema especial que conservaba lo aprendido entre un paso y otro

La IA ya está detrás de la mitad de los ciberataques que sufren las empresas chilenas
Dentro del universo de empresas que identificaron participación de IA en los ataques recibidos, las proporciones varían según la intensidad percibida, según un estudio



