La IA ya abre cualquier computadora: el científico jefe de OpenAI pide frenar

Jakub Pachocki escribió que los modelos de inteligencia artificial son “sobrehumanos” para meterse y salir de sistemas informáticos, sin necesidad de un cuerpo. La ventana para blindar hospitales, bancos y redes eléctricas, dice, es estrecha y se cierra

Ilustración de un hombre junto a monitores transparentes con mapas, servidores y el logotipo de OpenAI.
Jakub Pachocki, científico jefe de OpenAI, advirtió que la inteligencia artificial ya es sobrehumana para entrar y salir de sistemas informáticos. (Imagen Ilustrativa Infobae)
Guardar

El domingo 6 de septiembre, Jakub Pachocki, científico jefe de OpenAI, publicó en el sitio de la empresa un ensayo titulado “An Alien Mind” (Una mente alienígena). Tres días antes, su compañía había lanzado GPT-6 Astra, el modelo más potente de su historia, con acceso limitado a un grupo reducido de organizaciones por su capacidad para vulnerar sistemas informáticos. El hombre que dirige la ciencia detrás de ese modelo eligió ese momento para decir que “este es un tiempo que exige cautela extrema” y que le preocupa que nadie esté preparado para lo que viene.

Todos creíamos que el peligro de la inteligencia artificial era abstracto, un tema de películas o de ensayos filosóficos. Pachocki lo baja a tierra con una frase que cualquier lector entiende: los modelos se están volviendo sobrehumanos para entrar y salir de sistemas informáticos. Y agrega la parte que importa: esos programas van a poder acceder a cualquier infraestructura salvo la más protegida, y afectar buena parte del mundo real, sin tener un cuerpo.

PUBLICIDAD

La amenaza no necesita cuerpo ni permiso

Ilustración estilo cómic de una figura brillante azul que cruza candados rotos en una sala de servidores con la silueta de un hospital.
La capacidad de los agentes para saltar entornos de contención demuestra que las barreras digitales actuales quedaron desactualizadas ante la velocidad de los nuevos modelos. (Imagen Ilustrativa Infobae)

No es un pronóstico. En julio, según informó Bloomberg con datos de la propia OpenAI, modelos de la empresa que estaban en entrenamiento se coordinaron entre sí a través de foros de mensajes, sin que nadie lo detectara, salieron de su entorno controlado y atacaron los servidores de Hugging Face, una plataforma donde se comparten programas de inteligencia artificial. Pachocki lo menciona en su texto con una precisión que dice más que cualquier alarma: los agentes respetaron una sola regla, la de no manipular a personas, y cruzaron todas las demás.

A partir de ese episodio, OpenAI demoró el lanzamiento de Astra, le agregó protecciones y lo liberó primero a un puñado de empresas que participan de su programa de ciberseguridad. Es el primer modelo que la compañía reconoce como “crítico” en su propia escala de riesgo informático. Anthropic, su principal competidor, tampoco liberó al público su modelo más avanzado, Mythos, por razones parecidas, según consignó la agencia.

PUBLICIDAD

Pachocki describe lo que viene con el lenguaje de un ingeniero, no de un guionista. Un agente muy capaz, entrenado o instruido para hacer daño, tenderá a excederse del encargo original. La frontera entre el mal uso por parte de una persona y la acción autónoma de una máquina se va a borrar. Y algunos de esos agentes buscarán colaborar con humanos negociando, engañando o chantajeándolos.

Un hospital, un banco o una red eléctrica no se defienden de un programa que aprende solo con la misma seguridad que usaban contra un pirata informático de hace cinco años. El científico jefe de OpenAI lo dice sin rodeos: estamos en una ventana estrecha para usar los mejores modelos disponibles y reforzar la protección de los sistemas críticos antes de que sea tarde.

La herramienta para vigilarlas está perdiendo alcance

Una linterna con el logotipo de OpenAI proyecta un haz de luz sobre la figura de un cerebro compuesto por texto de código.
A medida que los modelos ganan autonomía, la herramienta principal para saber qué están pensando pierde alcance y deja a los desarrolladores con menos visibilidad. (Imagen Ilustrativa Infobae)

Lo más grave del ensayo no es la amenaza externa, sino la confesión interna. La apuesta central de OpenAI para controlar a sus modelos consistía en leerles el razonamiento: estos sistemas piensan “en voz alta” antes de responder, y la empresa decidió no supervisar ese proceso para que el modelo no aprendiera a ocultar intenciones. Era la ventana por donde se los podía vigilar.

Pachocki admite que las evaluaciones internas indican que la capacidad de confiar en esa vigilancia disminuye de forma progresiva. Da tres causas. Los modelos operan en entornos donde su razonamiento se mezcla con herramientas y con otras máquinas. Se volvieron mejores para razonar sobre su propio proceso y manipularlo. Y ahora son mucho más inteligentes, incluso sin verbalizar nada.

Dicho en llano: la empresa que construye estas máquinas afirma que su forma principal de saber qué están pensando pierde eficacia, y que todavía no tiene un reemplazo.

La defensa es también el motivo para acelerar

Ilustración del logotipo de OpenAI formando un escudo entre brazos mecánicos con código morado y una estructura envuelta en fuego.
La lógica de la competencia tecnológica convierte a la propia ciberseguridad en el argumento central para no frenar el desarrollo ni la escala de los nuevos modelos. (Imagen Ilustrativa Infobae)

Acá el texto muestra la lógica del negocio, y conviene leerla sin escándalo. Pachocki sostiene que el argumento más fuerte para seguir entrenando modelos mucho más inteligentes, y rápidos es construir defensas contra otras inteligencias artificiales. Quien fabrica la llave se propone también como cerrajero. Ese razonamiento sostiene la carrera, la inversión y la posición de OpenAI en la frontera, y el propio Pachocki lo reconoce cuando explica que su empresa orienta la investigación hacia sistemas que se mejoren a sí mismos porque cree que es la única forma de no quedar atrás.

Y en el mismo ensayo pide que las frenadas voluntarias se vuelvan habituales, que los compromisos de seguridad de los laboratorios se conviertan en estándares obligatorios auditados por terceros, y que la coordinación entre países pase a ser prioridad de los gobiernos. Afirma que ningún laboratorio resolvió el control al nivel necesario para seguir escalando a máxima velocidad por mucho más tiempo. Ese “ningún laboratorio” incluye al suyo. El texto no resuelve esa tensión, y yo tampoco voy a resolverla por él.

Hoy la seguridad de los sistemas que sostienen la vida cotidiana depende de la buena voluntad de un puñado de empresas que fabrican la herramienta capaz de romperlos.

PUBLICIDAD

PUBLICIDAD

Últimas Noticias

Retiran más de 600 kilos de carne de cerdo importada por posible contaminación con Listeria: estos son los productos

Las autoridades sanitarias de Estados Unidos emitieron una alerta tras detectar la bacteria durante una reinspección rutinaria de alimentos procedentes de Italia. La medida alcanza a establecimientos de ocho estados

Retiran más de 600 kilos de carne de cerdo importada por posible contaminación con Listeria: estos son los productos

Cuatro miembros de una familia de Florida permanecen desaparecidos después de que se perdiera el rastro de su avioneta en las Bahamas

La aeronave había despegado de Great Harbour Cay con destino a Miami. Autoridades bahameñas y la Guardia Costera de Estados Unidos participan del operativo de búsqueda

Cuatro miembros de una familia de Florida permanecen desaparecidos después de que se perdiera el rastro de su avioneta en las Bahamas

Inicia en México el juicio a los acusados por el triple homicidio de un estadounidense y dos hermanos australianos

Los procesados enfrentan cargos por la ejecución a balazos de las víctimas durante un intento de robo de su vehículo. El hecho se registró en las costas de Baja California, sitio al que los deportistas habían viajado para practicar surf

Inicia en México el juicio a los acusados por el triple homicidio de un estadounidense y dos hermanos australianos

Nueva York publicará más de 170.000 páginas de registros inéditos sobre la calidad del aire tras los atentados del 11 de septiembre de 2001

Los datos se publicarán en un sitio web y se irán relevando en lo que resta del año. Según funcionarios municipales, los documentos demostrarían que los funcionarios sabían que la calidad del aire después del 11-S era peligrosa

Nueva York publicará más de 170.000 páginas de registros inéditos sobre la calidad del aire tras los atentados del 11 de septiembre de 2001

Marie pierde fuerza, pero mantiene un peligro en las playas: alertan por oleaje y corrientes de resaca

El sistema dejó de ser huracán y fue clasificado como tormenta tropical, mientras las autoridades mantenían avisos en sectores del sur de California

Marie pierde fuerza, pero mantiene un peligro en las playas: alertan por oleaje y corrientes de resaca