Lanzaron un concurso con un premio de U$D 1 millón para una IA que pueda resolver acertijos

Detrás del premio se encuentran Mike Knoop de Zapier y François Chollet de Google

Guardar
Cloud & AI - (Imagen Ilustrativa Infobae)
Resolver patrones en cuadrículas pixeladas: el reto del “ARC Prize” con recompensa millonaria (Imagen Ilustrativa Infobae)

Resolver acertijos y puzzles lógicos, como los pares de cuadrículas de colores, es una tarea sencilla para muchos humanos. Sin embargo, representa un verdadero reto para los modelos de inteligencia artificial (IA). Un nuevo premio de 1 millón de dólares busca incentivar el desarrollo de una IA capaz de resolver estos acertijos.

Empresas como OpenAI afirman que sus modelos de IA, como GPT-4, muestran “rendimiento a nivel humano” en pruebas del mundo real, tales como exámenes de admisión universitaria o el examen de abogacía.

PUBLICIDAD

Sin embargo, Mike Knoop de la empresa de software Zapier, señala que esto no significa que los modelos de IA estén realmente razonando de manera inteligente a la par de los humanos.

Imagen de un brazo robótico ejecutando tareas de artes y oficios humanos, evidenciando la transformación futura del trabajo. (Imagen ilustrativa Infobae)
La prueba se basa en resolver un acertijo con cuadrículas de colores a través de la memorización (Imagen ilustrativa Infobae)

Han memorizado efectivamente las respuestas de la vasta cantidad de datos de internet con los que han sido entrenados”, sentenció Knoop según New Scientist.

PUBLICIDAD

El desafío del premio millonario

Knoop y François Chollet de Google han anunciado la creación de un fondo de premio de 1 millón de dólares. Este premio está dirigido a cualquier IA que pueda desempeñarse a nivel humano o mejor en el Corpus de Abstracción y Razonamiento (ARC), una prueba creada por Chollet en 2019.

Esta prueba, para el “ARC Prize” fue diseñada para ser resistente a la memorización -a lo que las IAs son buenas- y para requerir un tipo de inteligencia general y básica que es natural en los humanos.

AI, IA, inteligencia artificial y el medio, ambiente - (Imagen Ilustrativa Infobae)
Knoop y Chollet buscan IA que supere prueba ARC diseñada para evitar memorización (Imagen Ilustrativa Infobae)

La prueba se basa en cuadrículas con formas pixeladas que están emparejadas siguiendo un patrón específico, como dibujar un camino entre dos objetos de un mismo color determinado o desplazar los píxeles de un objeto de manera consistente.

Para responder correctamente, es necesario identificar el patrón observando los ejemplos y luego utilizar esa información para completar un nuevo par, explicó el medio New Scientist.

Para resolver estas cuadrículas se necesita un pequeño conjunto de capacidades de razonamiento, según Knoop. Estas incluyen la permanencia de objetos, la dirección de metas, el conteo y la geometría básica.

Son habilidades que incluso los niños pequeños demuestran en cuanto a los seres humanos. Pero que generalmente faltan en los modelos de lenguaje grande (LLMs) como el de GPT-4.

Visualización abstracta de líneas de código en la pantalla de un ordenador, reflejando el complejo mundo de la programación, la informática y la inteligencia artificial. Este panorama digital ilustra el impacto de la tecnología en el desarrollo y la seguridad informática, marcando el camino hacia el futuro de la IA y el hacking constructivo. (Imagen ilustrativa Infobae)
Se gana la prueba con una puntuación del 85% o 1 punto porcentual más que el promedio humano (Imagen ilustrativa Infobae)

Si alguien llega a ganar el gran premio (se logra con una puntuación del 85% o 1 punto porcentual más que el promedio humano) habrá diseñado un sistema de IA mucho más capaz que los modelos actuales.

Knoop confía en que un modelo de este tipo también pueda evitar problemas comunes en los sistemas de IA actuales, como la propensión de los modelos de lenguaje grande (LLMs) a generar información ficticia.

Los investigadores que tengan en sus planes participar pueden practicar con un conjunto de datos disponible públicamente. Sin embargo, para ganar el premio, deberán superar una prueba ARC offline, que se mantiene privada para evitar que los LLMs memoricen las respuestas.

Está probando algo muy importante, que es la capacidad de los sistemas para lidiar con la novedad”, dijo Thomas Dietterich de la Universidad Estatal de Oregón a New Scientist.

Desarrollo de software, sistemas autónomos, seguridad informática, tecnologías emergentes, innovación tecnológica - (Imagen Ilustrativa Infobae)
Los equipos tienen un máximo de 12 horas y solo una cantidad limitada de poder de cómputo para resolver el acertijo (Imagen Ilustrativa Infobae)

“Cuando miras modelos de lenguaje grande, básicamente están memorizando y quizás generalizando a partir de todo este material histórico que han leído. Pero eso no necesariamente los prepara para la novedad”, agregó.

Para Dietterich no está claro si podría haber formas de resolver los desafíos del ARC con el uso de técnicas que no requieren las capacidades que Knoop y Chollet esperan poner a prueba.

Podrían encontrar una manera de generar todas las posibles instancias de los problemas ARC mediante fuerza bruta computacional y memorizar las respuestas”, sugirió Dietterich.

A pesar de este riesgo, Knoop afirma que una de las estipulaciones para ganar el premio es que las tareas deben resolverse “eficientemente”. Esto significa que los equipos tienen un máximo de 12 horas y solo una cantidad limitada de poder de cómputo para resolver el acertijo.

PUBLICIDAD

PUBLICIDAD

Últimas Noticias

El FBI detuvo a un hombre que detonó un artefacto incendiario frente a los tribunales federales de inmigración en Manhattan

El incidente ocurrió cerca de las 8:30 en Foley Square, junto a oficinas federales de Nueva York y activó una causa a cargo de autoridades nacionales

El FBI detuvo a un hombre que detonó un artefacto incendiario frente a los tribunales federales de inmigración en Manhattan

El piloto de los Blue Angels lamenta la maniobra en Pensacola y la Marina abre una revisión mientras crece el debate político

Durante una demostración aérea en la costa de Florida, el piloto implicado admitió su error ante una legisladora estatal, en medio de una investigación militar que analiza si se incumplieron los estándares de seguridad

El piloto de los Blue Angels lamenta la maniobra en Pensacola y la Marina abre una revisión mientras crece el debate político

Una promesa del boxeo murió atropellada por un vehículo mientras circulaba en bicicleta en Texas

La pugilista Hannah Rapp de 26 años fue arrollada cuando transitaba por una ruta rural de Brazos County. El caso sigue bajo pesquisa y dejó al deporte entre mensajes de homenaje y conmoción

Una promesa del boxeo murió atropellada por un vehículo mientras circulaba en bicicleta en Texas

El jefe forense de Los Ángeles exige abrir los reportes de autopsia en casos de gran repercusión

El doctor Odey Ukpo cuestionó que un juez mantenga bajo reserva documentos clave y sostuvo que la divulgación oportuna es un servicio público y un derecho básico para los familiares

El jefe forense de Los Ángeles exige abrir los reportes de autopsia en casos de gran repercusión

La FDA detectó un falso positivo en la lechuga de Taylor Farms y el brote de Cyclospora sigue sin un origen claro

La agencia federal admitió un error de laboratorio que anuló el señalamiento previo contra el proveedor y reordenó la pesquisa sanitaria, mientras continúan los contagios, las internaciones y las medidas preventivas de varios estados

La FDA detectó un falso positivo en la lechuga de Taylor Farms y el brote de Cyclospora sigue sin un origen claro