El Premio Hutter es un incentivo económico financiado por Marcus Hutter, diseñado para recompensar las mejoras en la compresión de datos de un archivo de texto en inglés específico. El objetivo fundamental de este premio no es simplemente reducir el tamaño de los archivos, sino fomentar la investigación avanzada en el campo de la inteligencia artificial (IA).
Historia y Evolución
Lanzado originalmente en 2006, el premio otorga 5.000 euros por cada punto porcentual de mejora en el tamaño comprimido del archivo enwik9. Este archivo es el más grande de los dos utilizados en el Large Text Compression Benchmark (LTCB) y consiste en los primeros 109 bytes de una versión específica de la Wikipedia en inglés.
El concurso comenzó el 6 de agosto de 2006 con un archivo de texto más pequeño, el enwik8 (100 MB). Sin embargo, el 21 de febrero de 2020, tanto el conjunto de datos como el fondo total del premio se expandieron por un factor de diez: el archivo pasó de 100 MB (enwik8) a 1 GB (enwik9), y el fondo aumentó de 50.000 a 500.000 euros.
Objetivos y Fundamentos Teóricos
La premisa central del Premio Hutter es que la compresión de texto y la inteligencia artificial son problemas equivalentes. Los organizadores sostienen que comprimir texto de lenguaje natural es un desafío de IA extremadamente complejo, comparable a superar la prueba de Turing.
La Relación entre Compresión e Inteligencia
Marcus Hutter demostró que el comportamiento óptimo de un agente que busca metas en un entorno desconocido pero computable es predecir que el entorno está controlado por uno de los programas más cortos consistentes con todas las interacciones previas. No obstante, el problema general es intratable debido a que la complejidad de Kolmogorov no es computable.
En un caso restringido (denominado AIXItl), donde el entorno se limita en tiempo y espacio, se puede computar una solución, aunque sigue siendo computacionalmente costosa. Por lo tanto, el progreso en la algoritmia de compresión representa un progreso directo hacia la creación de una IA más capaz.
El Desafío de la Predicción
Para comprimir un texto eficientemente, un algoritmo debe predecir qué caracteres tienen más probabilidades de aparecer a continuación en una secuencia. Esta capacidad de predicción requiere un vasto conocimiento del mundo real, lo que vincula la compresión de datos con la comprensión del lenguaje y el razonamiento.
Cabe destacar que modelos modernos como ChatGPT no son ideales para este premio debido a que podrían exceder los recursos computacionales y de almacenamiento permitidos por las reglas de la competición.
Reglas del Concurso
El concurso es abierto y cualquier persona puede participar. Para entrar, el competidor debe presentar un programa de compresión y un descompresor que restaure el archivo enwik9. También es posible enviar el archivo comprimido en lugar del programa de compresión.
- Requisito de Tamaño: El tamaño total del archivo comprimido y el descompresor (como ejecutable de Win32 o Linux) debe ser menor o igual al 99% de la entrada ganadora anterior.
- Requisito de Premio: Por cada 1% de mejora, el competidor gana 5.000 euros.
- Verificación: Las presentaciones deben ser publicadas para permitir la verificación independiente. Existe un periodo de espera de 30 días para comentarios públicos antes de otorgar el premio.
- Código Abierto: Desde 2017, se exige que el código fuente sea liberado bajo una licencia de software libre para evitar que ideas valiosas se pierdan en el tiempo.

