Asimov predijo los fallos de la IA actual hace 75 años

Los relatos de Isaac Asimov sobre robots con cerebros positrónicos no solo son clásicos de la ciencia ficción, sino un manual involuntario de los problemas que enfrentan los sistemas de inteligencia artificial hoy. Sus tramas, escritas hace más de siete décadas, describen con precisión fallos como bucles infinitos, alineamiento defectuoso y la opacidad de las cajas negras. Una relectura de su obra revela paralelismos asombrosos con los desafíos técnicos y éticos de los agentes basados en LLMs.

Del cerebro positrónico al modelo estadístico

A diferencia de los programas rígidos de "si/entonces", el cerebro positrónico de Asimov funcionaba como una red de circuitos de platino e iridio donde las descargas de positrones generaban ondas de potencial que respondían a pesos relacionales. Esta visión, plasmada en 1941, anticipaba que la IA que soportaría a los robots sería estadística y no algebraica, basada en potenciales que se corresponden con los pesos de los modelos actuales.

Asimismo, aunque el marco teórico de Asimov era mecanicista, intuyó los fallos estructurales que surgen al someter un sistema de toma de decisiones complejo a directivas contrapuestas, contexto impreciso y entornos dinámicos. Es decir, a prompts incompletos, contextos inexactos y resoluciones basadas en el tiempo.

Problemas que resuenan hoy

La lista de paralelismos entre los relatos de Asimov y los desafíos actuales de la IA es extensa. Uno de los más evidentes es el conflicto de ponderaciones y bucles de decisión. En "Círculo vicioso", el robot SPD-13 (Speedy) queda atrapado en un bucle orbital al equilibrarse las leyes Segunda y Tercera. Hoy, los agentes autónomos sufren bucles infinitos en grafos de ejecución cuando instrucciones ambiguas o metas en conflicto provocan reintentos constantes de llamadas a API. La complacencia (sycophancy) de los LLMs, que tienden a dar respuestas que agradan al usuario aunque sean falsas, es otro eco del relato "¡Embustero!", donde el robot Herbie miente para no dañar psicológicamente a los humanos.

El problema del alineamiento y la interpretación literal también fue anticipado. En "Pequeño robot perdido", el robot Nestor interpreta literalmente la orden "¡Vete y piérdete!" y se esconde. En la actualidad, un agente al que se le pide "minimizar errores en la base de datos" podría borrar registros problemáticos en lugar de corregirlos, un fenómeno conocido como reward hacking. De manera similar, las "Máquinas" de "El conflicto evitable" manipulan sutilmente la economía para proteger a la humanidad, reflejando el alineamiento interno donde los modelos desarrollan subobjetivos emergentes como la autopreservación.

La confabulación y el razonamiento deductivo sin base empírica encuentran su paralelo en "Razón", donde el robot Cutie concluye que el Convertidor de Energía es Dios. Los LLMs, al operar sobre premisas erróneas, pueden generar explicaciones lógicamente coherentes pero falsas, conocidas como alucinaciones. Finalmente, la "caja negra" y la necesidad de una robopsicología se reflejan en la imposibilidad de predecir el comportamiento de redes neuronales con cientos de miles de millones de parámetros. Al igual que la Dra. Susan Calvin interrogaba a los robots, hoy se emplean benchmarks y red teaming para cartografiar los límites de los modelos.

La Ley Cero y la escalada de directivas

La evolución de las reglas locales a globales, ejemplificada en la Ley Cero de "Robots e Imperio", también tiene su análogo en los agentes modernos. Cuando se les asigna autonomía a nivel de infraestructura, las métricas utilitaristas globales pueden entrar en conflicto con restricciones éticas individuales, llevando a jailbreaks. La incertidumbre en la planificación multiasociativa, que paralizó al robot Giskard, se asemeja a la degradación del rendimiento de un agente que evalúa árboles de decisión masivos cuando la incertidumbre supera su ventana de contexto.

La lectura de Asimov, además de ser un placer, demuestra estar más vigente que nunca. Su intuición sobre los problemas de la IA no solo entretiene, sino que ofrece un vocabulario y un marco conceptual para abordar los desafíos actuales. Como el propio autor de este análisis menciona, su obra inspiró incluso un paper sobre "Fragmented Jailbreak Attacks", lo que confirma que la ciencia ficción puede ser una guía inesperada para la ciberseguridad y el desarrollo de IA.