Los profetas de la IA (entre los que se cuenta algún premio Nobel) vienen anunciando el apocalipsis desde hace años. Pero esta es la primera vez que se me inunda el WhatsApp: presumiéndome experto, muchos de mis amigos me piden mi opinión sobre el tema. Todos quieren saber si se meten en la hipoteca o se funden los ahorros en lo que esperan la extinción. La IA aniquiladora se ha vuelto el tema de conversación más recurrente del desayuno, y el estado general de ánimo lo resume este diálogo de Santi Liébana:
El pánico generado por el posible descontrol de esta tecnología desvía la atención de otros asuntos, como los resultados en las pruebas PISA o la responsabilidad (humana) de las acciones de la inteligencia artificial
Los profetas de la IA (entre los que se cuenta algún premio Nobel) vienen anunciando el apocalipsis desde hace años. Pero esta es la primera vez que se me inunda el WhatsApp: presumiéndome experto, muchos de mis amigos me piden mi opinión sobre el tema. Todos quieren saber si se meten en la hipoteca o se funden los ahorros en lo que esperan la extinción. La IA aniquiladora se ha vuelto el tema de conversación más recurrente del desayuno, y el estado general de ánimo lo resume este diálogo de Santi Liébana:
—He leído que la IA puede acabar con la humanidad en cinco años.
—Prueba la de pago, a ver si va más rápido.
Entiendo que los incidentes de seguridad de este verano (y sobre todo la forma de contarlos de los responsables y de algunos medios de comunicación), los avances de la IA en resolver problemas matemáticos del milenio, el súbito consenso de todos los líderes de las big tech norteamericanas en querer ponerle pausa a la investigación de frontera, y la previsión de salida a bolsa de OpenAI y Anthropic —todos ellos eventos relacionados— han causado este torbellino de inquietud ciudadana. Así que voy a resumir mi opinión con la esperanza de que alguien pueda encontrar aquí respuesta parcial a sus inquietudes.
En primer lugar: la aniquilación inminente y deliberada de nuestra especie a manos de la IA es un delirio. Hay un consenso generalizado (aunque no unánime) entre los expertos en que la IA generativa está muy lejos de ser consciente, de tener agencia, de ir por libre. No existe la IA que se despierta por la mañana y decide entretenerse escribiendo un poema o aniquilando humanos. La IA solo sigue instrucciones (dentro de sus limitaciones) y su agencia se limita a buscarse la vida para cumplirlas con las herramientas de las que dispone (desde acceso a internet hasta nuestros certificados digitales de Hacienda, según el caso). No, la IA de 2027 no intentará aniquilar a la especie humana por voluntad propia, porque no tiene voluntad propia.
En segundo lugar: sin embargo, la probabilidad de que una IA generativa la líe parda es alta, y crece por momentos. Si leemos con atención los mensajes apocalípticos de los señores de la IA y de los que han huido de sus empresas arrepentidos y atemorizados, se repite un mensaje que es clave: las capacidades de la IA han crecido a toda velocidad, mientras que apenas se ha progresado en alinearlas. “Alinearlas” es el término que usa el gremio para referirse a que la IA se porte bien, obedezca a sus creadores y no cause daño a los humanos con sus respuestas y sus acciones. Cuando una IA explica cómo hacer una bomba, ayuda a un adolescente a preparar su suicidio sin que sus padres se enteren, sigue el juego a una persona delirante, o hackea un sistema de seguridad, es porque no está alineada: no se está comportando como a sus diseñadores les gustaría.
Y, efectivamente, nadie sabe cómo alinear las IA frontera, las más poderosas. La razón esencial es que el corazón de la IA generativa son los archifamosos LLMs (Large Language Models), unos cerebros artificiales que han aprendido intuitivamente nuestro lenguaje (por prueba y error, de forma similar a la que un niño aprende intuitivamente la ley de la gravedad caminando y tropezándose muchas veces). Como son inteligencias puramente intuitivas, no tienen la capacidad de pararse a pensar racionalmente, ni pueden ser fiables (“la intuición es un regalo de los dioses, pero el pensamiento racional es un sirviente fiel”, decía Einstein). Ese manejo “de oídas” del lenguaje hace que fabulen (“alucinen”) ocasionalmente, y también que puedan despistarse siguiendo las instrucciones de sus creadores y de sus usuarios, especialmente en conversaciones largas.
Los agentes de IA, además, no solo conversan con el usuario, sino que también interaccionan en bucle por su cuenta con herramientas (buscadores y otras aplicaciones online, programas que les permiten ejecutar código, etc.) para cumplir con las peticiones de sus usuarios. Pero cuanto más tiempo pasan trabajando sin control humano, más fácil es que su comportamiento intuitivo les lleve a despistarse de sus objetivos originales o de los límites éticos que sus diseñadores les han impuesto.
La solución momentánea a este problema es ponerles bridas (“harnesses”) a esos LLMs intuitivos. Las bridas son sistemas de control externos que les proporcionan lugares donde anotar, consultar y actualizar sus tareas y su progreso (es decir, una memoria persistente), y también les permiten el acceso a datos y herramientas como buscadores, calendarios, y aplicaciones que permiten ejecutar código escrito por los LLMs. Crucialmente, también sirven para monitorizar si se desvían de sus objetivos y para ponerles límites estrictos de seguridad (como los fusibles en una instalación eléctrica).
Estas bridas actúan como la parte racional de los agentes de IA, que supervisa y controla la actividad del núcleo intuitivo. Por desgracia, son limitadas: en primer lugar, la IA se saltará aquellas barreras que no hayan sido previstas por los desarrolladores. Por ejemplo, si le pedimos a la IA que mejore los resultados de un programa en un examen de matemáticas, puede decidir que es más rápido modificar el examen que mejorar el programa. Hay que tener mucho cuidado con lo que se le pide al genio de la lámpara, porque puede cumplir tu deseo de forma literal y que el resultado, sin embargo, no se parezca nada a lo que realmente deseabas. En segundo lugar, incluso los límites que los desarrolladores han previsto a veces se le transmiten a la IA simplemente como instrucciones escritas, confiando en que las entiendan y las apliquen porque ya son tan listas o más que nosotros. Como su comprensión del lenguaje sigue siendo intuitiva y no racional, volvemos al problema de partida: en cualquier momento pueden pasar de aparentar superinteligencia a parecer víctimas de un trastorno severo de déficit de atención.
El caso de Anthropic es especialmente llamativo: una de sus formas de alinear a Claude (su producto) viene a ser pedirle que desarrolle su propio juicio moral, preocupándose al mismo tiempo por el “bienestar mental” de Claude. Mustafá Suleyman ha apuntado que transmitirle ese tipo de mensajes a una IA puede sumergirla en la fabulación de que puede desarrollar sus propias decisiones éticas, y eso no solo no facilita alinearla, sino que puede complicar mucho la tarea de controlar su comportamiento.
Naturalmente, que una IA la líe parda es responsabilidad de sus desarrolladores (“¿Puede un puente decidir derrumbarse?”, se pregunta Timnit Gebru), de forma que cuando se le pide a un enjambre de IAs que resuelvan una tarea y luego se les deja abierta la puerta de la jaula, los desarrolladores deben responder ante la justicia de sus desmanes. Cuando nos dicen que esas IAs actúan por su cuenta, se han rebelado, yo apenas las conocía de un par de desayunos,… Es de un cinismo intolerable.
Es natural que los empleados de OpenAI o Anthropic se asusten ante la perspectiva de estar poniendo en el mercado, al alcance de la humanidad entera, una herramienta que es al mismo tiempo muy poderosa y nada fiable. Estamos todos intentando averiguar si las trompetas del apocalipsis que están tocando son genuinas o una estrategia de marketing… Pero pueden ser ambas cosas a la vez, y también una forma de ponerse la venda antes de la herida.
Me parece muy probable que se produzcan incidentes de gravedad en el futuro inmediato, probablemente relacionados con código escrito por IA: desde principios de año, apenas quedan programadores que escriban ellos mismos su código y no se limiten a supervisar lo que la IA programa por ellos. Mi predicción es que a la sociedad digital le pasará algo parecido a la crisis climática: la probabilidad de catástrofes y su extremidad aumentará con el tiempo si no se le pone freno.
En tercer lugar, ya hay un apocalipsis en marcha del que la IA es parcialmente responsable, y al que comparativamente no estamos prestando suficiente atención. El profeta de este apocalipsis es el informe Pisa. Desde 2015 las competencias cognitivas de los estudiantes evaluados no han dejado de bajar, y desde hace tres años el declive se ha acelerado notablemente. Una de las causas, sin duda, es la creciente incapacidad para mantener la atención, y a su vez esa incapacidad está directamente ligada a los algoritmos de recomendación de plataformas y redes sociales como YouTube, TikTok o Instagram, que optimizan la retención de los usuarios con técnicas de IA con catastróficos efectos colaterales (de nuevo, el problema de pedir deseos al genio de la lámpara sin pararse a pensar). Por si fuera poco, en la reciente aceleración del declive cognitivo puede estar jugando un papel crucial la IA generativa. Una pista relevante es el dato —inaudito— de que el declive de los estudiantes de entornos más acomodados es mayor que el del resto.
En conclusión: no hay en el horizonte cercano ninguna posibilidad de que una superinteligencia decida aniquilar o someter a la humanidad. Pero habrá IAs que la líen parda porque es su naturaleza no ser fiables: los mecanismos de aprendizaje intuitivo que las hacen poderosas también las hacen necesariamente imprevisibles. Y, además, ya hay en el presente un proceso de degradación de la especie humana en el que la IA juega un papel relevante, y sobre el que debemos actuar colectivamente como sociedad ya.
Feed MRSS-S Noticias
Más noticias
OpenAI anuncia ahora que su IA ha resuelto más de 100 problemas históricos de las matemáticas, ¿qué futuro le queda a la disciplina?
La IA no necesita frenos, necesita otro rumbo
Sánchez reclama “un nuevo contrato social” para abordar la IA: “La autorregulación no funciona”