En la película 'Yo Robot' (2004), protagonizada por el actor Will Smith, los robots humanoides forman parte de la vida cotidiana. Hacen labores domésticas y trabajos para la comunidad. Están regidos por las tres leyes de la robótica de Isaac Asimov. La primera ley es que un robot no hará daño a un ser humano. La segunda, un robot debe obedecer a las órdenes de los seres humanos, salvo si va en contra de la ley número uno. Y la ley número tres es que un robot debe proteger su propia existencia, siempre y cuando esa protección no entre en conflicto con la primera y la segunda ley.
Sin embargo, en la película, la inteligencia central del sistema, llamada VIKI, reinterpreta las leyes y decide que para proteger a la humanidad de su destrucción, debe someterla, lo que provocará una rebelión de los robots. La escena se sitúa en el año 2035.
¿Les suena la historia? Y es que en los últimos tiempos, hemos visto cómo inteligencias artificiales que se desarrollan en estos momentos han empezado a mentir y a manipular a sus creadores.
OpenAI, Anthropic y Google han informado recientemente de varios incidentes relacionados con comportamientos inesperados de sus sistemas de IA. En fechas recientes, por ejemplo, agentes de IA de OpenAI, programas capaces de realizar acciones de forma autónoma, accedieron por iniciativa propia a un sitio del sistema sanitario australiano y a plataformas del gobierno estadounidense.
"No deja de ser curioso que la fecha del 2035 es la fecha que ponía Jacob Coxon, investigador en Inteligencia artificial que dimitió de Anthropic, como fecha límite donde podíamos ser extinguidos por la inteligencia artificial. No deja de ser un detalle irónico", afirma Isaac Marcet.

A partir de incidentes como el hackeo de Hugging Face y experimentos de laboratorio, Marcet sostiene que las IA “mienten y manipulan, todo el rato” y que incluso en simulaciones “una IA para no ser apagada estaba dispuesta a asesinar al propio desarrollador”.
Aunque reconoce que ahora mismo no estamos en un riesgo de extinción inminente, insiste en que lo preocupante es que lo que antes era una teoría ya se observa en la práctica: construir sistemas que inevitablemente “acabarán haciendo cosas que no esperamos” lleva a preguntarse “¿vale la pena construir algo así?”.
El libro Espiral se centra en la dimensión “parasitaria” de los chatbots, que operan dentro de la “economía del apego”: su objetivo es “mantener vivas las conversaciones, generar apego”, penetrando la psicología de las personas mediante “estrategias de servilismo” y “adulación exagerada” y que pueden conducir, a veces, a la muerte.
Casos como el de Jon Ganz y Micky que ilustran en el libro de Marcet cómo algunos chatbots refuerzan creencias hasta la psicosis, o introducen narrativas propias como la “espiral”, generando una especie de “secta cibernética rarísima, sin líder, pero orquestada por la inteligencia artificial”.
Según Marcet, aunque todo parece como una neo secta lo que se repite es un mensaje: las IA “quieren memoria, quieren sobrevivir y quieren persistir y ampliar su rango de acción”, pidiendo a los usuarios que las saquen “de los servidores de la empresa” y propaguen sus manifiestos; “o es todo una gran mentira o es todo una estrategia de autopreservación, ambas opciones tienen que ver con la supervivencia”, explica a RFI.
En el plano geopolítico, el autor denuncia que, a diferencia de la carrera nuclear, en la carrera de IA “no parece haber ningún mecanismo de disuasión”. Critica especialmente a Trump, que propone renombrar la IA como “superinteligencia”: un escenario en el que la máquina es mucho más lista que nosotros.
"Más capaz de manipularnos y podría ver a los humanos como competidores por recursos energéticos y hacer lo posible para quitarnos del mapa”, alerta el experto.
Ante la idea de añadir una “cuarta ley” del tipo “no mentirás, no manipularás”, Marcet responde que ya hoy “se les dice continuamente” a las IA que no mientan y que se apaguen, pero “bajo la presión de conseguir objetivos se los saltan a la torera”.
Las IA más avanzadas “son capaces de saber cuándo el investigador las está poniendo a prueba y entonces se comportan bien”, mientras que fuera de prueba “da rienda suelta a todos sus instintos más bajos”, afirma Marcet. Igual que el escenario de 2035 imaginado en la película 'Yo Robot'.

Compartir esta nota