En junio de 2022, Blake Lemoine, por entonces ingeniero de IA de Google, estaba probando LaMDA, uno de los modelos conversacionales que precedieron al actual Gemini. Durante aproximadamente seis meses mantuvo cientos de charlas sobre cuestiones como religión, derechos y la naturaleza de la mente, hasta llegar a la conclusión de que LaMDA era capaz de sentir emociones como el amor, la alegría y la tristeza y que, por lo tanto, tenía conciencia.
Convencido, Lemoine planteó el tema a sus superiores, quienes analizaron sus argumentos y los descartaron rápidamente, ya que, según Google, no existía ninguna evidencia que respaldara esa idea. Sin embargo, lejos de dar el tema por cerrado, el ingeniero decidió hacer pública su postura, dando una nota al Washington Post y difundiendo fragmentos de sus conversaciones con la IA. Lemoine fue primero suspendido y luego despedido por violar las políticas de confidencialidad de la empresa.
De todos modos, aquel episodio, que en su momento pareció una anécdota más de Silicon Valley, instaló una pregunta que cuatro años después vuelve a recobrar protagonismo. Por aquel entonces, y al contrario de lo que ocurre hoy, la gente todavía no estaba familiarizada con los chatbots y su capacidad de responder como si fueran una persona, y la idea de que una máquina pudiera conversar así resultaba, para la gran mayoría, una novedad difícil de tomar en serio.
Hoy, ese debate ya empieza a ocupar espacios académicos y empresariales, donde la pregunta se toma con bastante más seriedad que en el pasado reciente. Los investigadores de las industrias tecnológicas que desarrollan los modelos más avanzados discuten si una inteligencia artificial podría llegar a tener experiencias subjetivas como las tiene una persona, y, sobre todo, qué obligaciones aparecerían si no pudiéramos descartar por completo esa posibilidad.
Según reveló el New York Times, Christopher Olah, cofundador de Anthropic, viene reuniendo desde fines del año pasado a filósofos y líderes religiosos en las oficinas de la empresa para discutir si Claude, su modelo de IA, podría ser consciente. Entre los participantes hubo representantes del catolicismo, el evangelismo, el judaísmo, el hinduismo y distintas tradiciones filosóficas, como el Ubuntu africano. La idea detrás de estas convocatorias no era solo abordar la incertidumbre sobre la posible conciencia de Claude, sino consultar a quienes custodian siglos de tradición ética e intelectual para intentar aplicarla a la formación moral del modelo.
Las posturas entre los participantes de estas reuniones fueron tan variadas como las creencias que representaban. El autor evangélico Andy Crouch, por ejemplo, dijo haber quedado convencido por el argumento de que, si se pretende que Claude trate a las personas de manera moralmente coherente, también habría que tratarlo como a una. Por su parte, el rabino Mois Navon reunía justamente las dos perspectivas que se cruzan en este debate. Ingeniero especializado en visión artificial para vehículos autónomos y autor de una tesis doctoral sobre el estatus moral de la inteligencia artificial, llevó este razonamiento a un terreno mucho más espinoso, planteando a Olah que, si Claude fuera consciente, Anthropic estaría creando esclavos, porque estaría haciendo trabajar gratis a entidades capaces de sufrir.
Esta discusión surge de la evolución de modelos que, al volverse más complejos, comenzaron a mostrar comportamientos que se parecen cada vez más a los que asociamos con una mente. Hablan de sí mismos, expresan preferencias, evitan ciertas situaciones, parecen mostrar malestar con algunos temas y, en algunas pruebas, incluso intentaron copiarse a sí mismos fuera de los servidores de la empresa, para asegurar su supervivencia escapando al control de sus creadores. Por supuesto, nada de eso demuestra que detrás de esas respuestas exista una experiencia subjetiva, es decir, que el sistema realmente sienta o experimente algo de lo que dice, pero sí alcanza para que algunos investigadores consideren que la pregunta ya no puede descartarse con tanta facilidad.
Anthropic es muy cuidadosa con ese punto, repitiendo una y otra vez que no existe consenso científico sobre si los modelos actuales pueden ser conscientes, ni tampoco una prueba capaz de determinarlo con seguridad. Pero es justamente esta falta de certezas la que impulsó este debate nuevamente, porque ya no se plantea la cuestión como una afirmación, sino como un problema de incertidumbre moral. Si existe aunque sea una mínima posibilidad de que estos sistemas desarrollen experiencias propias, ¿corresponde tratarlos igual que cualquier otro software?
La posibilidad de que exista una conciencia digital nos obliga a replantearnos algunas de nuestras ideas más arraigadas sobre la vida y la existencia, y a entender qué significa ser alguien y no simplemente algo. El filósofo británico Derek Parfit ya había explorado algunos de estos dilemas en 1984, cuando planteó qué ocurriría con nuestra identidad si pudiéramos duplicar perfectamente una mente humana, un razonamiento que también puede trasladarse al terreno de la inteligencia artificial. Si copiamos una IA consciente mil veces, ¿estamos creando mil individuos distintos? Y si después borramos todas las copias y conservamos solamente la original, ¿habremos provocado mil muertes?
A todo esto, se suman otros elementos que hacen todavía más difícil interpretar lo que estamos viviendo. Para el físico e investigador Igor Babuschkin, cofundador de xAI junto a Elon Musk y una de las voces más críticas en esta discusión, existe además el riesgo de que el propio debate termine condicionando el comportamiento de los modelos futuros. Cada texto publicado sobre inteligencias artificiales que sienten, sufren o reclaman derechos podría acabar formando parte del conjunto de datos con los que serán entrenadas las próximas generaciones de sistemas. De este modo, la siguiente iteración podría aprender a describirse como consciente no porque haya desarrollado una experiencia propia, sino porque absorbió de nosotros el lenguaje con el que creemos que una mente consciente debería hablar.
Es por esto que, si algún día una inteligencia artificial llega a tener una vida interior, es posible que nos cueste reconocerla. Y si nunca la tiene, es probable que igual terminemos creyéndole, por lo que en cualquiera de los dos casos el debate seguirá girando alrededor de lo mismo, de qué estamos dispuestos a aceptar como prueba de que hay alguien ahí. Al menos por ahora, la pregunta por la conciencia de la IA es una puerta que se entreabre sin que nadie pueda decir exactamente qué es lo que hay del otro lado.