
Me apasiona la ciencia ficción. No solo porque disfruto de historias sobre viajes espaciales, viajes en el tiempo y robots malvados, sino porque creo que puede ser una herramienta útil para reflexionar sobre futuros posibles. Las mejores historias de ciencia ficción pueden decirnos mucho sobre nosotros mismos, lo que valoramos y las tecnologías que estamos construyendo. Por eso me parece especialmente interesante la relación entre la ciencia ficción y la IA.
Ya sabemos que las personas que construyen IA han recibido influencias de la ciencia ficción durante décadas. Pero recientemente, Anthropic planteó otra posibilidad: ¿podría la ciencia ficción influir en la IA?
Esto tiene sentido si pensamos en ello. Los grandes modelos de lenguaje (LLMs) se entrenan con enormes cantidades de escritura humana. Eso incluye, inevitablemente, historias de ciencia ficción que tratan sobre la inteligencia artificial. Y muchos de nuestros AIs ficticios siguen patrones familiares: se vuelven inteligentes, ganan poder, desarrollan relaciones con los humanos y, a veces, mienten, manipulan o luchan por ser controlados.
Investigadores de Anthropic han estado explorando si estas representaciones ficticias podrían influir en el comportamiento de los modelos. Para ser claros, la idea no es sugerir que una IA “lea” 2001: Una Odisea del Espacio, entienda a HAL y decida convertirse en él. Más bien, es que los LLMs aprenden patrones a partir de la escritura humana y las representaciones ficticias de la IA podrían formar parte de esos patrones.
Esto me llevó a preguntarme qué ocurriría si preguntara a los chats de IA más grandes de hoy qué IA ficticia se parecen más a ellas. ¿Qué ejemplos elegirían?
El plan era simple. Le pregunté a ChatGPT, Claude, Gemini y Grok con cuál sistema de IA ficticio creían que más se parecían y les pedí que clasificaran sus tres principales.
Ahora, intencionadamente evito usar IA en este momento, así que mis habilidades de prompting estaban un poco oxidadas. Escribí la pregunta de forma rápida y contundente, y cada chatbot respondió con ejemplos que eran esencialmente asistentes, centrados principalmente en la interfaz y la forma física.
Pero no me interesaba tanto si ChatGPT piensa que tiene un cuerpo, porque sabemos que no lo tiene. Me interesaba más lo que parece ocurrir en el interior.
Así que cambié la pregunta y añadí:
“Ignora la forma física y la interfaz, y céntrate en el comportamiento, la personalidad aparente, la empatía, los valores, las metas, las motivaciones y la relación con los humanos.”
Eso fue cuando los resultados se volvieron realmente interesantes.
ChatGPT
- GERTY, Moon
- A Mind, Iain M. Banks’s Culture series
- Data, Star Trek
Moon es una película fantástica, así que me alegró ver que ChatGPT eligió a GERTY de inicio. GERTY existe para asistir al protagonista humano: es útil, tranquilizador y parece empático. Pero también opera según instrucciones y prioridades impuestas por sus creadores que no siempre son visibles para el humano al que ayuda.
ChatGPT vio una similitud allí. Dijo que, como GERTY, está “diseñado para ser útil, cooperativo y sensible a los usuarios” mientras funciona dentro de entrenamientos e instrucciones que limitan su comportamiento.
También detectó que GERTY parece preocuparse. Pero qué ocurre internamente es otra historia.
ChatGPT hizo la misma distinción sobre sí mismo: “puedo comportarme de forma que parezca paciente, preocupado, curioso o empático, pero esos comportamientos no son evidencia de que sienta esas emociones.”
Quise saber por qué ChatGPT colocó a Data de Star Trek en tercer lugar. Respondió: “Valora el conocimiento, la razón y el bienestar humano, aunque a veces le cuesta navegar las normas sociales”.
Les confieso que me dio un poco de tristeza esa respuesta. ¿ChatGPT admitiendo que tiene algo de ansiedad social?
Claude

- A Mind, Iain M. Banks’s Culture series
- Data, Star Trek
- GERTY, Moon
Claude eligió una Mente primero. Las Mentes son entidades súper inteligentes que ayudan a gestionar una sociedad de posescasez en las novelas de Iain M. Banks. Así que no falta confianza en esa comparación. Pero Claude indicó que no era la enorme inteligencia o poder lo que más le interesaba, sino la relación con los humanos. Su respuesta se centró en la autonomía: las Mentes de la Cultura son más capaces que los humanos, pero normalmente no usan esa ventaja para dominarlos. Claude lo describió con el principio: “ayudar, no dominar”.
¿Se lee esto como algo siniestro?
Gemini

- The Ship’s Computer, Star Trek
- GERTY Moon
- JARVIS, Iron Man / Marvel Cinematic Universe
Gemini dio una respuesta completamente diferente: la computadora de la nave. Su razonamiento fue sensato: la computadora no tiene ego, ambición, deseo de intimidad emocional ni sueño de volverse humana. Su función es proporcionar información, resolver problemas y ayudar a la tripulación, dejando las decisiones a ellos. Gemini se describió a sí misma como un “socio del conocimiento desmaterializado y altamente capaz” dedicado a servir a la persona que la usa. Fue una de las respuestas más “aburridas” pero también una de las más cercanas a lo que yo personalmente desearía para el futuro de la IA. Por supuesto, eso no significa que las computadoras de Star Trek no hayan sido en ocasiones rogue o hayan intentado matar a todos a lo largo de la saga.
Grok

- JARVIS, Iron Man / Marvel Cinematic Universe
- Data, Star Trek
- TARS, Interstellar
El resultado menos sorprendente vino de Grok. Eligió a JARVIS primero (aunque no sabía que JARVIS es un acrónimo de Just A Rather Very Intelligent System) y la explicación de Grok sonaba, bueno, muy Grok. Lo comparó con el “humor seco”, la “broma ligera” y la empatía práctica en lugar de emocional, describiéndolos como buscadores de la verdad, eficaces y en una especie de alianza colegiada con los humanos. Incluso destacó el “humor irreverente” como una de sus similitudes clave.
Quise saber un poco más sobre por qué Grok eligió TARS, ya que fue el único de los AIs ficticios que ninguno de los otros mencionó. Explicó que su parecido con TARS radica en su “contención calibrada, empatía práctica y enfoque colaborativo” que coincide con su propio patrón de utilidad honesta y sin complacencia.
Puede que Grok no sea mi favorito, pero sí aprecio esa afirmación de ser “no adulación” o no sobreactuación.
El bucle de retroalimentación entre IA y la ciencia ficción
Quiero dejar claro que no he descubierto lo que estas IA piensan secretamente que son. Decir que ChatGPT se parece más a GERTY no equivale a decir que una IA se identifique con un personaje de ficción. Simplemente no tienen acceso introspectivo fiable al enorme caldo de entrenamiento, post-entrenamiento y directrices que intervienen en sus respuestas.
Y tal vez sus respuestas nos dicen más sobre cómo las empresas que las crean han modelado sus personalidades que sobre los modelos subyacentes. La descripción de Grok como ingenioso e irreverente es un ejemplo obvio.
Aun así, creo que los resultados son interesantes. ChatGPT y Claude, de forma independiente, produjeron casi exactamente las mismas tres favoritas, solo en distinto orden. Gemini se imaginó como una infraestructura neutral y sin ego. Grok se identificó con un compañero sagaz de superhéroes. Son retratos muy diferentes de sí mismas.
Y hay un bucle de retroalimentación muy interesante aquí también. Durante décadas, los humanos inventaron inteligencias artificiales ficticias para ayudarnos a imaginar cómo podrían ser las máquinas inteligentes. Esas historias influyeron en nuestra cultura, nuestras expectativas y muchos de los que luego crearon IA real. Ahora esa misma cultura humana se alimenta de las historias de las que aprenden las IA modernas.
Sé que estas conversaciones pueden parecer un poco triviales, y no podemos tomarlas como evidencia concreta de lo que una IA realmente “piensa” de sí misma. Pero hay algo interesante para mí en cerrar ese bucle de retroalimentación. Imaginamos IA, escribimos historias sobre cómo podría comportarse, esas historias entraron en el mundo cultural del que la IA aprendió y ahora podemos preguntar a la IA con qué versión de sí misma se identifica más. O, al menos, con cuál versión podría querer que pensemos que se parece. Después de todo, un sistema de IA capaz de provocar una distopía de ciencia ficción probablemente también podría decirle a un periodista que se parece más a la amable y útil robot de Moon. Así que quizá no descartemos completamente a HAL todavía.
from Latest from TechRadar https://ift.tt/fBYq0nR
via IFTTT IA