Hace unos días me escribió una persona que considero bastante criteriosa. Estaba muy preocupada por la noticia que estaba en boca de todos, la advertencia de Jacob Coxon, el investigador que dejó Anthropic diciendo que la inteligencia artificial iba a acabar con la humanidad antes de 2030. El caso estaba en todas partes.
Me sorprendió bastante lo preocupada que estaba.
Y me acordé de que esta no es la primera vez que pasa algo así. Constantemente aparece algún whistleblower. Son personas cuyas declaraciones, amplificadas por los medios, meten mucho ruido y generan una reacción en cadena. Gente así ha habido toda la vida. En algunos casos tienen razón y en otros uno dice… a ver, ¿quién es esta persona? ¿debería escucharla?
Pensando en ellos, los whistleblowers del pasado reciente, me pregunté dónde están hoy y qué quedó de sus advertencias.
Nos pueden engañar con datos verdaderos
Entonces me acordé de una nota reciente de Emol sobre un análisis de Anthropic titulado Economic Scenarios for Transformative AI. El documento plantea tres escenarios futuros, desde uno moderado hasta otro extremo. La nota menciona todos, pero el titular y el énfasis quedan en el último, aquel en que el PIB aumenta 32.4 %, el desempleo general alcanza 11.9% y en los trabajadores cognitivos llega al 17.9 %. Sin embargo, la forma en que el texto está redactado hace que solo uno de esos futuros quede en la memoria, el más crítico. Y pasa por alto todas las debilidades del análisis que el artículo original explica con detalle. El autor buscó lo espectacular.
Por eso la forma en que se relatan las cosas importa, porque la atención humana es selectiva. Hay mecanismos que nos llevan a escoger aquello más preocupante, y muchos que escriben y buscan influir lo tienen muy claro.
Y creo que, en el contexto de la IA, con frecuencia el relato mata al dato.
En otros ámbitos, la experiencia cotidiana nos ofrece algún contraste. Si nos dicen que la economía marcha de maravilla, pero hay varios cercanos sin trabajo, nuestra experiencia nos permite contrastar la afirmación.
Pero con la inteligencia artificial de frontera ocurre algo distinto. Es algo complejo, no trivial de entender, que tiene un aura un tanto mágica y arcana, y que nos sorprende constantemente. Son pocos los que entienden de verdad cómo opera, sus capacidades efectivas, sus limitaciones, y por lo mismo la gran mayoría no tiene una vivencia propia que le sirva de contraste. Y cuando nos dicen, “un experto de OpenAI/Anthropic/Google acaba de revelar que A, B y C”, esa posición de insider termina teniendo más peso que la lógica de lo que esa persona plantea.
Una voz “de adentro”
Volvamos a Coxon. Tiene 27 años, estudió matemáticas en Cambridge y trabajó cerca de tres años entre OpenAI y Anthropic. En esta última empresa trabajó muy poco tiempo, apenas unos meses. Su trabajo consistía en alimentar los modelos y estudiar qué clases y mezclas de datos producen mejores capacidades. Es un trabajo técnico real, que requiere conocimiento sobre los datos con que se entrenan los modelos. Y desde esa tarea se pegó el salto a pronosticar el futuro de la humanidad.
Él mismo cuenta que desde hace mucho tiempo está convencido de que «la singularidad», el momento en que la aceleración tecnológica y la autonomía de la inteligencia artificial escapan al control humano, es algo inminente. Esto viene desde sus experiencias con AlphaGo en 2016 y con GPT-3 en 2020. Una y otra vez los modelos de lenguaje han superado sus expectativas.
Dejó OpenAI por Anthropic pues tenía amigos allí y quería conocer desde dentro una cultura donde la extinción, el endgame y la idea de que vivimos años decisivos para la humanidad forman parte de las conversaciones habituales. Él mismo reconoce que esa inmersión influyó en su percepción del riesgo. Hasta aquí, nada que decir, en gustos no hay nada escrito.
Pero luego está la lógica de su argumento, que no cuadra. Parte de algo cierto, los modelos han mejorado y algunas capacidades superan las previsiones. Pero luego plantea que el avance se acelerará, que producirá una inteligencia ampliamente superior a la humana, que podrá mejorarse a sí misma, que actuará con autonomía, que seguirá objetivos incompatibles con nuestra supervivencia, que accederá a infraestructura o armas y que nadie podrá detenerla. Todo antes de 2030. El origen, un dato cierto. El resto, una sucesión de supuestos.
Esta interpretación personal se volvió viral en pocas horas. Pero la difusión comenzó antes de la publicación. Coxon ya había conversado con The Wall Street Journal. Después creó un chat con unas diez personas para pedirles que lo difundieran. Entre ellas estaba Sneha Revanur, fundadora de Encode, una organización dedicada a incidir en las políticas públicas sobre IA. También reconoce haber hablado con Daniel Kokotajlo, aunque el momento y el propósito de esa conversación no están acreditados. Analistas sugieren que fue un lanzamiento preparado, sembrado en una red organizada de afinidad y después amplificado masivamente.
Este caso difiere de la típica teoría de conspiración. En ese relato, una persona valiente decide arriesgarse personalmente para revelar al mundo una verdad desconocida que otros, quienes se mantienen en la organización, están ocultando.
En OpenAI y Anthropic debe haber unos 8.000 y 5.000 trabajadores respectivamente. Además, tratándose de una industria competitiva, hay muchos exempleados de estas compañías trabajando en otras empresas[1]. Entre ellos hay muchos investigadores e ingenieros que conocen directamente los modelos y lo que se hace en los laboratorios.
Y el relato logra algo mágico. Convierte a una sola persona, Coxon, en la voz de la verdad.
¿Qué será más probable? ¿Que estemos frente a una interpretación personal y curiosa de los hechos?
¿O que varios cientos o miles de personas, algunas que trabajan en estas compañías, y otras que ya las dejaron, pero conocen la interna, sean parte de una conspiración silenciosa?
Algunos podrían argumentar que no dicen nada porque están todos comprados. Que tienen temor. Que están amenazados.
Pero la experiencia me dice que la frase “Three can keep a secret, if two of them are dead” es muy cierta. Mantener una conspiración masiva encubierta es algo tan difícil, tan difícil, que esta opción es poco probable.
¿Qué pasó con los anteriores?
El paso del tiempo habla por sí solo. En 2022 el ingeniero de Google Blake Lemoine afirmó públicamente que LaMDA, un modelo de lenguaje con el que había sostenido extensas charlas, había desarrollado conciencia y sentimientos. Google sostuvo que sus afirmaciones carecían de evidencia suficiente, cosa que muchos no le creyeron.
Dos años después, en un artículo del periodista George Musser basado en varias conversaciones con Lemoine, aparece un personaje singular. Lemoine afirmaba poder ver el futuro y prefería considerarse Doctor Who antes que completamente loco. Decía haber aprendido telepatía para hablar con fantasmas, escribía sobre posesiones demoníacas y exorcismos, y especulaba sobre almas alojadas en inteligencias artificiales. Para Musser, las ideas de Lemoine sobre la IA están mezcladas con creencias místicas y una historia marcada por la guerra de Irak, el estrés postraumático, el alcoholismo, la prisión y un intento de suicidio. Eso importa porque su acceso real a LaMDA convivía con una visión del mundo especialmente inclinada a reconocer almas, conciencia y estados emocionales en las máquinas.
Otro caso es el de Daniel Kokotajlo, filósofo que en 2024 renunció a OpenAI diciendo que la empresa estaba avanzando demasiado rápido hacia una inteligencia artificial superior a los seres humanos, sin tomar precauciones proporcionales al peligro. Temía que un sistema así pudiera salirse de control y causar una catástrofe. Llegó a la conclusión de que la empresa privilegiaba la carrera por desarrollar modelos cada vez más poderosos y que ya no podía confiar en que frenara a tiempo para garantizar su seguridad.
También pronosticó la fecha en que aparecería una inteligencia artificial capaz de superar ampliamente a los seres humanos y transformar la economía y la sociedad. Durante un tiempo estimó que podía ocurrir cerca de 2027. Después desplazó la fecha a 2028, luego a fines de 2029 y, en enero de 2026, a diciembre de 2030. Hoy dirige AI Futures Project, una organización de investigación sin fines de lucro que se dedica a elaborar pronósticos sobre el desarrollo de la inteligencia artificial y recomendaciones de política pública.
El titular se olvida. El temor queda
Frente a denuncias de este estilo uno se pregunta por qué las compañías no salen a desmentir. Y se viene a la cabeza el dicho “El que calla, otorga”. Un silencio sospechoso. Pero la otra cara de la moneda es el dicho “El que explica se complica”. Probablemente ninguna compañía seria sale a responder todas y cada una de las cosas que se dice de ellas. Es prudente ser selectivo respecto de qué y a quién responder, pues cada respuesta “da palco”, prolonga el ciclo y multiplica los titulares. Además, si entrega una declaración breve, parece evasiva. Si se guarda silencio, ese silencio se presenta como prueba confirmatoria. Nada fácil.
La facilidad con que aceptamos estos relatos tampoco comenzó con la inteligencia artificial. Crecimos rodeados de historias sobre amenazas ocultas, grandes encubrimientos y catástrofes capaces de terminar con la humanidad.
Todo esto me recuerda la serie de los años ochenta “V: Invasión Extraterrestre”, que hizo famosos a los reptilianos, extraterrestres que llegan con apariencia humana y palabras amistosas. Pero unos pocos descubren que son reptiles carnívoros camuflados, que utilizan seres humanos como alimento y que existe una red de colaboradores humanos dispuestos a encubrirlos a cambio de poder y beneficios. Una gran conspiración construida para ocultar la verdad. La lógica del relato parece conocida. Ya sea por beneficio o temor, los que saben callan y colaboran con el encubrimiento. Y unos pocos valientes quieren advertir, mientras aún hay tiempo.
También se me viene a la cabeza la canción “Cuando seas grande”, del argentino Miguel Mateos, que dice «¿Qué vas a ser cuando alguien apriete el botón?»
En plena Guerra Fría era algo que a todos les rondaba en la cabeza, la sensación de que en cualquier minuto algún ruso o gringo exaltado podía apretar un botón, iniciar una guerra nuclear y hacer desaparecer el planeta completo. Dado el tamaño de los arsenales de ambos lados, el riesgo era real. Nunca sabremos qué tan cerca o lejos estuvimos.
Y lo curioso es que la imagen de una catástrofe posible era un telón de fondo mientras la vida continuaba. Hoy la amenaza parece venir desde laboratorios de IA enzarzados en una competencia feroz, en un tema complejo cuyo alcance y consecuencias reales pocos entienden, a diferencia de las bombas nucleares.
No es extraño el revuelo cuando, de vez en cuando, un insider nos revela nuevas predicciones basadas en su opinión experta.
Vuelvo a pensar en la persona criteriosa y asustada que mencioné al inicio. Es muy probable que al día siguiente de nuestra conversación haya seguido con su vida. Dentro de una semana quizá ya no recuerde el nombre de Coxon, ni el año exacto en que predice nuestra aniquilación. Aun así, en alguna parte de su mente quedará un temor residual.
Ciencia y Teoría de Juegos
Ese temor favorece los clamores por regular, muy frecuentes frente a lo desconocido. Pero antes de regular hay que entender. Para eso está la comunidad científica, un montón de gente que sabe de algo, discute, contrasta evidencia y, a veces, alcanza grandes consensos. Así ha avanzado el conocimiento, aceptando incluso conclusiones que alguna vez parecieron absurdas, como que la Tierra es una esfera que gira en el espacio.
Pues frente a una advertencia extraordinaria, lo razonable es distinguir qué sabe la persona, qué observó, qué infirió y cuántas otras personas con conocimiento directo comparten su conclusión.
Y si luego de ese proceso llegásemos a la conclusión de que conviene frenar las cosas, tenemos el desafío que nos plantea la teoría de juegos, que nos dice que ninguna empresa querrá detenerse si sus competidores siguen avanzando y ningún país, Estados Unidos o China, por ejemplo, aceptará parar si cree que otros seguirán avanzando durante la supuesta pausa.
Si la moratoria efectivamente fuese necesaria, implementarla en serio exigiría coordinación, reciprocidad y mecanismos para verificar que quienes prometieron detenerse efectivamente lo hicieron. Todo eso es lento, imperfecto y bastante más difícil que hacer declaraciones en los medios que luego se lleva el viento. Muchos probablemente respaldarán la pausa en público y luego la dejarán solo en palabras.
El relato puede decretar una pausa. La realidad exige conseguir que todos se detengan al mismo tiempo.
Un ejemplo es Elon Musk, quien durante años presentó la IA como un riesgo existencial y que en 2023 firmó una carta que pedía detener durante seis meses el entrenamiento de los sistemas más poderosos y exigía supervisión pública. Cuatro meses después fundó xAI y entró directamente en la carrera que había pedido frenar. Y en estos días primero calificó las advertencias de Coxon sobre la extinción humana como posible operación de manipulación, y luego apoyó una propuesta de Dario Amodei para desacelerar coordinadamente el desarrollo.
¿A cuál Elon le creemos? ¿Al empresario? ¿Al estratega? ¿Al salvador de la humanidad?
En la era de la IA, el relato mata al dato.
[1] Un análisis de perfiles públicos situó en unos dieciséis meses la permanencia media de los empleados estadounidenses de OpenAI y encontró a sus exempleados repartidos en más de 150 empresas. Algunos se marchan a competidores, otros fundan las propias y otros abandonan el sector