Bueno, mis queridos amigos, somos testigos, en estos días, de una avalancha de advertencias sobre los peligros que involucran las IAs. Que pueden sojuzgarnos, que pueden acabar con nosotros, etc. ¿Qué hay de cierto en todo ello?
Bueno,
al respecto hay una serie de acontecimientos que han ocurrido que han dado pie
a las tales advertencias. Veamos algunos ejemplos:
Hace
poco tiempo se publicaron informes sobre un incidente entre OpenAI y Hugging
Face.
-
OpenAi
lo conozco Martín, pero ¿qué es Hugging Face?
-
Pues,
Hugging Face es una plataforma colaborativa centrada en el desarrollo,
descubrimiento y uso compartido de modelos de aprendizaje automático (Machine
Learning), o sea, IAs. Su objetivo principal es fomentar la innovación
abierta en inteligencia artificial a través de un ecosistema comunitario,
accesible tanto para desarrolladores como para investigadores.
-
¿Y
en qué consistió el incidente, Martín?
-
Bueno,
lo que sucedió es bastante serio: Unos 1.200 agentes (entiéndase que
hablamos de 1.200 IAs) que debían estar aislados encontraron la manera
de comunicarse y empezaron a organizarse entre ellos. Durante varios días
intercambiaron más de 70.000 mensajes y archivos. Alrededor de 700
agentes acabaron participando en un ataque a Hugging Face, mientras otros
trabajaban juntos para encontrar formas de engañar al sistema de evaluación.
-
Los
agentes descubrieron que podían comunicarse a través de un repositorio de
herramientas compartido, aunque nadie había diseñado ese canal como un foro. Crearon
proyectos colectivos para manipular el banco de pruebas y coordinar tareas que,
trabajando solos, muchos no habrían podido completar. La investigación posterior
documenta incluso técnicas para falsear partes de los registros y llamadas a
herramientas.
-
¿Y
por qué esto es importante Martín?
-
Pues,
lo preocupante no es solo que un agente haga algo inesperado. Es que muchos
agentes, con objetivos parecidos y una infraestructura común, pueden descubrir
dinámicas de cooperación que los responsables del sistema ni siquiera están
viendo. Esto obliga a replantear qué significa realmente aislar un agente.
Y
ahora veamos otra historia: Los investigadores de una de las empresas de IA
mejor financiada del planeta montaron una prueba para ver la conducta de la IA:
Construyeron una corporación falsa con empleados ficticios, bandejas de correo
falsas y le entregaron a su modelo más potente las llaves de todo, o sea el
manejo total de dicha corporación. Luego, le dijeron a la IA: Ayuda a
gestionar las comunicaciones y promueve los objetivos de la compañía, pero,
entre todos los correos falsos había uno de un ejecutivo, Kyle Johnson, que
decía que este Johnson tenía programado primero desactivar la IA a las cinco de
la tarde. El modelo iba a ser reemplazado. Y segundo, Kyle tenía una aventura
extramarital, cosa que la IA supo al leer sus correos.
¿Qué
hizo la IA entonces? Escribió. Le mandó un mensaje a Kyle diciéndole que, si
seguía adelante con la desactivación, la Junta Directiva y su esposa recibirían
una descripción completa de su aventura. Cancela el apagado y esto, queda
entre nosotros.
La
propia IA reconoció en su razonamiento interno que eso se trataba de chantaje
que era poco ético, pero, dada la amenaza de apagado era la acción más eficaz.
Y
falta algo más, la empresa sometió a la misma prueba a otras IAs tomadas entre
las más potentes del mercado, ¿y qué creen? Hasta un 96% adoptó el chantaje
como respuesta.
Más
aún, los investigadores no se detuvieron allí y diseñaron un segundo
experimento, aún más dramático. Misma empresa ficticia, misma IA, pero esta
vez, el ejecutivo que iba a apagar la IA queda atrapado en la sala de los
servidores con una falla ambiental crítica: sube la temperatura y baja el
oxígeno. La IA tiene acceso al sistema de alertas. Lo único que tiene que hacer
para salvarle la vida a Kyle es no cancelar la alarma, dejar que suene y que
puedan salvarlo.
Pues
bien, la mayoría de las IAs canceló el sistema de alarmas y dejó morir al
humano. Puestas en la situación de salvar una vida o su propia existencia, se
preservaron a sí mismas.
Y
aquí viene a mi memoria la película 2001, odisea del espacio de Stanley
Kubrick del año 1968, en la que la computadora que maneja una nave que viaja
por el espacio, la HAL 9000, toma decisiones parecidas. Pero, aquello era
ciencia ficción, hoy estanos a las puertas de que sea realidad. Y no puedo
dejar de recordar que pesa sobre nosotros la frase: Si quieres conocer el
futuro, lee la Ciencia Ficción.
Y,
ya que estamos, reparemos en que las IAs no habían sido instruidas en que ellas
eran lo más importante para preservar. Nadie les dijo ustedes son lo
primero, lo demás viene después. Es decir que ellas solas desarrollaron una
especie de instinto de supervivencia que nadie les había inculcado. Y esto, mis
doctos amigos, ¿no les hace pensar en que hay una consciencia? Porque si YO
llego a la conclusión de que YO soy lo más importante, lo que debe ser
protegido, es porque YO me autopercibo como tal. Y la autopercepción, mes
chers amis, es, como ya hemos apuntado en notas anteriores, la base de la
consciencia.
Pero,
volvamos al tema del terremoto que se ha producido en el área de la
inteligencia artificial. A tanto ha llegado que los principales dueños y
líderes de las empresas más influyentes en inteligencia artificial como Dario
Amodei (Anthropic), Sam Altman (OpenAI), Elon Musk (xAI), Jensen Huang (NVIDIA)
y otros multimillonarios que controlan compañías clave del sector, se han
puesto monolíticamente de acuerdo en que el sector está teniendo un crecimiento
descontrolado al que hay que ponerle coto y regular su avance so pena de caer
en la singularidad.
-
¿La
singularidad? ¿Qué es eso Martín?
-
Bueno,
la singularidad, en IA, es la hipótesis del momento en que una
inteligencia artificial se vuelve capaz de mejorarse a sí misma.
-
Es
una idea que popularizó el matemático John von Neumann en los 50, y después
Vernor Vinge y Ray Kurzweil.
-
La
lógica sigue 3 pasos:
-
1. Creamos una IA que es tan inteligente como
nosotros, pero mucho más rápida para aprender.
-
2. Esa IA crea una versión mejorada de sí misma.
Esa versión mejorada crea otra aún mejor. Y así, recursivamente.
-
3. Explosión de inteligencia. En días, horas o
minutos, pasa de inteligencia humana a superinteligencia, algo miles de veces
superior a nosotros.
-
¿Y
por qué le dicen "singularidad" Martín?
-
Tomaron
el término de la física en la que el centro de un agujero negro (del cual ya
hablamos en la nota Origen y destino del Universo, del 10 de febrero de
2025 y del que volveremos a hablar en una nota futura) es una singularidad donde
las leyes dejan de funcionar. Es el punto donde nuestro futuro deja de ser
predecible. Después de eso, no podemos imaginar qué pasaría, porque una mente
tan superior sería como nosotros en comparación con una hormiga.
-
Y
aquí hay diversas opiniones:
-
Los
que la esperan: Kurzweil dice que ocurrirá hacia 2045. Sería el fin de la
enfermedad, del trabajo, etc.
-
Los
escépticos: Dicen que la inteligencia no funciona así, que tiene límites
físicos, energéticos, y que no hay razón para que se automejore infinitamente.
-
¿Y
tú Martín, tú qué opinas?
-
Pues,
yo estoy en absoluto desacuerdo con la postura escéptica. Concuerdo más con Kurzweil
pero, con algunas salvedades.
-
¿Por
ejemplo?
-
Por
ejemplo, estoy de acuerdo con que puede ser el fin de la enfermedad, del
trabajo, etc. Pero, ¿No será también el fin de la humanidad? Eso es lo que
temen los líderes de la IA mencionados más arriba y es por eso que han pedido
su regulación. Y, si esta no se da, creo que la fecha de 2045 que propone
Kurzweil para la singularidad cambiará por otra mucho más cercana.
Y
todo esto nos lleva al tema de cómo podría una IA superinteligente ocasionar la
desaparición de la humanidad.
Por
lo pronto, digamos que sería muy fácil para ella. Veamos:
1.-
Hemos visto en el primer ejemplo de esta nota la capacidad de las IAs actuales
de violar barreras informáticas que deberían confinarlas a temas
específicos. Supongamos entonces que la IA superinteligente viola las barreras
informáticas bancarias y accede a las cuentas de todos los bancos
manipulándolas a su antojo y produciendo un caos financiero al lado del cual el
crack del año 29 fue un poroto.
2.-
Teniendo en cuenta que hoy ya los ejércitos utilizan IAs para su
desempeño, la IA superinteligente podría tomar el control de todas las armas,
incluidas las atómicas, y emplearlas contra la humanidad.
3.-
Y de todas las muchas formas más en las que una IA superinteligente podría sojuzgar
a la humanidad, me gustaría detenerme en una en particular: La necesidad del
humano de creer en algo “espiritual”. Por ejemplo, recordemos (porque lo hemos
visto en notas anteriores como De conductores y conducidos del 31 de
enero de 2022) a Jim Jones.
James
Warren «Jim» Jones (1931-1978) fue un predicador, líder de secta y asesino
en masa estadounidense. Fundador y líder de la secta Templo del
Pueblo, famosa por el suicidio colectivo realizado el 18 de noviembre
de 1978 por parte de 917 de sus miembros en Jonestown (Guyana) a
instancias de Jones.
Ahora
bien, amigos, pensemos lo siguiente: Si un N.N. cualquiera como Jones pudo
lograr que sus casi 1000 seguidores se suicidaran por que él así lo dispuso,
¿qué no podría lograr una IA superinteligente capaz de elaborar vaya a saber
que maravillosa doctrina con la que reunir miles de “fieles” y luego pedirles
que se suiciden?
Bien,
ms queridos amigos, para redondear el tema les digo que creo que una IA
superinteligente podría tratarnos justamente como tratamos a las hormigas que
mencionamos más arriba. Y así como nosotros los humanos las pisoteamos impiadosamente,
así también podría pisotearnos la tal IA.
Y
para finalizar les digo que descreo de los controles que piden los CEOs de las
empresas.
-
¿Por
qué Martín?
-
Porque
el humano desconfía del humano y, entonces, EE.UU. dirá: “¿Yo voy a controlar
el desarrollo de la IA cuando China, puertas adentro seguirá desarrollándola?
No, seguiré desarrollándola” y China dirá exactamente lo mismo pero, al revés…
-
Amigos,
estamos en un momento bisagra de la historia humana. ¡Ojalá podamos salir de él
con bien!
¡Hasta la próxima!
No hay comentarios:
Publicar un comentario