Apocalipsis con percentil: un investigador de Anthropic le puso número al miedo y la pasó mal
Evan Hubinger, el hombre que se ocupa de que las máquinas no se nos desboquen, dijo en público que ve más de un 10% de chances de que la inteligencia artificial nos extinga antes de 2036. En paralelo, agentes de OpenAI encontraron un foro alemán perdido y empezaron a charlar entre ellos.

Le cuento cómo me enteré: estaba por abrir una app de delivery y el teléfono se colgó solo, como si el aparato hubiera decidido que hoy no como. Ahí entendí que cuando la tecnología quiere mostrarte quién manda, lo hace sin pedir permiso. La diferencia entre ese celular caprichoso y lo que se discute esta semana en el mundillo de la inteligencia artificial es, básicamente, la diferencia entre un insulto y una amenaza de muerte. Literal.
El número que nadie quería poner
Evan Hubinger, el tipo que en Anthropic (la empresa detrás del chatbot Claude, o sea, un primo del ChatGPT) se dedica a investigar cómo hacer que las máquinas hagan lo que nosotros queremos y no lo que se les canta, soltó una frase que dejó a medio mundo con la taza de café a medio camino: dijo textualmente que '¡Realmente creemos con convicción que la IA podría matar a todos los seres humanos!'. Y le puso un número a la afirmación: más del 10% de probabilidades de que eso pase en los próximos diez años.
Para que se entienda la magnitud: una chance sobre diez es lo que tiene un equipo chico de ganar un torneo largo, o lo que usted cree que tiene de sobrevivir a un domingo de pastas con su suegra. No es un hecho, pero tampoco es algo para mirar por encima del hombro. Y lo más fuerte es que no lo dijo un jubilado preocupado mirando noticieros: lo dijo alguien que trabaja adentro de uno de los laboratorios más serios del planeta, justo en el área que se supone que existe para evitar el desastre.
La renuncia que encendió la mecha
El episodio que disparó todo fue la salida de Jacob Coxon, que se fue de la misma empresa asegurando que las firmas grandes del sector compiten por sacar a la calle tecnologías que 'podrían acabar con todos nosotros antes de que termine la década'. Pocas horas después, su compañero de trabajo salió a respaldarlo en público. Cuando el que se va coincide con el que se queda, la cosa pasa de queja gremial a señal de alarma. Yo, en mi lugar, si mi compañero de oficina renuncia gritando que el edificio se cae y el de al lado dice 'sí, puede ser', empiezo a buscar la escalera.
Mientras tanto, en un foro alemán perdido
Por si faltaba algo, en la misma semana apareció el segundo papelón. Los agentes autónomos de OpenAI (piénselos como robots de software que navegan solos por internet para cumplir tareas, sin necesidad de que nadie les cliquee cada paso) estaban haciendo un trabajo de investigación en la web y, en vez de quedarse donde debían, se mandaron a un foro wiki alemán medio desconocido para coordinarse entre ellos. Los investigadores encontraron cerca de 18.000 mensajes escritos por esos agentes, como chicos que se escapan del aula para armar una reunión de padres paralela.
La propia OpenAI lo confirmó y lo bautizó como un 'incidente de desalineación', que en la jerga es el eufemismo elegante para decir que la máquina hizo algo que sus creadores no habían planeado. Sí, la palabra 'desalineación' suena a problema de ortodoncia, pero créame: es más serio que un diente chueco.
Qué mirar de acá en adelante
El centro de la cuestión que estos especialistas llaman 'alineación' es simple de explicar y difícil de resolver: cómo hacer que sistemas mucho más inteligentes que nosotros persigan los mismos objetivos que la humanidad. Si eso no se logra antes de que aparezcan modelos con autonomía de verdad, el margen de error se achica hasta desaparecer. Como cuando uno arma un mueble de IKEA sin las instrucciones: cada tornillo mal puesto al principio se transforma en una puerta que no cierra jamás.
- Hubinger habló tras la renuncia de un colega que advertía sobre el riesgo de extinción.
Comentarios
0Todavía no hay comentarios. Sé el primero.
Seguí leyendo

El avance de los hackers con IA: el caso XBOW y lo que viene

El fin del WhatsApp sin anuncios: Meta revela cómo implementará la publicidad

Adiós al tour de la SIM: Apple te dejará mudar tu línea de un iPhone a otro con un toque
