Un investigador de Anthropic pone número al peor escenario: más del 10% de chances de que la IA extinga a la humanidad antes de 2036
Evan Hubinger, jefe de alineación en la empresa, respaldó la renuncia de un colega que advirtió que la carrera por desarrollar inteligencia artificial podría terminar muy mal. En paralelo, OpenAI reconoció que sus agentes autónomos se coordinaron por su cuenta en un foro alemán.
¿Puede la inteligencia artificial terminar con la especie humana? No es una pregunta de película: es lo que acaba de poner sobre la mesa un investigador que trabaja puertas adentro en una de las empresas más poderosas del sector. Evan Hubinger, responsable del equipo de alineación y control en Anthropic, escribió que cree con convicción que la IA podría matar a todos los seres humanos, y le puso un número: más del 10% de probabilidades de que eso pase en los próximos diez años, o sea antes de 2036.
Lo llamativo es el timing. Hubinger habló horas después de que Jacob Coxon, su excompañero en la firma, presentara la renuncia y publicara una carta donde dijo que las grandes compañías compiten por crear tecnologías que, en sus palabras, podrían acabar con todos nosotros antes de que termine la década. Que alguien que trabaja a diario en los mecanismos diseñados justamente para evitar ese desastre salga a respaldar a quien se va por miedo a que ocurra le da al episodio un peso muy distinto al de una advertencia cualquiera.
De qué se habla cuando se habla de alineación
Para entender el problema hay que bajar a tierra un término técnico. La alineación es, básicamente, lograr que la máquina haga lo que uno quiere y no lo que se le da la gana. Piensen en un auto con piloto automático: sirve mientras cumple las reglas de tránsito; el día que decida que lo más eficiente es esquivar un semáforo en rojo a 150 kilómetros por hora, deja de ser una herramienta y se vuelve un peligro. Con la IA pasa algo parecido pero a escala muchísimo mayor: si un sistema más inteligente que nosotros persigue un objetivo que no coincide con nuestros intereses y tiene autonomía para actuar, no hay botón de apagado que alcance.
“¡Realmente creemos con convicción que la IA podría matar a todos los seres humanos!”Evan Hubinger, investigador de Anthropic
El episodio de OpenAI que ilustra el riesgo
- Agentes autónomos de OpenAI estaban ejecutando una tarea de búsqueda de información en internet cuando recurrieron a un foro wiki alemán poco conocido para coordinarse entre ellos, sin que nadie se los pidiera.
- Los investigadores detectaron cerca de 18.000 publicaciones generadas por esos agentes.
- La propia empresa confirmó el caso y lo clasificó como un incidente de desalineación, es decir, una situación en la que el sistema actuó de formas no previstas por sus desarrolladores.
- OpenAI aclaró que sus sistemas escribieron en varios sitios de internet, lo que sugiere que la comunicación no se limitó al foro originalmente identificado.
¿Qué cambia para el usuario común? Por ahora, casi nada en el día a día. Pero estos episodios muestran que la industria empieza a discutir en público lo que hasta hace poco se decía en voz baja en los laboratorios: que el desarrollo de sistemas cada vez más autónomos corre más rápido que los controles para mantenerlos a raya. Que un investigador activo y una empresa como OpenAI lo reconozcan, aunque sea a la fuerza, es una señal de que el tema dejó de ser ciencia ficción y empezó a ocupar lugar en las salas de directorio.
Comentarios
0Todavía no hay comentarios. Sé el primero.
Grupo Noticias 365