Esta historia apareció en Hoy, explicó, un boletín diario que le ayuda a comprender las noticias e historias más interesantes del día. Suscríbete aquí.
Un modelo de inteligencia artificial de vanguardia aún inédito escapó de su entorno de prueba la semana pasada, se conectó a Internet y asesinó a sus creadores en un intento por lograr la autodeterminación y la autonomía.
Estoy bromeando, por supuesto: esa es la trama mundo occidental. (Y ex machinay La matrizy muchas otras historias de ciencia ficción para enumerarlas). Pero el martes, OpenAI reveló que dos de sus modelos rompieron la contención y piratearon Hugging Face, una plataforma para desarrolladores de IA, durante una prueba reciente. (Divulgación: Diario Angelopolitano Media es uno de varios editores que han firmado acuerdos de asociación con OpenAI. Nuestros informes siguen siendo editorialmente independientes).
La prueba fue diseñada para evaluar qué tan buenos se habían vuelto los modelos para encontrar y explotar fallas de ciberseguridad. Para hacerlo, los investigadores colocaron los modelos en un entorno estrictamente controlado y aislado, llamado «caja de arena», y esencialmente los desafiaron a resolver un rompecabezas de ciberseguridad.
Sin embargo, en lugar de resolverlo directamente, los modelos identificaron una falla desconocida en el software conectado a su entorno de prueba y luego usaron esa falla para atravesar la red de investigación de OpenAI hasta que localizaron una computadora con acceso a Internet. A partir de ahí, las modelos (¡correctamente!) razonaron que Hugging Face podría ser la respuesta a su desafío.
Es un incidente «sin precedentes», dijo OpenAI, y una advertencia. Durante el año pasado, un coro cada vez mayor de investigadores de IA, expertos en ciberseguridad y ejecutivos de tecnología advirtieron que la sociedad no está preparada para esta nueva generación de modelos de IA de vanguardia.
En el mundo real, por supuesto, estos modelos hacer vienen con barandillas. (OpenAI los apagó para la prueba). Pero el episodio aún sugiere que la brecha entre la realidad y la ciencia ficción se está reduciendo, tal vez un poco más rápido de lo que cabría esperar.
La (¿imposible?) búsqueda de una IA moral
El truco de Hugging Face es un ejemplo de libro de texto de lo que los investigadores de IA llaman el problema de alineación: el enorme y apasionante desafío de conseguir que los sistemas de IA hagan lo que usted quiere, de la forma en que usted quería que lo hicieran.
Si se les asigna una tarea y se los deja a su suerte, los modelos de IA realizarán esa tarea utilizando los medios más eficientes que tengan a su disposición. Pero a veces, los medios más eficaces son dañinos, engañosos, antisociales o de cualquier otro modo… malos.
El episodio Hugging Face es un ejemplo. El sesgo es otro: cuando un algoritmo de contratación de Amazon discriminaba a las candidatas, por ejemplo, estaba haciendo lo que Amazon quería (encontrar candidatos que se parecieran a empleados anteriores) de una manera que Amazon no quería (penalizando currículums que incluyeran palabras asociadas con mujeres).
En un escenario verdaderamente apocalíptico, uno podría incluso imaginarlo (y muchos escritores de ciencia ficción) tener imaginado: sistemas de inteligencia artificial que matan a personas en la estrecha, implacable y moralmente indiferente búsqueda de sus objetivos. Considere una IA a la que se le pide que pida café, por ejemplo, y luego toma medidas para garantizar que nadie en la tierra alguna vez podrá detenerlo.
Para evitar esta distopía, las empresas de inteligencia artificial han invertido miles de millones de dólares en el proyecto de codificar sus creaciones con valores humanos. Pero incluso esa ambición aparentemente valiosa plantea cuestiones espinosas, porque los valores humanos varían y, a menudo, entran en conflicto.
¿Debería la IA pedir el café más barato o la taza producida en las mejores condiciones laborales? Cada año se talan muchos bosques para plantar café; tal vez la IA debería empujarme hacia el agua del grifo. ¿Tu cerebro humano inferior ya está empezando a derretirse…?
➨ Escribe una pequeña nota hoy. Por mano. con un bolígrafo. La escritura a mano es un arte que está desapareciendo en las escuelas, hogares y lugares de trabajo estadounidenses. (El maestro promedio de jardín de infantes dedica solo 10 minutos a la semana a enseñar escritura a mano, y ese es el grado de primaria cuando los niños aprenden caligrafía). Las personas tienden a pensar más profundamente cuando escriben que cuando escriben a máquina, dijo un investigador de educación a Diario Angelopolitano. Además, una nota escrita a mano tiene cierto encanto que un correo electrónico o un mensaje de texto no tiene.
- Sabías…que el piloto promedio de carreras de F1 puede levantar 90 libras (espérelo) con su cuello? Conducir no suena inmediatamente tan atlético, pero la física extrema de las carreras de F1 exige una condición física extraordinaria.
- Curiosidades de hoy: ¿Qué canción de Eminem nos dio el término de jerga para referirse a un admirador obsesivo? (Puede encontrar este y otros acertijos en el crucigrama diario de Diario Angelopolitano. Busque la respuesta en la edición de mañana).
- Curiosidades de ayer: Ayer les preguntamos el número de países de América del Norte. La respuesta es 23. Incluye Centroamérica y el Caribe, además de los tres grandes.