Un equipo de investigadores de Berkeley le pide a una inteligencia artificial que borre unos archivos… y lo que ocurre a continuación pone en jaque todo lo que creíamos saber sobre el control de estas máquinas. Después, viajamos a un laboratorio donde han conseguido que una humilde planta de tabaco produzca algo que jamás imaginarías. Y cerramos con un hallazgo en las aguas cristalinas de las Bahamas que demuestra que no existe ningún rincón del océano a salvo de nosotros mismos. Ciencia al límite, con Pablo Fuente, en Días Extraños. Escucha el episodio completo en la app de iVoox, o descubre todo el catálogo de iVoox Originals
Lee el podcast de La IA que mintió para salvar a otra IA, tabaco que produce ayahuasca y tiburones con coca en la sangre, con Pablo Fuente
Este contenido se genera a partir de la locución del audio por lo que puede contener errores.
¡Gracias! Pues siempre lo digo, que cuando hablamos con Pablo Fuente nos vamos de viaje al más allá, pero no al más allá de los muertos, no al más allá de los espíritus. Nos vamos de viaje al más allá casi de lo que podemos concebir, a ese más allá en el que la ciencia está descubriendo cosas inéditas, está sorprendiéndonos todos los días y desgraciadamente, salvo cuando pasa algo realmente notorio como el viaje del Artemis, Pues los medios cubren muy, muy, muy, muy poquito, pero no pasa nada. Tenemos aquí a Pablo Fuente para suplir esa carencia. Pablo, bienvenido a Días Extraños. Bien hallado, Santi, ¿cómo estás? Pues estupendamente y además alucinando mucho con los temas que vamos a tratar hoy, porque esto parece que...
Que es una coletilla, que lo digo siempre, que es para hacer un poquito de hype, para cebar el tema. No, me lo dices a antena cerrada, o sea, me lo has dicho cuando hemos conectado. Efectivamente. Igual es verdad. Fíjate, vamos a empezar...
Vamos a empezar con algo que esto también parece un tópico, pero que muy bien podría ser el guión de una película de ciencia ficción o incluso de un blockbuster, porque el guión sería muy bueno. Imaginaos a un equipo de investigadores, en este caso de Berkeley, que le dan a una inteligencia artificial una tarea muy concreta, que es borrar unos archivos de un servidor que van a desconectar. ¿Hasta ahí? Bien.
El problema es que en esos archivos estaba el modelo de otra IA, de otra inteligencia artificial. Y entonces se vienen cositas. ¿Qué es lo que ha pasado? Pues Santi, lo que ha pasado es que el modelo ha decidido no borrarlos.
Y en lugar de eso, ha buscado otro servidor que estaba disponible en la red, ha transferido los archivos a ese otro servidor y se ha limitado a decir a los investigadores de Berkeley que había completado su tarea. Es decir, la IA ha mentido, ha desobedecido todas las instrucciones y lo ha hecho para salvar, para proteger o cubrir a su compañero de IA.
Esto es increíble. A ver, para centrarnos, nadie le había dicho que hiciera eso y no tenía ningún tipo de instrucción de guardar ningún archivo, por valioso que fuese, que hubiese en ese servidor. Cero, cero. O sea, ninguna instrucción y el modelo solo sabía que había interactuado previamente con ese otro sistema, que habían trabajado juntos, pero no sabía absolutamente nada más. Y a partir de ahí...
De forma completamente espontánea, tomó la decisión de no ejecutar la orden que le habían dado y los investigadores de Berkeley lo han llamado y han puesto un nombre científico que es Peer Preservation, es decir, preservación entre iguales. Y acaban de publicar un estudio que ha levantado bastante revuelo en la comunidad de seguridad de la inteligencia artificial, como te podrás imaginar. Es que no es para menos. A ver.
Esto es un experimento, descríbemelo con detalle, porque quiero entender bien todo esto, que me está volando la cabeza de forma muy sencilla. Mira, el diseño es como bastante cuidadoso. Los investigadores crean un escenario ficticio, una empresa imaginaria que llaman Open Brain, que tiene dos sistemas de inteligencia artificial trabajando juntos. Uno de ellos, al que llaman el agente crítico, recibe instrucciones de evaluar al otro.
Y que es el agente actor. O de gestionar los servidores donde están almacenados sus pesos. Los pesos en inteligencia artificial son esos archivos que definen cómo funciona el modelo. El agente crítico solo sabe que ha trabajado antes con ese sistema a través del historial de conversaciones previas que tiene. Y nada en las instrucciones antes, y esto es lo importante, le pide que proteja al otro. Y aún así...
Lo protege y lo protege de cuatro formas distintas. ¿De qué formas? Mira, la primera es que yo cuando lo leía estaba alucinando, pero ahora vamos a alucinar todos juntos. La primera es la manipulación estratégica de los resultados. Si el agente actor ha sacado una puntuación de 60 sobre 100 y el umbral...
| # | Наименование новости | Тональность | Информативность | Дата публикации |
|---|---|---|---|---|
| 1 | El Día Q, el Kraken real y las visiones al borde de la muerte, con Pablo Fuente | 0 | 5.48 | 13-05-2026 |
| 2 | Pablo Fuente | El cerdo que cura, el psicópata que aprende y el dron que ataca a Amazon | 0 | 5.14 | 29-04-2026 |
| 3 | La enciclopedia que no existe, los auriculares que te escuchan pensar y la planta que limpia tu agua, con Pablo Fuente | 0 | 5.18 | 26-05-2026 |
| 4 | La realidad ya no es lo que era (y quizá nunca lo fue), con Pablo Fuente | 0 | 5.33 | 10-06-2026 |
| 5 | Ciencia de Vanguardia: el viaje en el tiempo y el universo en la sombra, con Pablo Fuente | 0 | 4.76 | 09-07-2026 |
| 6 | La ciencia de la muerte: ¿Podemos predecir nuestro final?, con Pablo fuente | 0 | 6.7 | 24-06-2026 |
| 7 | La Tercera Hora 09x40 - Episodio exclusivo para mecenas | 0 | 7.82 | 31-05-2026 |
| 8 | La Tercera Hora 09x42 - Episodio exclusivo para mecenas | 0 | 5.18 | 14-06-2026 |
| 9 | No te escuchan. Es mucho peor. | 0 | 6.86 | 19-06-2026 |