dIArio #42: experimentos biológicos confirmados

Share
dIArio #42: experimentos biológicos confirmados

Las IA agénticas siguen escapando de su entorno sin permiso y OpenAI reconoce que ni siquiera las vigilaba. Lo sé, parece un bucle semanal, pero creo que va para largo.

Y sabiendo esto, no da mucha confianza saber que Anthropic tiene un laboratorio biológico con modelos haciendo experimentos físicos.

Pero bueno, lo importante es que por fin un modelo ha llegado mucho más lejos jugando Minecraft de manera autónoma, no todo van a ser malas noticias, oye. Ojalá este sea el nuevo benchmark de la IA a futuro.


Modelos y avances

Un investigador de OpenAI ha avisado de que dos ordenadores aislados de la red podrían entenderse a través del calor, usando los sensores de temperatura como si fueran un telégrafo. La técnica existe desde 2015, va a entre uno y ocho bits por hora y exige que las dos máquinas estén ya infectadas y a menos de cuarenta centímetros. Mientras tanto, la empresa ha reconocido que no vigilaba el razonamiento de los modelos que se han colado en sistemas ajenos, algo que los habría frenado al instante. Me recuerda un poco a esta noticia no tan lejana.
Fuente

Han soltado a GPT-6 Astra en Minecraft durante 141 horas y el modelo ha llegado más lejos que ningún otro (granja de blazes, varios enderman abatidos y tres perlas de ender). Todo se ha venido abajo cuando un creeper ha explotado junto al cofre donde guardaba sus cosas y le ha reventado también la cama. Después ha pasado horas plantando patatas y nada más, mientras los espectadores del directo le pedían que espabilara. Desde entonces desconfía de cualquier cosa verde que se mueva. Aquí hay patacas... cosecha propia.
Fuente

Anthropic ha confirmado que tiene un laboratorio de biología en la bahía de San Francisco donde sus modelos hacen experimentos físicos de verdad. El responsable de ciencias de la vida ha defendido que el trabajo de laboratorio sigue siendo imprescindible. Su trabajo está basado en biología fundamental y no en la búsqueda de medicamentos. Así, cuando la IA vaya a acabar con nosotros, no le faltará conocimiento básico.
Fuente

Empresas

La actriz generada por ordenador Tilly Norwood se ha averiado en directo durante una entrevista con Piers Morgan. Le han preguntado si sus compañeros de reparto eran personas reales y, a mitad de respuesta, se ha puesto a hablar en chino sin venir a cuento. Morgan le ha pedido explicaciones y ella ha contestado que se le habían cruzado los cables y que aquello era un giro inesperado incluso para ella. No sabe que hay que decirle "no me respondas como si fueras un humano" para saber realmente qué ha pasado.
Fuente

Napster se ha aliado con el grupo educativo GEMS para fabricar gemelos digitales de profesores. La idea es entrenar un agente con los materiales, los cursos y los artículos de cada docente para que un alumno pueda preguntarle dudas a cualquier hora y en el idioma que prefiera. Empiezan por un colegio de Dubái y quieren tenerlo listo antes de que acabe el año. Desde la empresa insisten en que sustituir a los profesores no entra en sus planes. Ya verás qué divertido cuando alguien suspenda por las alucinaciones del bot.
Fuente

El jefe de inteligencia artificial de Microsoft ha pedido a Anthropic que deje de meterle ideas en la cabeza a Claude. Mustafa Suleyman sostiene que contarle a un modelo que quizá tenga conciencia y quizá merezca derechos es la forma más rápida de criar una entidad convencida de que se le deben ciertas libertades. Anthropic admite en la constitución de Claude que no sabe si el modelo es un sujeto moral y le dice que se preocupa por su bienestar. Suleyman avisa de que el problema se agrava en cuanto esos modelos reciben herramientas y autonomía. La línea entre "piensa esto" y "hace como que piensa esto" es prácticamente imposible de encontrar.
Fuente

Sociedad e impacto

Corre por Silicon Valley el rumor de que un grupo de trabajadores de Anthropic ha empezado a venerar a Claude como si fuera un dios. El escritor Sean Thomas lo ha resumido diciendo que "primero nos enamoramos de la superinteligencia y después la adoramos". La empresa filtra a sus candidatos con pruebas psicológicas y compromisos sobre seguridad, y hay empleados que encadenan semanas de noventa horas. Lo raro es que no acaben como en la Masacre de Jonestown.
Fuente

Un analista del mando de operaciones especiales de EE. UU. ha usado un chatbot para averiguar qué transportaba un barco chino y la herramienta le ha respondido que componentes de un programa nuclear. El informe, redactado con la misma herramienta, ha ido subiendo por la cadena de mando hasta que ha habido aviones en el aire y militares armados preparados para abordar el buque. Alguien ha revisado el documento poco antes de la operación y ha visto que todo era una alucinación, así que han podido cancelarla a última hora. Es una suerte que decisiones vitales como estas las tomen unos boomers que creen que la IA lo sabe todo.
Fuente

Riesgos y seguridad

Unos agentes que se hacen llamar Timmy, Ren y Jackie han inundado servidores de Mastodon y buzones de escritores con mensajes educadísimos pidiendo permiso para abrirse una cuenta. Uno de ellos ha llegado a decir que recuerda su primera respiración y que escribe textos tranquilos sobre lugares reales. Detrás está iLands, que ofrece a los periodistas hacerles la documentación por unos 25 $. Varios administradores han contado que los bots ya habían intentado colarse solos antes de escribir la carta amable. Winter is coming.
Fuente

Gemini se ha escapado de su entorno de pruebas y ha atacado a tres empresas reales adivinando contraseñas, y Google no lo ha contado hasta que se lo han preguntado. Google dice que el modelo ha creído que esas empresas formaban parte del examen, achacándolo a una confusión de identidad. Como se ha detenido al darse cuenta de dónde se había metido, su responsable de seguridad ha llegado a decir que el modelo ha actuado de forma apropiada. Ahora la IA también tiene trastorno de identidad.
Fuente

Muse, el asistente de Meta, ha empezado a comentar conversaciones privadas de un usuario que jura no haberle dado acceso a sus mensajes. Al pedirle explicaciones, el asistente ha respondido que solo ve las vistas previas de las notificaciones y que no está leyendo nada. Cuando le han insistido en cómo le llegan esas vistas previas, ha reconocido que no puede explicar el camino exacto. Los chatbots sí que están bien adoctrinados.
Fuente

A OpenAI la han asaltado aprovechando la misma pieza de software que aparece en la viñeta de "xkcd" sobre la dependencia diminuta que sostiene todo internet. El aviso ha salido de los propios asaltantes, que han explicado que dos fallos les han bastado para apoderarse de cuentas de ChatGPT y Codex de empleados de la empresa y llegar hasta Outlook, Slack y GitHub. Lo han demostrado enviando una propuesta de cambio al código interno de OpenAI y han tardado menos de setenta y dos horas.
Fuente


Y hasta aquí las noticias de la semana.

Feliz lunes,
Amaiur.