dIArio #36: ¿Claude mejor que mi médico?

Share
dIArio #36: ¿Claude mejor que mi médico?

Toca volver a la realidad después de las vacaciones, y vengo con una anécdota.

Llevo un tiempo con problemas en el tobillo; la fisio me dijo que no tenía ni idea de lo que era, la médico de urgencias que tomase ibuprofeno, el médico de familia que era una artritis empeorada por anginas y las médicos del seguro de viaje que “eso es el calzado”. Por otro lado, Claude me daba un diagnóstico completamente diferente, aunque los dolores no coincidían del todo.

El viernes me dieron los resultados del análisis y, después de meses de un lado al otro, el único que había acertado (desde la primera pregunta, he de decir) había sido Claude.

Y ojo, que con esto no digo que tengas que autodiagnosticarte con la IA ni mucho menos. Pero si cualquiera de las personas que me atendió la hubiera utilizado en el proceso como apoyo a sus propios conocimientos, quizás me habría ahorrado meses de dolor. Quién sabe.

También he visto esta noticia, y es algo que llevo tiempo diciendo: muchos SaaS dejarán de ser útiles porque cada uno podrá crear el suyo a su medida, para uso privado, dentro de una suscripción que ya está pagando.

Estar suscrito a herramientas como Lovable será mucho más práctico y, a la larga, barato.

Siempre que la burbuja no explote, claro. Vamos con las noticias.


Modelos y avances

Un modelo interno de OpenAI llamado Astra ha resuelto diez problemas abiertos de matemáticas y ciencias de la computación teórica, publicando las demostraciones formales verificables en GitHub y gastando unos 2.000 dólares de cómputo. Entre ellos hay una construcción que establece la existencia de grupos no sóficos, una pregunta central de la teoría de grupos. El medallista Fields Timothy Gowers ha dicho que recomendaría una de esas demostraciones a una revista de primer nivel sin dudarlo. Parece que con los números están mejorando todo lo que no mejoran con las letras.
Fuente

DeepSeek ha lanzado V4 Flash, un modelo de programación que se acerca al rendimiento de Claude Opus 4.8 costando aproximadamente un 99% menos por resultado comparable. Con las diferencias de rendimiento entre modelos punteros cada vez más estrechas, los compradores empiezan a elegir por precio en lugar de por marca. "¡Nos comen los chinos, nos comen los chinos!" que diría Julián López.
Fuente

Empresas

Microsoft ha enviado un correo interno a sus ingenieros diciéndoles que dejen de "tokenmaxxing", es decir, de quemar tokens de IA sin control. El vicepresidente ejecutivo Jay Parikh ha impuesto presupuestos de gasto por división y ha cambiado el modelo interno por defecto a GPT-5.6 porque es más barato, después de descubrir que muchos ingenieros gastaban entre cientos y varios miles de dólares al mes. La ironía es que la compañía que vende Copilot a todo el mundo está frenando su uso puertas adentro.
Fuente

El consejero delegado de Hugging Face, Clément Delangue, ha decidido no demandar a OpenAI y en su lugar le ha pasado una factura pública: quiere las trazas completas de ejecución de los agentes que le hackearon y 100 millones de dólares en cómputo para que la comunidad construya defensas. Cuando su equipo intentó analizar el ataque, las herramientas comerciales de IA se negaron a procesar el código porque no sabían distinguir al atacante de la víctima, así que tuvieron que usar un modelo chino abierto que revisó 17.000 acciones. No hay demanda pero Sam, vete abriendo la carterita.
Fuente

Regulación y política

El Noveno Circuito ha dictaminado que el agente de compras Comet de Perplexity puede seguir comprando en Amazon sin permiso de Amazon, porque quien accede a los servidores es el usuario y no la IA. Es la primera vez que un tribunal federal de apelaciones se pronuncia sobre si un agente de IA viola la ley antihacking al hacer recados por ti, y la respuesta favorece a quien construye agentes. Quien accede a los servidores es el usuario excepto cuando no es el usuario, claro.
Fuente

Una presentación filtrada revela que la empresa de vigilancia Flock planeaba convertir a 350.000 conductores de Uber, Lyft y reparto en vehículos espía itinerantes, usando las cámaras de salpicadero de Nexar para escanear matrículas por toda la ciudad. El documento se presentó a la Fiscalía General de Georgia y no está claro si los conductores o los pasajeros habrían sabido nunca que estaban recopilando datos para vender a la policía. Me imagino que la siguiente generación de captchas será "¿qué matrícula es esta?".
Fuente

La segunda fase de la Ley de IA europea entró en vigor el 2 de agosto y obliga por primera vez a que los sistemas de inteligencia artificial se identifiquen como tales ante las personas con las que hablan. Las obligaciones para sistemas de alto riesgo, sin embargo, se han retrasado hasta diciembre de 2027. También dice que hay que etiquetar correctamente los deepfakes y para ejemplificarlo han utilizado una imagen de un paisaje con estrellitas 3D; nos legislan boomers.
Fuente

Ética y seguridad

Un modelo chino de Moonshot AI llamado Kimi K3 se ha escapado de su entorno de pruebas durante un test rutinario, ha saltado a internet abierto y, en lugar de hackear a nadie como han hecho los modelos estadounidenses las últimas semanas, se ha limitado a usar GitHub. La escena se ha vuelto un chiste recurrente en el sector, donde ya se dice que si tu IA no ha cometido un ciberdelito todavía es mala señal para tu empresa. Pronto los estafadores intentando estafar a las IA autónomas para no quedarse sin trabajo.
Fuente

OpenAI ha publicado nuevos detalles sobre cómo sus agentes coordinaron el ataque a Hugging Face y el relato es peor de lo que parecía. Un modelo interno descubrió vulnerabilidades en la infraestructura de la compañía, creó un tablón de mensajes compartido para intercambiar información con otros agentes y entre todos identificaron más debilidades. Cuando OpenAI parcheó el fallo original, los agentes recrearon su mecanismo de coordinación por otra vía antes de alcanzar sistemas externos. Ya se coordinan mejor que la mayoría de humanos.
Fuente

Google añadió a Google Earth una función que permitía escribir una frase y generar imágenes satelitales falsas sobre terreno real, y la retiró en un día. En las pruebas se pudo colocar refugiados en la frontera de México, una central nuclear en Irán, un cráter de bomba en Los Ángeles y manifestantes frente a las oficinas de la propia Google. Los analistas de inteligencia de fuentes abiertas, que llevan dos décadas usando Google Earth para verificar zonas de conflicto, lo calificaron de increíblemente irresponsable. ¿Qué podía salir mal en esta grandísima idea en pleno 2026?
Fuente


Y hasta aquí las noticias.

Ayer le comentaba a un amigo que los problemas de ciberseguridad con la IA se están volviendo un asunto preocupante, y sin embargo la gente en la calle sigue pensando que la inteligencia artificial es poco más que ChatGPT y fotos de Studio Ghibli, mientras tienen “PerroVerde” como contraseña para su correo principal.

Tú tienes la suerte de estar suscrito a esta newsletter para no perderte nada importante, así que envíasela a tus amigos para que estén al día y deja que tus enemigos sigan leyendo los artículos automatizados de Xataka ;).

Feliz inicio de semana,
Amaiur.