El Frontier Red Team de Anthropic mide a GLM-5.3, open-weight de Z.ai, en 50 de 410 exploits frente a 56 de Claude Mythos Preview. Técnicas simples evaden sus salvaguardas entre el 64% y el 100%. CAISI lo situó a unos cuatro meses del frente de EE.UU.
Un preprint presenta OPEN-1B, con datos, código, checkpoints y herramientas para auditar pasos de su entrenamiento. Aún falta validación independiente.
GitHub migró el runtime de Copilot de TypeScript a Rust con ayuda intensiva de sus propios agentes. El caso explica tanto el potencial como la revisión necesaria.
En agentes, el harness es el andamiaje que conecta al modelo con herramientas, contexto y bucles de ejecución. Explicamos qué es, para qué sirve y por qué cada vez pesa tanto como el propio LLM.
OpenAI publicará informes sobre comportamientos preocupantes de sus modelos. El primer paquete trae seis casos, pero no permite medir cuán frecuentes son.
Anthropic une Claude Chat y Cowork en una sola conversación: la promesa es que el asistente decida cuándo basta responder y cuándo debe ponerse a trabajar.