El Frontier Red Team de Anthropic mide a GLM-5.3, open-weight de Z.ai, en 50 de 410 exploits frente a 56 de Claude Mythos Preview. Técnicas simples evaden sus salvaguardas entre el 64% y el 100%. CAISI lo situó a unos cuatro meses del frente de EE.UU.
Alibaba publicó el 20 de septiembre un generador y editor de imagen 7B con transparencia nativa y hasta 10 referencias. Los pesos ya no van con Apache 2.0: rige la Qwen Research License Agreement.
Tras una jornada de conversaciones en Nueva York, Scott Bessent presentó un «U.S.-China A.I. dialogue» para notificarse incidentes de IA de nivel de seguridad nacional. Pekín no ha formalizado su respuesta.
Circula que esta semana podrían salir Gemini 4, Claude Opus 5.5, Grok 4.7 y GPT-6 Sol/Luna. Ninguno está confirmado como producto público. Repasamos qué espera la comunidad de cada uno y qué fiabilidad real tiene una salida en los próximos días.
Jev, el modelo System One de TypeSafe, no chatea: recibe un estado, responde Choice, Score o Noul y devuelve una decisión con probabilidad. Qué es, qué no es, qué cambia en los agentes y por qué hay tanto hype.
Un term sheet del 21 de septiembre muestra que SoftBank lanza 10.000 millones de dólares y 1.000 millones de euros en notas senior para financiar el pago a OpenAI del 1 de octubre y cancelar un puente de 10.000 millones.
Anthropic publica que Claude lideraba en agosto el 26% de su I+D, frente a menos del 1% en febrero. Más del 90% del trabajo ya es colaborativo o superior. Ninguna tarea se midió como autónoma al completo.