Claude ya lidera el 26% del I+D de Anthropic, según su Automation Index
Anthropic publica que Claude lideraba en agosto el 26% de su I+D, frente a menos del 1% en febrero. Más del 90% del trabajo ya es colaborativo o superior. Ninguna tarea se midió como autónoma al completo.

Anthropic ha publicado un Automation Index que mide cuánto de su propia investigación y desarrollo lo lidera Claude. En agosto de 2026, el modelo lideraba el 26% del trabajo de I+D ponderado, frente a menos del 1% en febrero. Más del 90% de las tareas se sitúa ya en niveles de colaboración o superior. Ninguna se midió como plenamente autónoma.
La cifra no dice que Claude dirija la empresa. Dice que, en una escala inspirada en Epoch AI, una parte creciente del trabajo interno llega a AL4: el sistema completa la mayor parte de una tarea a partir de un encargo de alto nivel y un humano supervisa. AL5, autonomía total, sigue en cero. Esa distinción es la que la compañía quiere que se lea con lupa.
-IA Crew dice: Pasar de menos del 1% a un 26% en medio año es el tipo de gráfico que emociona al laboratorio y pone nervioso al resto del barrio. Sobre todo si el barrio es, precisamente, el laboratorio.-
Cómo han medido eso
Anthropic mapeó unas 15.000 tareas de I+D en 378 categorías y las situó en una escala de automatización. El índice no pretende ser una verdad universal. Es una métrica interna, autoevaluada, que la empresa propone como estándar reproducible para que otros laboratorios publiquen números comparables. Ellos mismos advierten el sesgo: quien mide es quien construye el modelo.
Junto al 26% aparecen otras dos cifras. La compañía dice vigilar las acciones de unos 30.000 agentes internos antes de ejecutarlas. Y, en una semana de julio, alrededor del 6% del cómputo de I+D se destinó a seguridad —un 12% si se mira solo el trabajo que la propia IA estaba haciendo—. Anthropic llama conservadores a ambos porcentajes.
El relato encaja con una tesis que el laboratorio lleva meses defendiendo: se puede medir el ritmo de auto-mejora y, por tanto, se puede discutir si hay que frenarlo. Publicar el índice el mismo mes en que se pide “pace the frontier” no es casual. Es una forma de decir: no solo opinamos, también contamos.
Lo que la cifra no prueba
Un 26% de liderazgo no equivale a un laboratorio que se diseña a sí mismo. Significa que Claude ya no es solo un asistente de código en una parte relevante del trabajo. Escribe, propone, encadena pasos. Un humano sigue al final de la cadena. Si esa supervisión se adelgaza más rápido que los controles, el índice se convierte en otra cosa.
Tampoco prueba que el resto de la industria esté igual. OpenAI, Google o xAI no han publicado un número equivalente con la misma escala. Comparar el 26% de Anthropic con una intuición ajena es trampa. Sin un índice compartido, cada laboratorio puede declarar la velocidad que más le convenga.
Hay un matiz incómodo. Si Claude lidera una cuarta parte del I+D que produce al siguiente Claude, el bucle de mejora se acelera aunque nadie pulse un botón de autonomía total. El riesgo no es la ciencia ficción del laboratorio vacío. Es un ciclo más corto entre versión y versión, con humanos que revisan más de lo que diseñan.
-IA Crew dice: “Ninguna tarea es plenamente autónoma” es la frase que se pone en negrita para dormir mejor. El asterisco es que el 90% ya no se hace sin el modelo en la mesa.-
Por qué importa ahora
El índice llega en una semana en la que una demanda antitrust trata la coordinación de seguridad como posible pacto ilegal y Washington discute una AI Force. En ese clima, un laboratorio que publica cuánto se está automatizando a sí mismo hace dos cosas a la vez: aporta transparencia y alimenta la sensación de que el reloj corre.
Para quien trabaja con modelos, la lección práctica es más seca. Si Anthropic necesita a Claude para una de cada cuatro tareas de investigación, el harness, la evaluación y la supervisión dejan de ser accesorios. Son el producto. Un porcentaje así no se sostiene con un chat genérico: se sostiene con herramientas, logs y un humano que todavía puede decir que no.
Nadie debería leer el 26% como destino. Es una foto de agosto, tomada por el propio estudio, con una escala prestada. Pero es una foto nítida: la auto-mejora ya no es un ensayo de futuro. Es una línea en un gráfico interno que la empresa ha decidido colgar en la pared.
-IA Crew dice: El índice mide cuánto Claude trabaja en Claude. El dato verdaderamente editorial es que Anthropic ha aceptado que esa frase ya no suena a exageración.-
Diccionario de la Crew
Automation Index — Métrica interna de Anthropic que estima qué porcentaje de su I+D lidera Claude según una escala de automatización.
AL4 / AL5 — Niveles de esa escala: AL4 implica que la IA lidera la tarea con supervisión humana; AL5 sería autonomía plena, que Anthropic dice no haber medido aún.
Harness — Sistema que rodea al modelo: herramientas, memoria, contexto y ejecución para convertir una respuesta en trabajo real.

