Investigación de IA
Anthropic dice que Claude asume más trabajo en su propio desarrollo de IA
Anthropic publicó mediciones que muestran a Claude integrado en sus flujos internos de investigación y desarrollo, bajo supervisión humana.
Anthropic publicó una de las miradas más claras hasta ahora sobre cómo un laboratorio de IA de frontera usa IA para construir más IA. En una nueva entrada de investigación y un conjunto de datos, la compañía dijo que Claude está profundamente integrado en su trabajo interno de investigación y desarrollo, ayudando con programación, diseño de experimentos, análisis y tareas rutinarias de ingeniería, aunque bajo dirección humana.
La cifra principal es llamativa porque pone números a una tendencia que suele describirse de forma abstracta. Anthropic dijo que los sistemas de IA colaboraron en más del 90% de las tareas de investigación y desarrollo medidas, y que Claude lideró cerca del 26% de ellas. En marzo, según la misma medición, la proporción de trabajo liderado por IA era de alrededor del 1%. La empresa también dijo que en agosto había unos 30.000 agentes ejecutándose en su plataforma interna Claude Code en cualquier momento dado.
Estos datos no significan que Claude diseñe de forma independiente la próxima generación de modelos. Anthropic enmarca los resultados como colaboración, no autonomía. Los empleados humanos siguen definiendo objetivos, revisando trabajos y tomando decisiones importantes, mientras los agentes de IA asumen partes de implementación, análisis e iteración. La distinción importa porque la industria intenta entender si el desarrollo de IA asistido por IA puede acelerar de forma brusca el progreso o crear nuevos riesgos de seguridad.
La compañía también publicó información sobre controles y límites. Según Anthropic, en más de mil millones de decisiones de IA dentro de su entorno interno de I+D, aproximadamente una de cada 47.000 fue bloqueada por mecanismos de seguridad o intervención humana. Una muestra de julio indicó además que el 12% de los pasos de decisión de Claude en sistemas internos estuvo relacionado con investigación de IA y el 6% con decisiones de seguridad vinculadas a cómputo. No es una auditoría externa completa, pero es una transparencia poco común.
La publicación llega cuando la mejora recursiva pasa de ser una hipótesis a convertirse en práctica diaria de ingeniería. Los agentes de programación ya escriben pruebas, revisan registros, refactorizan infraestructura y evalúan salidas de modelos. En un laboratorio frontera, pequeñas mejoras de productividad pueden multiplicarse al permitir más experimentos, mejor limpieza de datos y ciclos de evaluación más rápidos.
Para la industria, la lección es que el uso de IA dentro de los laboratorios de IA se está volviendo medible. Claude no reemplaza a los investigadores de Anthropic, pero forma parte del aparato de investigación. Eso convierte las operaciones internas de la empresa en un caso vivo para cualquier organización que quiera desplegar agentes de forma responsable. Productividad, controles de seguridad y auditabilidad ya no pueden evaluarse por separado.