Modelos de IA
Anthropic presenta Claude Fable 5.1 y Mythos 5.1 con acceso restringido
Anthropic presentó Claude Fable 5.1 y Claude Mythos 5.1 para programación, trabajo de conocimiento e investigación científica, con cambios de precio y salvaguardas.
Anthropic presentó el 1 de septiembre Claude Fable 5.1 y Claude Mythos 5.1, describiéndolos como una mejora importante para programación, trabajo de conocimiento, tareas agénticas de larga duración e investigación científica. Las dos versiones comparten el mismo modelo subyacente, pero se distribuyen con distintos niveles de salvaguardas. Fable 5.1 está disponible de forma general, mientras que Mythos 5.1 se limita a programas de acceso confiable, con protecciones diseñadas para trabajos avanzados de ciberseguridad y ciencias de la vida.
El anuncio combina cambios de rendimiento, precio y seguridad. Anthropic dijo que Fable 5.1 costará un 25% menos que Fable 5 en cargas típicas facturadas por token gracias a una reducción en el precio de lecturas de caché. En trabajos muy agénticos, la compañía afirmó que los ahorros pueden llegar con frecuencia a alrededor del 45%. Ese cambio importa porque los modelos de frontera se usan cada vez más en tareas largas que leen repositorios, documentos y salidas de herramientas durante muchas rondas. Reducir el costo de caché puede hacer que una empresa use un modelo de frontera como sistema principal de investigación e implementación, no solo como revisión final.
Anthropic también presentó Fable 5.1 como un avance de desempeño. La empresa reportó mejores resultados que Fable 5 en benchmarks como Terminal-Bench-Science, Terminal-Bench, Humanity’s Last Exam, OSWorld, AutomationBench y CursorBench. También citó comentarios de socios de acceso temprano como Jane Street, Cognition, Millennium, MongoDB, Red Hat, Rakuten, Block, Ramp, Canva, Hebbia y Plaid. Los ejemplos destacan comportamiento práctico de agentes: encontrar la causa raíz de fallos raros de software, construir prototipos durante ejecuciones de varios días, revisar cambios complejos de código e identificar nuevas líneas de investigación. El mensaje no es solo que el modelo puntúa mejor, sino que puede sostener trabajos largos con mejor razonamiento, comunicación y seguimiento.
La parte científica es especialmente llamativa. Anthropic dijo que el modelo contribuyó a tareas como diseño de ligantes proteicos, análisis computacional y optimización de rendimiento para modelos biológicos. En un ejemplo, Claude Fable 5.1 entrenó una red neuronal para crear un mapa de elevación de mayor resolución de aproximadamente un tercio de Venus a partir de imágenes de radar de la misión Magellan de la NASA y cartografía previa. Según Anthropic, el nuevo mapa mejora el detalle de 10 a 20 kilómetros hasta dos o tres kilómetros y estima alturas con hasta 25% más precisión. En biología computacional, Mythos 5.1 aceleró siete modelos abiertos de aprendizaje profundo hasta 2,5 veces mediante kernels GPU personalizados y caché de resultados intermedios, reduciendo costos estimados de GPU para algunos análisis genómicos entre 30% y 60%.
Esas capacidades llegan con controles más estrictos. Anthropic afirmó que Mythos 5.1 tiene las capacidades cibernéticas más fuertes entre los modelos que ha lanzado, aunque sigue en una categoría de menor riesgo dentro de su Frontier Compliance Framework. La compañía también describió pruebas de riesgos químicos y biológicos, resistencia a inyección de prompts y comportamiento de alineación. Mythos 5.1 conservará salvaguardas que restringen el acceso a capacidades de biología de investigación, y Anthropic dijo que un programa para trabajos avanzados de biología fue desarrollado con el gobierno estadounidense. Para Fable 5.1, las salvaguardas de ciberseguridad se vuelven más precisas: permiten identificar vulnerabilidades para defensa, pero redirigen tareas de doble uso más riesgosas, como generación de exploits y pruebas de penetración, a modelos Opus.
El lanzamiento también está ligado a Enterprise Frontier Safeguards, la nueva aproximación de Anthropic para ofrecer a clientes empresariales monitoreo más fuerte y privacidad similar a cero retención de datos. Los clientes elegibles podrán usar Fable 5.1 y Fable 5 con cero retención hasta que EFS se despliegue por fases este otoño. En conjunto, la noticia muestra que las empresas de modelos de frontera ya empaquetan capacidad, costo y gobernanza como una sola decisión de producto. Fable 5.1 busca hacer el trabajo agéntico avanzado más barato y útil; Mythos 5.1 muestra que las capacidades más sensibles se distribuirán cada vez más mediante acceso controlado, no mediante lanzamientos amplios.