Anthropic lanza las versiones 5.1 de Claude Fable y Mythos

Anthropic, la empresa detrás de los modelos de inteligencia artificial Claude, ha anunciado la disponibilidad de las versiones 5.1 de Claude Fable y Claude Mythos, dos de sus modelos más avanzados. Estas actualizaciones representan un salto significativo en capacidades técnicas, con mejoras en seguridad, costes operativos, protección de datos y rendimiento en tareas complejas. Además, se introducen nuevas medidas para hacer estos modelos más accesibles y confiables para usuarios empresariales y especialistas en campos como la ciberseguridad o las ciencias de la vida.

Avances clave en seguridad y protección de datos

Ambos modelos, Fable 5.1 y Mythos 5.1, comparten la misma arquitectura tecnológica, pero difieren en sus configuraciones de seguridad. Fable 5.1 está disponible de forma general para cualquier usuario, mientras que Mythos 5.1 requiere acceso a través de programas restringidos, diseñados específicamente para entornos críticos como la ciberseguridad y la investigación biomédica.

Una de las novedades más destacadas es el sistema de Enterprise Frontier Safeguards (EFS), que garantiza la privacidad total de los datos de los usuarios. Este sistema almacena información en infraestructura controlada exclusivamente por el cliente, no por Anthropic, ofreciendo un nivel de protección equivalente a una política de retención de datos cero. Aunque el EFS se implementará gradualmente a lo largo del otoño, los clientes elegibles ya pueden usar Fable 5.1 con esta configuración de privacidad.

Reducción del coste operativo y mejoras en rendimiento

El principal atractivo de Fable 5.1 es su reducción del 25% en el coste de uso para tareas típicas en comparación con la versión 5 anterior. Esta optimización se debe a una mejora en el precio de las lecturas de caché, donde el modelo accede a datos previamente procesados. En casos de uso altamente agentic, el ahorro puede alcanzar incluso el 45%.

Además, los modelos muestran un rendimiento significativamente superior en benchmarks técnicos. Por ejemplo, en el Terminal-Bench-Science 0.1, Fable 5.1 supera a su predecesor en un 30%, mientras que en el CursorBench 3.2.0 logra una eficiencia notable al procesar tareas complejas con menor consumo de tokens. Estos avances permiten que Fable 5.1 ofrezca resultados similares o superiores a la versión 5 en tareas de alto esfuerzo, pero a un coste reducido.

Mejoras en la detección de fallos y capacidad de resolución de problemas

Una de las aplicaciones más destacadas de Fable 5.1 es su habilidad para identificar fallos de software críticos que otros modelos no han podido resolver. Por ejemplo, en pruebas realizadas por la firma de inversión Millennium, Fable 5.1 descubrió una causa de un error raro en sus sistemas internos que había evadido a sus ingenieros durante años. El modelo analizó una biblioteca externa, comparó su código con un volcado de memoria y localizó un error en la misma.

Este tipo de capacidades se han validado en múltiples escenarios, como la revisión de proyectos clínicos o la resolución de problemas empresariales complejos. En una evaluación simulada de 30 días con herramientas de Square, Fable 5.1 demostró una eficiencia superior al 50% en comparación con Opus 5, permitiendo a los equipos de ingeniería abordar escenarios complejos sin necesidad de sesiones prolongadas de planificación.

Testimonios de usuarios y socios

Varias organizaciones han destacado los avances de Fable 5.1. Un ejemplo es Devin, que ha migrado su tráfico de Opus 5 a Fable 5.1 desde el lanzamiento, al encontrar que ofrece resultados similares a un costo menor. Otro caso es el de un equipo de investigación que usó Fable 5.1 para generar un prototipo complejo en tres días, incluyendo análisis de código, diseño arquitectónico y pruebas automatizadas.

En el ámbito de la creatividad y la resolución de problemas, los usuarios destacan la capacidad del modelo para proponer soluciones novedosas que superan a otros modelos y a veces incluso a investigadores humanos. Por ejemplo, en un desafío de investigación, Fable 5.1 identificó una vía alternativa para un problema científico que había bloqueado a otros equipos durante meses.

Limitaciones y consideraciones

A pesar de sus avances, Mythos 5.1 sigue siendo un modelo restringido, accesible solo mediante programas de confianza, lo que limita su disponibilidad para usuarios generales. Además, aunque los nuevos sistemas de seguridad reducen significativamente los falsos positivos (en ciberseguridad, un 60% menos), aún existen restricciones en su uso para desarrollar exploits o herramientas de ataque, un área que Anthropic ha decidido mantener controlada.

Conclusiones

Las versiones 5.1 de Claude Fable y Mythos marcan un hito en la evolución de los modelos de inteligencia artificial, combinando un rendimiento superior, mejoras en seguridad y reducción de costes operativos. Estas actualizaciones no solo benefician a usuarios empresariales y especialistas, sino que también abren nuevas posibilidades para la investigación científica y la resolución de problemas complejos. Con su disponibilidad gradual y el enfoque en privacidad, Anthropic parece estar posicionándose como un actor clave en la próxima generación de modelos de IA responsables y eficientes.

Para más información: https://www.anthropic.com/claude-fable-and-mythos-5-1


También te podría Interesar :