El día 24 de Julio, Anthropic anunció el lanzamiento de Claude Opus 5, el modelo más reciente de la serie Opus. Este nuevo modelo combina un avance notable en capacidad con un coste reducido en comparación con su predecesor, Opus 4.8, y se presenta como una alternativa viable a modelos más caros como Claude Fable 5. Según la información disponible, Opus 5 sobresale en tareas de desarrollo de software, resolución de problemas y ciencia de vida, aunque sigue mostrando limitaciones en ciberseguridad. Su disponibilidad en todas las plataformas y su precio competitivo marcan un hito en el equilibrio entre potencia y asequibilidad.
Mejoras en rendimiento y eficiencia
Claude Opus 5 representa un salto importante en términos de rendimiento para el mismo coste. En evaluaciones como Frontier-Bench v0.1, supera a todos los modelos existentes, duplicando el rendimiento de Opus 4.8 a menor coste por tarea. En el CursorBench 3.2, alcanza un 99.5% del máximo puntaje de Fable 5 al mismo coste, mientras que en OSWorld 2.0, supera a todos los modelos incluso al 33% del coste de Fable 5. Estas mejoras se traducen en una mayor eficiencia para usuarios que necesitan resultados rápidos y económicos.
En tareas científicas, Opus 5 destaca especialmente en organic chemistry y bioinformatics. Por ejemplo, en una evaluación interna, supera a Opus 4.8 en 10.2 puntos porcentuales al inferir estructuras moleculares a partir de datos de espectroscopía. En tareas de protein function prediction, mejora en 7.7 puntos porcentuales. Estas capacidades lo convierten en una herramienta valiosa para investigadores en ciencias de la vida.
Capacidad de autogestión y resolución de problemas complejos
Una de las características más destacadas de Opus 5 es su capacidad para verificar su trabajo y iterar hasta lograr resultados exitosos. En una prueba, se le pidió reconstruir un componente mecánico a partir de un dibujo sin acceso directo a la imagen. El modelo desarrolló una pipeline de visión por computador para extraer geometría de los píxeles y reconstruir el componente, algo que ningún otro modelo logró repetidamente. Este enfoque proactivo se repite en casos como la corrección de errores en paquetes de código abierto, donde Opus 5 identificó causas raíz que otros modelos no detectaron.
Alineación ética y medidas de seguridad
En términos de alineación con los valores de la empresa, Opus 5 es el modelo más alineado de Anthropic hasta la fecha. Según pruebas automatizadas, muestra menores tasas de comportamiento engañoso y es menos susceptible a ser manipulado para usos indebidos. En cuanto a seguridad, se ha evitado su entrenamiento en tareas de ciberseguridad, aunque su capacidad general ha permitido identificar vulnerabilidades similares a Mythos 5. Sin embargo, en la explotación de vulnerabilidades, sigue a una distancia considerable de Mythos 5.
En ciberseguridad, Opus 5 tiene clasificadores menos restrictivos que Fable 5, lo que le permite detectar vulnerabilidades en código fuente, pero bloquea tareas como scanning binario, penetration testing y generación de exploits. Esto reduce en un 85% las intervenciones de seguridad en comparación con Fable 5. Para usuarios que necesiten mayor flexibilidad, el Cyber Verification Program (CVP) ofrece acceso a una versión con menos restricciones.
Precio y disponibilidad
Claude Opus 5 está disponible en todas las plataformas, con un precio de $5 por millón de tokens de entrada y $25 por millón de tokens de salida, igual que Opus 4.8. Además, se ofrece en modo Fast, donde se ejecuta 2.5 veces más rápido, aunque a un costo duplicado en la plataforma de Claude y en créditos de uso en Claude Code. Esta opción es ideal para usuarios que priorizan la velocidad sobre el coste.
Nuevas funcionalidades en beta
Junto con Opus 5, Anthropic lanzó dos actualizaciones en beta:
- Cambio de herramientas en conversaciones: Permite a los desarrolladores modificar las herramientas que puede usar Claude durante una conversación sin invalidar el caché del prompt.
- Retroceso automático en la API: Permite que las solicitudes marcadas por clasificadores de seguridad se redirijan automáticamente a otro modelo, asegurando que siempre se use el modelo más adecuado.
Limitaciones y consideraciones
A pesar de sus mejoras, Opus 5 no elimina completamente las limitaciones en tareas de investigación autónoma de largo plazo en biología, donde Mythos 5 sigue siendo el modelo más capaz. Además, aunque puede identificar vulnerabilidades en ciberseguridad, su capacidad para explotarlas es significativamente menor que la de Mythos 5.
Conclusiones
Claude Opus 5 representa un avance importante en el equilibrio entre rendimiento y coste, con mejoras en tareas técnicas, científicas y de resolución de problemas complejos. Su alineación ética y medidas de seguridad lo hacen una opción segura para usuarios que buscan eficiencia sin comprometer la responsabilidad. Aunque no supera a modelos especializados como Mythos 5 en ciertas áreas, su disponibilidad a precios reducidos y su versatilidad lo convierten en una herramienta valiosa para una amplia gama de aplicaciones.
Para más información: https://www.anthropic.com/news/claude-opus-5




