Anthropic presenta Claude Opus 5 y promete casi el rendimiento de su modelo insignia a mitad de precio
por Edgar OteroAnthropic ha presentado Claude Opus 5, la nueva versión de su modelo de gama alta, disponible ya en todas sus plataformas. La compañía lo describe como un modelo "reflexivo y proactivo" que se acerca al rendimiento de Fable 5, su modelo más potente, pero a la mitad de precio. Opus 5 se convierte además en el modelo por defecto de Claude Max y en el más potente disponible dentro de Claude Pro.
Según los datos publicados por la propia empresa, Opus 5 marca un nuevo máximo en evaluaciones de programación y trabajo de conocimiento como Frontier-Bench o GDPval-AA, aunque sigue por detrás de Mythos 5 en tareas de ciberseguridad.

Mejoras en programación y en tareas de razonamiento
Anthropic asegura que Opus 5 mantiene el mismo precio que su predecesor, Claude Opus 4.8, pero con un salto notable de rendimiento. En Frontier-Bench v0.1, la evaluación centrada en tareas de ingeniería de software, la compañía afirma que Opus 5 más que duplica el resultado de Opus 4.8 con un coste menor por tarea. En CursorBench, con el máximo nivel de esfuerzo, se queda a apenas un 0,5% del mejor resultado de Fable 5, pero a mitad de coste por tarea.

El modelo también destaca en evaluaciones de resolución de problemas. En ARC-AGI 3, centrada en problemas novedosos, Anthropic afirma que la puntuación de Opus 5 triplica a la del siguiente mejor modelo. En AutomationBench, de Zapier, que mide si un modelo puede completar tareas empresariales de principio a fin, la tasa de éxito sería alrededor de 1,5 veces superior a la del siguiente modelo, al mismo coste por tarea. En el terreno científico, la compañía señala mejoras respecto a Opus 4.8 en química orgánica y en tareas relacionadas con proteínas.
Menos comportamiento desalineado, pero con límites en ciberseguridad y biología
Anthropic afirma que Opus 5 es, según sus propias auditorías internas, su modelo más alineado hasta la fecha, con las tasas más bajas registradas de comportamiento engañoso y menor susceptibilidad a ser manipulado para usos indebidos. La compañía lo sitúa también como su modelo más seguro a la hora de evitar acciones difíciles de revertir.
Pese a esta mejora general, Opus 5 mantiene deliberadamente ciertos límites. La empresa explica que no se ha entrenado específicamente en tareas de ciberseguridad, y que, aunque el modelo identifica vulnerabilidades con una eficacia cercana a la de Mythos 5, queda muy por detrás de este a la hora de convertir esas vulnerabilidades en exploits funcionales. En el terreno biológico, Opus 5 pasa a ser el modelo de acceso general más capaz para investigación científica. De todos modos, Anthropic reconoce limitaciones en tareas de investigación autónoma y prolongada, el escenario donde considera que existe mayor riesgo.
Este tipo de matices son importantes y a menudo pasan desapercibidos. De hecho, conectan con un debate más amplio sobre hasta qué punto las empresas pueden depender de modelos de IA sujetos a restricciones de acceso que pueden variar de un lanzamiento a otro, como ya ocurrió previamente con Fable 5 y Mythos 5.
Precio, disponibilidad y nuevas funciones en beta
Claude Opus 5 ya está disponible en todas las plataformas de Anthropic, con un precio de 5 dólares por millón de tokens de entrada y 25 dólares por millón de tokens de salida, idéntico al de Opus 4.8. El modelo también puede ejecutarse en modo rápido, con una velocidad hasta 2,5 veces superior a cambio de duplicar el precio base.
Junto al lanzamiento, Anthropic ha introducido en fase beta dos funciones adicionales. Estas son la posibilidad de cambiar las herramientas disponibles a mitad de una conversación sin invalidar la caché del prompt y un sistema de fallback automático en la API. Se trata de un sistema que permite que las solicitudes bloqueadas por los clasificadores de seguridad se redirijan automáticamente a otro modelo en lugar de quedar rechazadas.
Fin del Artículo. ¡Cuéntanos algo en los Comentarios!



