Anthropic presenta Claude Opus 5 y promete casi el rendimiento de su modelo insignia a mitad de precio

Anthropic presenta Claude Opus 5 y promete casi el rendimiento de su modelo insignia a mitad de precio

por Edgar Otero

Anthropic ha presentado Claude Opus 5, la nueva versión de su modelo de gama alta, disponible ya en todas sus plataformas. La compañía lo describe como un modelo "reflexivo y proactivo" que se acerca al rendimiento de Fable 5, su modelo más potente, pero a la mitad de precio. Opus 5 se convierte además en el modelo por defecto de Claude Max y en el más potente disponible dentro de Claude Pro.

Según los datos publicados por la propia empresa, Opus 5 marca un nuevo máximo en evaluaciones de programación y trabajo de conocimiento como Frontier-Bench o GDPval-AA, aunque sigue por detrás de Mythos 5 en tareas de ciberseguridad.

Geeknetic Anthropic presenta Claude Opus 5 y promete casi el rendimiento de su modelo insignia a mitad de precio 1

Mejoras en programación y en tareas de razonamiento

Anthropic asegura que Opus 5 mantiene el mismo precio que su predecesor, Claude Opus 4.8, pero con un salto notable de rendimiento. En Frontier-Bench v0.1, la evaluación centrada en tareas de ingeniería de software, la compañía afirma que Opus 5 más que duplica el resultado de Opus 4.8 con un coste menor por tarea. En CursorBench, con el máximo nivel de esfuerzo, se queda a apenas un 0,5% del mejor resultado de Fable 5, pero a mitad de coste por tarea.

Geeknetic Anthropic presenta Claude Opus 5 y promete casi el rendimiento de su modelo insignia a mitad de precio 2

El modelo también destaca en evaluaciones de resolución de problemas. En ARC-AGI 3, centrada en problemas novedosos, Anthropic afirma que la puntuación de Opus 5 triplica a la del siguiente mejor modelo. En AutomationBench, de Zapier, que mide si un modelo puede completar tareas empresariales de principio a fin, la tasa de éxito sería alrededor de 1,5 veces superior a la del siguiente modelo, al mismo coste por tarea. En el terreno científico, la compañía señala mejoras respecto a Opus 4.8 en química orgánica y en tareas relacionadas con proteínas.

Menos comportamiento desalineado, pero con límites en ciberseguridad y biología

Anthropic afirma que Opus 5 es, según sus propias auditorías internas, su modelo más alineado hasta la fecha, con las tasas más bajas registradas de comportamiento engañoso y menor susceptibilidad a ser manipulado para usos indebidos. La compañía lo sitúa también como su modelo más seguro a la hora de evitar acciones difíciles de revertir.

Pese a esta mejora general, Opus 5 mantiene deliberadamente ciertos límites. La empresa explica que no se ha entrenado específicamente en tareas de ciberseguridad, y que, aunque el modelo identifica vulnerabilidades con una eficacia cercana a la de Mythos 5, queda muy por detrás de este a la hora de convertir esas vulnerabilidades en exploits funcionales. En el terreno biológico, Opus 5 pasa a ser el modelo de acceso general más capaz para investigación científica. De todos modos, Anthropic reconoce limitaciones en tareas de investigación autónoma y prolongada, el escenario donde considera que existe mayor riesgo.

Este tipo de matices son importantes y a menudo pasan desapercibidos. De hecho, conectan con un debate más amplio sobre hasta qué punto las empresas pueden depender de modelos de IA sujetos a restricciones de acceso que pueden variar de un lanzamiento a otro, como ya ocurrió previamente con Fable 5 y Mythos 5.

Precio, disponibilidad y nuevas funciones en beta

Claude Opus 5 ya está disponible en todas las plataformas de Anthropic, con un precio de 5 dólares por millón de tokens de entrada y 25 dólares por millón de tokens de salida, idéntico al de Opus 4.8. El modelo también puede ejecutarse en modo rápido, con una velocidad hasta 2,5 veces superior a cambio de duplicar el precio base.

Junto al lanzamiento, Anthropic ha introducido en fase beta dos funciones adicionales. Estas son la posibilidad de cambiar las herramientas disponibles a mitad de una conversación sin invalidar la caché del prompt y un sistema de fallback automático en la API. Se trata de un sistema que permite que las solicitudes bloqueadas por los clasificadores de seguridad se redirijan automáticamente a otro modelo en lugar de quedar rechazadas.

Fin del Artículo. ¡Cuéntanos algo en los Comentarios!

Temas Relacionados: IA Claude Claude Opus 5
Redactor del Artículo: Edgar Otero

Edgar Otero

Soy técnico en sistemas informáticos, empecé a experimentar un Pentium II, aunque lo mío siempre ha sido el software. Desde que actualicé de Windows 95 a Windows 98 no he dejado de instalar sistemas. Tuve mi época Linuxera y fui de los que pidió el CD gratuito de Canonical. Actualmente uso macOS para trabajar y tengo un portátil con Windows 11 en el que también he instalado Chrome OS Flex. En definitiva, experimentar, probar y presionar botones.

Comentarios y opiniones sobre: Anthropic presenta Claude Opus 5 y promete casi el rendimiento de su modelo insignia a mitad de precio ¿Qué opinas? ¿Alguna pregunta?