Anthropic lanza Claude Opus 5: rendimiento casi de élite a la mitad de precio

Anthropic lanza Claude Opus 5: rendimiento casi de élite a la mitad de precio 2

Anthropic ha puesto en marcha Claude Opus 5, su nuevo modelo de inteligencia artificial diseñado para tareas complejas de programación, flujos de trabajo empresariales y agentes autónomos. Según la compañía, este modelo ofrece un rendimiento muy próximo al de su modelo de referencia —Claude Fable 5— pero a la mitad de precio, lo que lo convierte en una propuesta interesante tanto para desarrolladores como para empresas que ya trabajan con IA a escala.

El cuarto lanzamiento de Claude 5 en menos de dos meses

El dato que quizás dice más sobre el ritmo actual del sector: Opus 5 es el cuarto modelo de la familia Claude 5 que Anthropic publica en menos de dos meses. Según fuentes especializadas, esto refleja bien cómo ha cambiado la industria, que ya no va de grandes anuncios puntuales sino de mejoras continuas y rápidas en capacidad, coste y velocidad.

De acuerdo con la compañía, el nuevo modelo supera claramente a su predecesor, Claude Opus 4.8, especialmente en razonamiento profundo, tareas de larga duración y lo que en el sector se llama «test-time compute scaling», es decir, la capacidad de aprovechar más recursos computacionales en el momento de la inferencia para obtener mejores resultados.

Precios sin cambios, pero con mucho más rendimiento

Uno de los puntos que Anthropic ha destacado en su comunicado es que el precio se mantiene igual que el de Opus 4.8: 5 dólares por millón de tokens de entrada y 25 dólares por millón de tokens de salida. Según los datos facilitados, esto supone acceder a prestaciones cercanas a las del modelo más potente de la compañía sin pagar más.

El modelo se convierte de forma automática en la opción predeterminada para los usuarios del plan Claude Max y también se posiciona como el modelo más avanzado disponible dentro de Claude Pro. Para quienes acceden a la API, está disponible bajo el identificador claude-opus-5 y también a través de Amazon Bedrock, Google Cloud y Microsoft Foundry.

Pensamiento activado por defecto y nuevas herramientas para desarrolladores

A nivel técnico, uno de los cambios de comportamiento más importantes es que el modo «thinking» —la capacidad de razonamiento extendido del modelo— viene activado por defecto, algo que no ocurría en Opus 4.8. Según la documentación de Anthropic, el modelo decide de forma autónoma cuándo y cuánto razonar en cada turno de conversación.

La compañía también ha introducido un sistema de niveles de «effort» (esfuerzo) que permite a los desarrolladores controlar cuántos recursos dedica el modelo a cada tarea. La escala va de low a max, siendo este último el nivel más profundo de razonamiento disponible. Según los datos facilitados, Opus 5 convierte mejor que cualquier modelo anterior ese esfuerzo adicional en resultados de mayor calidad.

Novedades para quienes trabajan con agentes y flujos automatizados

Para quienes usan la API en flujos agenticos, Anthropic ha añadido la posibilidad de cambiar las herramientas disponibles a mitad de una conversación sin interrumpir la caché del prompt. Esto, según la compañía, permite construir sesiones más dinámicas sin necesidad de reiniciar cada vez que se necesita incorporar una nueva herramienta.

Otro añadido es el modo de fallback automático: si Opus 5 rechaza una petición, el sistema puede redirigirla a otro modelo de forma automática. De acuerdo con Anthropic, esto evita que los flujos de trabajo queden bloqueados y mejora la experiencia general de los equipos que dependen de la API para tareas críticas.

Además, el mínimo de tokens necesario para activar la caché de prompts ha bajado de 1.024 a 512 tokens. Según los datos facilitados, esto permite que prompts que antes eran demasiado cortos para beneficiarse del caché ahora puedan hacerlo sin ningún cambio de código.

Qué mejora en la práctica: de la programación a los documentos

Según la documentación publicada por Anthropic, las mejoras más destacadas de Opus 5 respecto a su predecesor incluyen varios ámbitos:

  • Programación y revisión de código: mejor detección de bugs reales con menos falsos positivos.
  • Tareas de larga duración: mayor capacidad para mantener el hilo en proyectos que implican múltiples archivos o pasos encadenados.
  • Visión: mejor comprensión de gráficos, documentos y diagramas, así como mayor precisión al replicar interfaces visuales.
  • Contexto largo: ventana de contexto de 1 millón de tokens, tanto como mínimo como como máximo.
  • Documentos y hojas de cálculo: generación de archivos con fórmulas complejas y presentaciones bien estructuradas.
  • Coordinación multiagente: mejor gestión de equipos de subagentes con patrones escritor-verificador más eficaces.

Un mercado enterprise en plena ebullición

El lanzamiento llega en un momento de notable expansión comercial para Anthropic. Según un análisis de Contrary Research citado por medios especializados, Claude acumulaba alrededor del 40% del mercado empresarial de modelos de lenguaje por uso a finales de 2025, y sus ingresos anualizados habrían pasado de unos 1.000 millones de dólares a finales de 2024 a una proyección de 9.000 millones para finales de 2025.

Casos de uso reales respaldan las afirmaciones de la compañía. De acuerdo con declaraciones recogidas por VentureBeat, Wade Foster, CEO de Zapier, indicó que Opus 5 encabezó el AutomationBench de su empresa completando un flujo de trabajo completo de principio a fin, algo que modelos anteriores no lograron. Por su parte, Scott Wu, CEO de Cognition —empresa detrás del agente de programación Devin—, señaló que el nuevo modelo se acerca al rendimiento de Fable 5 «a la mitad de coste», con especial fortaleza en depuración y análisis de causa raíz, según datos facilitados por la fuente.

También destaca en investigación científica

Más allá del mundo del software, según los datos facilitados por Anthropic, Opus 5 se posiciona ahora como su modelo más capaz para investigación científica entre los disponibles públicamente. La compañía indica que supera a Opus 4.8 en más de 10 puntos porcentuales en su benchmark interno de química.

Eso sí, la propia Anthropic matiza que Mythos 5 —su modelo más avanzado, no disponible al público en general— sigue siendo superior para trabajos de muy largo recorrido, como campañas de diseño autónomo de fármacos. Opus 5 queda así en una posición intermedia: potente y accesible, pero sin alcanzar las capacidades del techo de la gama.

Fuente: https://www.bloomberglinea.com/negocios/anthropic-lanza-claude-opus-5-un-modelo-de-ia-mas-rentable-para-tareas-cotidianas/


También podría ser de tu interés:

Deja un comentario