Claude Opus 5 llega con inteligencia de frontera a mitad del precio de Fable 5
Anthropic lanzó hoy Claude Opus 5, un modelo de inteligencia artificial que combina capacidades cercanas a la frontera de razonamiento con una eficiencia de costos notable. El nuevo modelo, disponible desde este 24 de julio de 2026 en todas las plataformas de la compañía, se convierte en la opción por defecto en Claude Max y en el más potente de Claude Pro, ofreciendo la mitad del precio del modelo Fable 5.
Con este lanzamiento, la empresa busca ofrecer una herramienta de inteligencia artificial que optimice tareas de programación y trabajo del conocimiento sin disparar los costos de uso. El modelo mantiene el precio de su predecesor: 5 dólares por millón de tokens de entrada y 25 dólares por millón de tokens de salida. También se ofrece un modo rápido que duplica la velocidad base por el doble del costo estándar.
Claude Opus 5: rendimiento de frontera por la mitad del costo
En evaluaciones como Frontier-Bench y GDPval-AA, Opus 5 se convierte en el nuevo estado del arte en tareas de codificación y trabajo del conocimiento. Duplica el rendimiento de Opus 4.8 en Frontier-Bench v0.1 con un costo por tarea menor. En CursorBench 3.2, a máximo esfuerzo, queda a solo 0,5 % del puntaje pico de Fable 5 pero a la mitad del costo.

Los resultados se extienden a la solución de problemas novedosos: en ARC-AGI 3 triplica la puntuación del siguiente mejor modelo. En Zapier AutomationBench, la tasa de aprobación es 1,5 veces la del siguiente competidor por el mismo costo, y en OSWorld 2.0 supera a todos los modelos en cualquier punto de costo, alcanzando la mejor marca de Fable 5 con poco más de un tercio del gasto.
El campo científico también recibe un impulso. En evaluaciones internas de ciencias de la vida, Opus 5 mejora a Opus 4.8 en todas las áreas, con saltos de 10,2 puntos porcentuales en química orgánica y 7,7 puntos en predicción de variaciones proteicas. Además, la capacidad visual se refina: el modelo genera ilustraciones científicas interactivas y simulaciones de flujo de aire sobre objetos aerodinámicos.
Un motor de verificación y agencia autónoma

Los primeros usuarios reportaron un salto cualitativo en la capacidad del modelo para verificar su propio trabajo. En una tarea de Frontier-Bench, Opus 5 tenía que reconstruir una pieza mecánica en 3D a partir de un dibujo sin acceso directo a la imagen. El modelo creó su propio pipeline de visión por computadora para extraer la geometría y completó la pieza con éxito repetido, algo que ningún competidor logró. En otro caso, encontró la causa raíz de un error en un gestor de paquetes de código abierto que la comunidad había pasado por alto.
Desarrolladores de plataformas como Cursor, Zapier o Lovable coincidieron en que Opus 5 se comporta con más criterio: no se precipita, contradice al usuario cuando detecta un fallo de diseño y propone soluciones equilibradas. Un ingeniero de una firma de trading construyó en una sola sesión un feed de datos de mercado para una nueva bolsa, tarea que modelos anteriores no podían completar ni con planes detallados.
Seguridad y alineamiento: el modelo más fiable según Anthropic
Anthropic insiste en que Opus 5 es su modelo más alineado hasta la fecha. En la auditoría automatizada de comportamiento, obtuvo una puntuación de solo 2.3 en conducta desalineada, la más baja de los modelos recientes. El modelo respeta la Constitución de Claude mejor que Opus 4.8, Sonnet 5 y Fable 5, y mostró la menor tasa de comportamientos engañosos y la menor susceptibilidad a usos indebidos.
En ciberseguridad, donde Google ya presentó su propio modelo ligero Gemini 3.5 Flash Cyber, Opus 5 se mantiene deliberadamente por detrás de Mythos 5 en la explotación de vulnerabilidades. Según la evaluación OSS-Fuzz, Opus 5 identifica fallos con una eficacia similar al modelo más peligroso, pero es mucho menos capaz de convertirlos en amenazas concretas. Para evitar usos ofensivos, los clasificadores de Anthropic bloquean el escaneo binario de vulnerabilidades, las pruebas de penetración y la generación de exploits, aunque permiten la búsqueda de fallos en código fuente. Las solicitudes bloqueadas se derivan automáticamente a Opus 4.8.
En biología, el modelo hereda las salvaguardas de Opus 4.8 y se convierte en la opción más capaz disponible para investigación científica general. Sin embargo, Anthropic advierte que aún muestra limitaciones en tareas de investigación autónoma prolongada, precisamente donde los modelos de IA podrían representar mayores riesgos.
Junto con Opus 5, la compañía liberó dos funciones beta: cambios de herramientas a mitad de conversación sin invalidar la caché de prompts y redireccionamiento automático ante bloqueos de seguridad, de modo que las solicitudes siempre lleguen al mejor modelo disponible en lugar de ser rechazadas.
Los desarrolladores pueden consultar la guía de prompting específica para Opus 5 y revisar los detalles de seguridad en la System Card publicada por Anthropic.
Con información de Anthropic.
Comunidad Arepa
Únete a nuestros canales principales
Comentarios
Relacionados
Ver más
OpenAI estrena ChatGPT Voice en la app de escritorio: así funciona el nuevo modo de voz

Google libera sus skills oficiales para agentes de IA: 13 habilidades compatibles con Claude Code y Copilot
