Actualizado recientemente: A una semana del lanzamiento, los benchmarks independientes y demos que circulan por X confirman que Claude Opus 5 es el nuevo estado del arte en coding. Los números de SWE-bench y AutomationBench se sostienen, y los primeros tests de usuarios muestran que el modelo cumple lo que Anthropic prometió.
En pocas palabras: Anthropic lanzó Claude Opus 5, un modelo que se acerca a la inteligencia de frontera y cuesta la mitad que Claude Fable 5. Viene por defecto en Claude Max, está disponible en Pro, y lidera los benchmarks de ingeniería de software.
Claude Opus 5 es el nuevo modelo de lenguaje estado-del-arte (SOTA) de Anthropic, recién lanzado. Ofrece inteligencia cercana a Claude Fable 5 a la mitad del precio, con rendimiento líder en programación (SWE-bench), trabajo de conocimiento y resolución de problemas novedosos. Está disponible en Claude Max como modelo predeterminado, en Claude Pro como la opción más potente, y vía API.
Anthropic largó Claude Opus 5 con una jugada clara: meter un modelo con inteligencia de frontera a un precio que deja en offside a varios competidores. El anuncio oficial confirma que Opus 5 está disponible como modelo predeterminado en Claude Max y como la opción más potente dentro de Claude Pro. Entrega un rendimiento que roza al de Claude Fable 5 costando la mitad.
Claude Opus 5 fue diseñado para tareas de programación, trabajo de conocimiento y resolución de problemas complejos con una eficiencia de costo por tarea que más que duplica a la generación anterior. Según el comunicado oficial de Anthropic, Opus 5 se posiciona como el nuevo referente en benchmarks de ingeniería de software como SWE-bench, superando a todos los modelos disponibles en el mercado.
En 30 segundos
- Claude Opus 5 ya está disponible en Claude Max (como modelo predeterminado) y Claude Pro (como la opción más potente).
- Ofrece un costo similar al de Opus 4.8 y más que duplica su rendimiento en tareas de ingeniería de software a un costo por tarea menor, y cuesta la mitad que Fable 5. A máximo esfuerzo, Opus 5 queda dentro del 0,5% del puntaje pico de Fable 5.
- Es el nuevo SOTA en coding: en SWE-bench supera a todos los demás modelos y multiplica por tres el puntaje del siguiente mejor modelo en resolución de problemas novedosos, según los datos de Anthropic.
- En ciberseguridad, queda por detrás de Mythos 5, así que si tu foco es 100% security tasks, Opus 5 no es la opción número uno.
- Tiene effort settings ajustables (high, xhigh, max) para equilibrar inteligencia contra consumo de tokens según la tarea que encares.
- Disponible mediante suscripción directa y vía API para desarrolladores.
Anthropic es una empresa de inteligencia artificial fundada en 2021, que desarrolla modelos de lenguaje como Claude para tareas de generación y análisis de texto. Sus sistemas están diseñados para ser útiles, honestos y seguros en diversas aplicaciones.
Anthropic es una empresa de inteligencia artificial fundada por Dario Amodei y otros ex empleados de OpenAI, que desarrolla modelos de lenguaje como Claude para tareas de generación de texto, análisis y razonamiento.
¿Por qué Anthropic lanzó Opus 5 justo ahora?
Con Opus 5, Anthropic amplía su línea de modelos Claude. Antes de este lanzamiento, el lineup ya tenía a Fable 5 como el tope de gama en inteligencia pura y a Mythos 5 como el especialista en ciberseguridad. Faltaba el modelo de uso diario, el que le da a un equipo de desarrollo o a un profesional independiente la potencia de frontera sin el costo de Fable 5. Ese hueco lo ocupaba Opus 4.8, un modelo de la generación anterior que ya pedía recambio.
La decisión de lanzar Opus 5 responde a una lógica de segmentación que Anthropic viene afinando hace meses. No todos los usuarios necesitan el 100% de inteligencia todo el tiempo, ni pueden pagar lo que cuesta Fable 5 en modo max effort. Opus 5 está pensado para ese 90% de tareas donde necesitás calidad profesional —código, análisis, razonamiento— sin pagar el precio de un modelo diseñado para investigación de frontera.
Opus 5 no es un modelo recortado. Según la documentación técnica de Anthropic, supera a Fable 5 en coding y, en otras evaluaciones a máximo esfuerzo, queda dentro del 0,5% del puntaje pico de Fable 5. La diferencia práctica es casi imperceptible, salvo que estés haciendo investigación donde cada punto porcentual cuenta.
Anthropic estableció un costo similar al de Opus 4.8. En un mercado donde cada nueva versión suele venir con aumento, mantener un costo comparable mientras duplicás el rendimiento manda una señal: la guerra de precios en modelos de lenguaje está lejos de terminar. Para equipos que venían usando Opus 4.8, la actualización es directa y sin fricción económica. Para los que usaban Fable 5 por falta de una alternativa costo-eficiente con inteligencia comparable, Opus 5 les da una razón concreta para migrar.
Que la línea se amplíe no significa que sea estática. Mythos 5, Fable 5 y Opus 5 son los tres modelos actuales, cada uno con un perfil de uso bien distinto. La pregunta que queda flotando es si en el futuro van a converger o si la especialización por modelo va a profundizarse todavía más.
¿Qué hace diferente a Claude Opus 5?
Anthropic laburó en una dirección que varios veníamos pidiendo hace rato: bajar el costo sin recortar inteligencia. Opus 5 es un modelo que Anthropic describe como “thoughtful and proactive” —más reflexivo y con iniciativa— y la diferencia se nota en tareas que requieren planificación, razonamiento en varios pasos y generación de código con contexto extenso.
El diferencial grueso no está solo en los números de benchmark. Está en que lograron acercarse al techo de inteligencia de Fable 5 (su modelo más caro y potente) cobrando la mitad. Si estás corriendo un pipeline de revisión de código automatizado, con Opus 5 obtenés resultados que antes solo conseguías pagando el doble por Fable 5. Para equipos que consumen millones de tokens por mes, esto cambia la ecuación por completo. Esto se conecta con lo que analizamos en nuestra comparativa entre Gemini y Claude.
En coding, Opus 5 pasa directamente a Fable 5. En otras evaluaciones a máximo esfuerzo se queda dentro del 0,5% del puntaje pico de Fable 5. Depende de qué priorices. Te puede servir nuestra cobertura en la comparativa de GPT y Claude.
¿Cuánto cuesta Claude Opus 5 y qué planes están disponibles?
Opus 5 mantiene un costo similar al de su predecesor, Opus 4.8. Anthropic logró más que duplicar el rendimiento en tareas clave como SWE-bench sin mover la aguja del precio. Comparado con Fable 5, el costo por tarea es la mitad.
En términos prácticos: en SWE-bench, Opus 5 supera a Fable 5, y a máximo esfuerzo obtenés un resultado que está a 0,5% del puntaje máximo de Fable 5 pagando la mitad. Opus 5 logra un rendimiento superior a un costo dado en comparación con otros modelos en los niveles high, xhigh y max effort.
Los planes donde está disponible son:
- Claude Max: Opus 5 es el modelo predeterminado. Ni bien te suscribís, ya lo estás usando sin configuración adicional.
- Claude Pro: Aparece como la opción más potente del menú. Lo seleccionás manualmente.
- API: Disponible para desarrolladores. Los precios de API no se detallaron en el anuncio, pero mantienen la proporción de costo respecto a Fable 5.
¿Y frente a Mythos 5? Ahí la cosa cambia. En tareas de ciberseguridad, Mythos 5 sigue siendo superior. La fuente no detalla el diferencial de precio con Mythos 5, pero el posicionamiento está claro: Opus 5 es el modelo para el día a día, el caballito de batalla; Mythos 5 es la herramienta especializada para security.
¿Cómo se compara Claude Opus 5 con Fable 5 y Mythos 5?
En SWE-bench, Opus 5 supera a todos los modelos del mercado —incluido Fable 5— y más que duplica el rendimiento de Opus 4.8 a un costo por tarea menor. A máximo esfuerzo, Opus 5 queda dentro del 0,5% del puntaje pico de Fable 5, costando la mitad.
En cybersecurity la tabla se invierte. Mythos 5 mantiene la delantera. Anthropic no ocultó este dato —lo pusieron en el anuncio sin maquillaje— y eso habla bien de la transparencia de la empresa. No todos los fabricantes admiten dónde su modelo nuevo pierde.
Para tareas de conocimiento y resolución de problemas novedosos, el puntaje de Opus 5 es tres veces superior al del siguiente mejor modelo. No es un 10% ni un 20%: es tres veces el puntaje del competidor más cercano en evaluaciones diseñadas para medir razonamiento sobre problemas que el modelo no vio antes. Si tu caso de uso es investigación, análisis de documentos o cualquier cosa que requiera conectar puntos sueltos, este dato pesa fuerte.
| Modelo | Costo relativo | SWE-bench | Problemas novedosos | Ciberseguridad | Disponible en |
|---|---|---|---|---|---|
| Claude Opus 5 | Costo similar a Opus 4.8; mitad que Fable 5 | SOTA — supera a todos | 3× el siguiente mejor modelo | Por debajo de Mythos 5 | Claude Max (default), Claude Pro, API |
| Claude Fable 5 | 2× Opus 5 | Por detrás de Opus 5 | Segundo lugar | No especificado | No especificado |
| Mythos 5 | No revelado (mayor) | No especificado | No especificado | Líder | No especificado |
| Claude Opus 4.8 | Similar a Opus 5 | Menos de la mitad que Opus 5 | Muy por debajo | No especificado | No especificado |



¿Qué resultados obtiene Claude Opus 5 en software engineering?
El dato más contundente del lanzamiento está en SWE-bench, el benchmark que mide la capacidad de un modelo para resolver tareas reales de ingeniería de software. Opus 5 no solo lidera la tabla: más que duplica el rendimiento de Opus 4.8 a un costo por tarea menor. Es el mismo benchmark, la misma métrica, y más del doble de puntaje pagando lo mismo o menos.
Ponele que antes tirar una tarea de generación de código con Opus 4.8 te daba un resultado aceptable el 40% de las veces. Con Opus 5 pasás a más del 80% sin mover el presupuesto. Esa diferencia se siente en el día a día de un equipo de desarrollo: menos revisiones manuales, menos reintentos, menos tiempo perdido en correcciones. En el análisis de OpenAI vs Claude profundizamos sobre esto.
En Zapier AutomationBench, que mide si un modelo puede completar tareas empresariales reales de principio a fin, la tasa de aprobación de Opus 5 es aproximadamente 1,5 veces la del siguiente mejor modelo al mismo costo por tarea. No son pruebas académicas: son flujos concretos como procesar una factura, clasificar tickets de soporte o actualizar registros en un CRM a partir de un mail.
Anthropic logró esta mejora sin aumentar el costo. Subir el modelo, mantener el precio, más que duplicar el output. El manual de la industria suele ser el opuesto. Lo explicamos a fondo en el análisis de ofertas OpenAI y Anthropic.
¿En qué tareas supera Claude Opus 5 a sus predecesores?
El foco está en tres áreas bien definidas donde hay plata sobre la mesa: programación, trabajo de conocimiento y resolución de problemas novedosos. Anthropic no quiso hacer un modelo generalista que abarque todo; lo optimizó para casos de uso concretos.
- Ingeniería de software. SWE-bench es el benchmark de referencia y Opus 5 lo lidera. Generación de código, code review automatizado, debugging y refactorización: este modelo es el nuevo piso desde donde arrancar.
- Trabajo de conocimiento. Análisis de documentos largos, extracción de información estructurada, síntesis de informes y razonamiento sobre datos no estructurados. Los números en Zapier AutomationBench muestran que la tasa de aprobación es 1,5 veces la del siguiente mejor modelo al mismo costo.
- Problemas novedosos. Multiplica por tres el puntaje del siguiente mejor modelo en evaluaciones diseñadas para medir razonamiento sobre escenarios inéditos. Si necesitás que el modelo piense en algo que no está en sus datos de entrenamiento, Opus 5 tiene muchas más chances de llegar a una respuesta útil.
Lo que no es: un especialista en ciberseguridad. Para eso, Mythos 5. Anthropic destaca en el anuncio sus capacidades visuales mejoradas, como la generación de ilustraciones interactivas. Es un modelo optimizado para razonar y producir código, con salidas visuales potenciadas.
Automatizaciones empresariales: el rendimiento de Opus 5 en Zapier AutomationBench
Uno de los datos que pasó más desapercibido en el anuncio es el desempeño de Opus 5 en Zapier AutomationBench. No es un test académico: son flujos de trabajo concretos como procesar una factura, clasificar tickets de soporte o actualizar registros en un CRM a partir de un mail.
Opus 5 tiene una tasa de aprobación aproximadamente 1,5 veces superior a la del siguiente mejor modelo en este benchmark. Una mejora de 1,5 veces en automatización empresarial significa que el modelo no solo entiende la tarea, sino que la ejecuta con menos errores, menos pasos intermedios y menos necesidad de intervención humana. Para equipos de operaciones que manejan cientos o miles de tareas automatizadas por día, esta diferencia impacta directo en los costos operativos.
El dato se vuelve más interesante cuando lo cruzás con el precio. Según los datos publicados por Anthropic, Opus 5 logra esta performance a un costo por tarea que es la mitad que Fable 5 y comparable al de modelos mucho menos capaces. Para empresas que ya tienen flujos armados con Zapier, Make o n8n, migrar a Opus 5 vía API es una decisión que se paga sola en semanas.
Ahora bien, AutomationBench no cubre todos los sectores por igual. Está sesgado hacia tareas de oficina, administración y ventas. Si tu automatización es más nicho —digamos, procesamiento de imágenes satelitales o análisis de señales de IoT—, el benchmark no te dice mucho. Siempre conviene validar con tus propios casos de uso antes de migrar pipelines completos.
¿Qué es el effort setting en Claude Opus 5?
Los effort settings son la palanca que Anthropic te da para equilibrar costo e inteligencia según la tarea. Tenés tres niveles documentados: high, xhigh y max. No son modos de personalidad ni ajustes de temperatura: modifican cuánto cómputo interno dedica el modelo a cada consulta.
- High: para tareas rutinarias como clasificación de texto, extracción de datos simples o respuestas a preguntas frecuentes. El modelo responde rápido y consume pocos tokens.
- Xhigh: el punto medio para trabajo de conocimiento y código de complejidad moderada. La mayoría de los casos de uso productivo caen acá. Buena relación costo-rendimiento.
- Max: para cuando necesitás el mejor resultado posible sin importar el costo. Problemas novedosos, razonamiento en varios pasos, auditoría de código crítico. Acá es donde Opus 5 queda a 0,5% de Fable 5 y multiplica por tres el puntaje de los competidores en problemas inéditos.
La recomendación práctica: arrancá con xhigh para el 80% de tus casos de uso, subí a max cuando el resultado sea crítico, y bajá a high para tareas de alto volumen y baja complejidad. Ajustar esto bien te puede ahorrar una cantidad considerable de plata sin sacrificar calidad donde importa. Relacionado: nuestro análisis de infraestructura de Anthropic.
¿Dónde puedo probar Claude Opus 5?
Desde su lanzamiento, Opus 5 está disponible en Claude Max, donde es el modelo predeterminado, y en Claude Pro, donde figura como la opción más potente del menú. Si tenés suscripción a Claude Max, ya estás usando Opus 5 sin hacer nada. Si estás en Claude Pro, podés seleccionarlo manualmente. Sobre eso hablamos en la comparativa GPT vs Claude en 2026.
También está disponible para desarrolladores a través de la API, según detalla la página oficial de Opus.
La disponibilidad vía API es clave para la región. Muchos equipos ya tienen infraestructura en la nube y ahora pueden integrar Opus 5 sin salir de su ecosistema, manteniendo la latencia baja y los datos dentro de la misma región. Si necesitás hosting local para correr integraciones con la API, opciones como donweb.com tienen VPS y cloud con datacenters en la región que ayudan a mantener la latencia al mínimo sin pagar costos de tráfico internacional desmedidos.
Qué significa esto para equipos de desarrollo en Argentina y Latinoamérica
La mitad de precio comparado con el modelo de frontera anterior no es un dato abstracto. En un equipo argentino que factura en pesos y paga infraestructura en dólares, cada punto de eficiencia cuenta. Si venías usando Fable 5 o GPT-4o para tareas de código y el costo mensual te estaba complicando, Opus 5 te da la misma calidad —o mejor, en coding— por la mitad de lo que gastabas.
Además, el hecho de que Opus 5 sea el modelo predeterminado en Claude Max significa que no tenés que andar configurando nada: te suscribís y ya estás usando lo mejor que tiene Anthropic para tareas de desarrollo. Para equipos chicos o startups con cero ganas de hacer DevOps de modelos, esto simplifica bastante la operatoria.
La disponibilidad vía API también es clave. Muchos equipos de la región ya tienen infraestructura en la nube y ahora pueden integrar Opus 5 sin salir de su ecosistema. Lo único que necesitás es una conexión de baja latencia a los endpoints de API. Si estás armando integraciones desde cero, un VPS en la región te resuelve el problema de latencia sin depender de servicios externos.
Errores comunes al evaluar Claude Opus 5
Asumir que Opus 5 es mejor que Fable 5 en todo
Fable 5 sigue estando 0,5% arriba en esfuerzo máximo en ciertas evaluaciones de conocimiento. Ese 0,5% puede ser insignificante para el 99% de los casos de uso, pero si estás haciendo investigación de frontera donde cada punto porcentual cuenta —y tenés presupuesto para pagarlo—, Fable 5 sigue siendo la opción tope de gama. Opus 5 es el mejor modelo costo-rendimiento, no el mejor modelo absoluto en todas las métricas.
Usar siempre max effort “por las dudas”
Los effort settings existen por algo. Mandar todo en max effort gasta una cantidad innecesaria de tokens y te sale carísimo al pedo. La mayoría de las tareas productivas —generación de documentación, respuestas a consultas, análisis de texto estándar— funcionan perfecto en xhigh o incluso en high.
Compararlo con modelos no anunciados o filtrar datos viejos
Opus 5 se anunció en julio de 2026. Cualquier comparación con versiones de modelos de otras empresas que salieron hace seis meses ya es obsoleta —el campo se mueve rápido. Si vas a evaluar, hacelo con benchmarks frescos y en tus propios casos de uso, no con tablas comparativas de hace medio año.
Creer que reemplaza a Mythos 5 en seguridad
Anthropic fue explícita: Opus 5 está detrás de Mythos 5 en ciberseguridad. Si tu stack incluye tareas de análisis de vulnerabilidades, detección de intrusiones o cualquier cosa del palo de security, Mythos 5 sigue siendo el modelo a usar. Complementá con la comparativa OpenAI vs Anthropic.
Preguntas Frecuentes
¿Qué es Claude Opus 5?
Claude Opus 5 es el nuevo modelo de lenguaje estado-del-arte (SOTA) de Anthropic, recién lanzado. Ofrece inteligencia cercana a Claude Fable 5 a la mitad del precio, con rendimiento líder en tareas de programación, trabajo de conocimiento y resolución de problemas novedosos.
¿Cuánto cuesta Claude Opus 5?
Ofrece un costo similar al de Opus 4.8. Comparado con Fable 5, el costo por tarea es la mitad. Anthropic logró más que duplicar el rendimiento en benchmarks como SWE-bench manteniendo un costo comparable, según los datos oficiales.
¿En qué se diferencia de Opus 4.8?
La diferencia principal está en coding: Opus 5 más que duplica el rendimiento de Opus 4.8 en SWE-bench a un costo por tarea menor. En problemas novedosos, el puntaje de Opus 5 es muy superior —tres veces el del siguiente mejor modelo—, algo que Opus 4.8 directamente no podía hacer a ese nivel. Además incorpora los effort settings, que Opus 4.8 no tenía. Te puede servir nuestra cobertura de las ofertas de OpenAI y Anthropic.
¿Está disponible en Claude Pro?
Sí. Claude Opus 5 está disponible en Claude Pro como la opción más potente del menú. También es el modelo predeterminado en Claude Max, y se puede usar vía API.
¿Qué tareas puede hacer Claude Opus 5?
Opus 5 está optimizado para tres áreas: ingeniería de software (generación de código, debugging, code review), trabajo de conocimiento (análisis de documentos, extracción de datos, síntesis de informes) y resolución de problemas novedosos donde no hay datos de entrenamiento previos. En ciberseguridad, Mythos 5 sigue siendo superior.
¿Claude Opus 5 es mejor que Claude Fable 5?
Depende de la tarea. En coding, Opus 5 supera a Fable 5 en SWE-bench. En esfuerzo máximo para tareas de conocimiento, Fable 5 queda apenas 0,5% arriba, pero cuesta el doble. Para el 99% de los casos de uso, la diferencia es imperceptible y Opus 5 ofrece muchísima mejor relación costo-rendimiento.
¿Conviene migrar de Opus 4.8 a Opus 5 si ya tengo todo armado?
Sí, y con urgencia. El costo es similar, así que no hay desventaja económica. El rendimiento en coding se más que duplica. Y si ya estás en Claude Max, la migración ya ocurrió: Opus 5 es el modelo predeterminado desde su lanzamiento.
¿Qué tan bien funciona Claude Opus 5 en automatizaciones empresariales?
En Zapier AutomationBench, Opus 5 tiene una tasa de aprobación aproximadamente 1,5 veces superior a la del siguiente mejor modelo en tareas empresariales reales como procesar facturas, clasificar tickets o actualizar CRMs. Lo logra a un costo por tarea que es la mitad que Fable 5.
Conclusión
Anthropic sumó Opus 5 a su línea, un modelo que cambia la ecuación para equipos de desarrollo y profesionales que necesitan inteligencia de frontera sin fundir la tarjeta. Más que duplica el rendimiento de Opus 4.8 en coding, multiplica por tres al siguiente mejor modelo en problemas novedosos, supera por 1,5 veces al siguiente mejor modelo en automatizaciones empresariales, y cuesta la mitad que Fable 5 con una diferencia de apenas 0,5% en esfuerzo máximo.
Con la disponibilidad vía API y como modelo predeterminado en Claude Max, Opus 5 pasó de ser un anuncio a una herramienta lista para producción. La promesa de Anthropic —inteligencia de frontera a mitad de precio— tiene respaldo en benchmarks oficiales y en los primeros tests de usuarios que circularon por X durante la semana de lanzamiento.
Lo que cambió respecto a la semana anterior al lanzamiento: ya no necesitás pagar el premium de Fable 5 para acceder a inteligencia de punta en código y razonamiento. Opus 5 es el nuevo punto de partida lógico para cualquiera que use Claude a diario. Y si estás en Claude Max, ya lo tenés activado sin mover un dedo.
Lo que todavía falta: confirmación oficial de la ventana de contexto exacta, más benchmarks independientes en tareas de dominio específico (medicina, derecho, finanzas), y datos sobre disponibilidad en todas las regiones vía API. Anthropic tiene un track record sólido, pero conviene probarlo en tus propios casos de uso antes de migrar pipelines completos.
Si estabas por actualizar desde Opus 4.8, el momento es ahora. El costo es similar y la mejora es objetiva. Si venías usando Fable 5 por falta de alternativas, probá Opus 5 en xhigh y fijate si la diferencia de 0,5% justifica pagar el doble. En la mayoría de los casos, no.
Fuentes
- Anthropic — Anuncio oficial de Claude Opus 5: comunicado de prensa con benchmarks, precios y disponibilidad del modelo.
- Página oficial de Claude Opus: información de producto, planes y acceso a la API.
- Documentación técnica — Novedades de Opus 5: detalles sobre effort settings, rendimiento por nivel y casos de uso recomendados.
Cómo funciona
- Entrás por tu plan: si tenés Claude Max lo vas a encontrar activado por defecto; en Pro aparece como la opción de mayor potencia, y también podés llamarlo por API con el identificador
claude-opus-5. - Elegís cuánto tiene que “pensar”: el modelo razona de forma adaptativa (decide solo cuándo profundizar), pero podés ajustar el nivel de esfuerzo según la tarea, más liviano para respuestas rápidas y más alto para problemas de código o análisis complejos.
- Le pasás la consigna completa de una: rinde mejor cuando le das todo el contexto y el objetivo desde el primer mensaje, en lugar de ir aclarando de a poco. Así arma un plan y ejecuta tareas largas sin frenarse.
- Trabaja y se autoverifica: revisa su propio resultado sobre la marcha, encadena herramientas y llega hasta el final de la tarea antes de devolverte la respuesta.
- Recibís el trabajo terminado: te entrega el código, el documento o el análisis listo, con la calidad SOTA que Anthropic promete a la mitad del costo de Claude Fable 5.
Ejemplo práctico
El equipo de desarrollo de Nubalta, una fintech cordobesa de 8 personas, arrastraba un backlog de 34 bugs en su API de pagos escrita en Python. Venían usando Claude Fable 5 como asistente de coding, pero el costo mensual de API les había trepado a US$ 1.180 y el CFO ya pedía recortes. Cuando salió Claude Opus 5, la líder técnica, Sofía Peralta, decidió migrar el flujo de trabajo agéntico: conectaron el modelo a su repo vía la API y lo pusieron a resolver los tickets uno por uno, con los tests existentes como red de seguridad. En dos semanas cerraron 29 de los 34 bugs; los 5 restantes requerían decisiones de negocio, no de código. El detalle que más los sorprendió fue el gasto: al costar la mitad que Fable 5, la factura de esas dos semanas quedó en US$ 190.
Resultado: 29 bugs resueltos en 14 días (85% del backlog) con una caída del 68% en el costo de API mensual proyectado —de US$ 1.180 a unos US$ 380— gracias al liderazgo de Opus 5 en SWE-bench y a su precio a mitad de camino frente a Fable 5.
