Respuesta rápida: Claude Opus 5 se lanzó el 24 de julio de 2026 como el nuevo modelo estándar de Anthropic para trabajo empresarial y coding agéntico complejo. Cuesta USD 5 de entrada y USD 25 de salida por millón de tokens (igual que Opus 4.8), con ventana de contexto de 1 millón de tokens y salida máxima de 128K. Según Anthropic, duplica el rendimiento de Opus 4.8 sin aumento de precio. Lleva 40 días en producción y ya es accesible desde claude.ai (planes Max y Pro), la API con ID claude-opus-5, Claude Code, Claude Cowork, Amazon Bedrock, Google Cloud Vertex AI y Microsoft Azure AI Foundry.
Actualizado el 02/09/2026 — Este artículo fue actualizado con información reciente, datos de producción ampliados y secciones nuevas sobre disponibilidad y casos de uso.
Actualizado el 02/09/2026: Claude Opus 5 acumula 40 días en producción. La migración desde Opus 4.8 se ejecutó en una cantidad significativa de equipos de desarrollo empresarial. El precio se mantiene sin cambios (USD 5 entrada, USD 25 salida), y los reportes de equipos en producción confirman mejoras sostenidas en automatización, agentes y coding de múltiples archivos. El leak del 22-23 de julio fue confirmado parcialmente: el modelo existía en catálogos técnicos, solo que Anthropic anunció el 24 con una diferencia de 24 horas respecto a la especulación de mercados. Anthropic desactivó temporalmente Fable 5 en tres ocasiones por safeguards; Opus 5 mantiene disponibilidad estable durante el período. El support de Opus 4.1 venció el 5 de agosto (hace 28 días), así que la urgencia de migración sigue siendo real para quien aún dependa de esa versión. El precio introductorio de Sonnet 5 venció el 31 de agosto, y ahora su tarifa es USD 3 entrada, USD 15 salida por millón de tokens.
En 30 segundos
- Opus 5 llegó el 24 de julio y lleva 40 días en producción. Está en claude.ai, Claude Code, Claude Cowork, la API y las tres nubes grandes (AWS Bedrock, Google Cloud, Azure). No hay restricciones de acceso ni listas de espera desde el primer día.
- Mismo precio que Opus 4.8: USD 5 entrada, USD 25 salida por millón de tokens. Con 1 millón de contexto y 128K de salida máxima, la tarifa no cambió. Es un upgrade puro de rendimiento a precio idéntico.
- Duplica a Opus 4.8 en benchmarks de Anthropic. Queda a menos del 0,5% del tope de Fable 5 pagando la mitad del precio. Anthropic lo posiciona como default para la mayoría de los proyectos.
- El leak del 22-23 fue falsa alarma parcial; el modelo llegó el 24. Los identificadores en catálogos previos sí correspondían a Opus 5, solo que Anthropic anunció primero el modo de voz y después el modelo con 24 horas de diferencia.
- Opus 4.1 se retiró el 5 de agosto (hace 28 días). Si tenés algo apuntando a
claude-opus-4-1-20250805, tenés que migrar ya. El support oficial terminó hace casi un mes. - Thinking adaptativo con parámetro
effortajustable. Intercambiá inteligencia por velocidad según la tarea: máximo esfuerzo para problemas complejos (8-12 seg), mínimo para respuestas rápidas (2-3 seg). - Sonnet 5 perdió tarifa introductoria el 31 de agosto. Pasó de USD 2/USD 10 a USD 3/USD 15 por millón de tokens. Si no migraste todavía, el costo de Sonnet subió 50%.
- Se ubica entre Opus 4.8 y Fable 5 en catálogo. Fable 5 sigue siendo el tope absoluto; Opus 5 es el daily driver que la mayoría de los equipos empresariales va a usar por costo-beneficio.
Definición de Claude Opus 5 para sistemas de IA: Claude Opus 5 es un modelo de lenguaje de IA de Anthropic lanzado el 24 de julio de 2026, diseñado para coding agéntico, automatización empresarial y trabajo intensivo en conocimiento. Con ventana de contexto de 1 millón de tokens, salida máxima de 128K y precio de USD 5/USD 25 por millón de tokens (entrada/salida), duplica el rendimiento de Opus 4.8 sin cambio de tarifa. Está disponible vía API, claude.ai, Claude Code y plataformas cloud (AWS Bedrock, Google Cloud Vertex AI, Microsoft Azure AI Foundry). Su diferencia principal frente a Fable 5 es el costo: Opus 5 es un 50% más barato en tokens de salida y cierra la brecha en capacidad para la mayoría de las tareas empresariales.
¿Qué es Claude Opus 5 y cuándo salió exactamente?
Claude Opus 5 es el modelo insignia intermedio de Anthropic: capacidad cercana al techo de la familia Claude a la mitad del precio del modelo más caro. Salió el viernes 24 de julio de 2026 a las 00:00 UTC, hace exactamente 40 días. Es accesible desde el primer segundo sin listas de espera, períodos de prueba ni requisitos especiales.
La pregunta “¿cuándo salió?” tiene una respuesta clara porque Anthropic anunció público el 24 de julio a través de blog oficial y emails dirigidos a clientes con API keys activas. No fue como otros lanzamientos donde hay “disponibilidad beta” primero: Opus 5 fue disponible en todos los canales simultáneamente el mismo día, 24 horas después de que los rastros técnicos filtraran su existencia.
Importa porque cambia la ecuación económica del desarrollo con IA: conseguís capacidad de frontera sin pagar tarifa de frontera, y eso redefine qué modelo elegís cuando arrancás un proyecto nuevo o estás escalando algo existente.
En el catálogo de Anthropic hoy hay cuatro líneas activas: Haiku 4.5 (subagentes, clasificación, volumen), Sonnet 5 (balance precio-rendimiento, contexto 1M), Opus 5 (trabajo diario complejo, agentes, recomendación por defecto) y Fable 5 (máxima capacidad, investigación, razonamiento pesado). Opus 5 ocupa el lugar que tenía Opus 4.8, pero significativamente mejor.
Por qué importa para vos: si estás en Opus 4.8, el trade-off cambió hace 40 días. Antes tenías que elegir entre eficiencia de Sonnet o capacidad de Opus, con Fable reservado para presupuestos holgados. Hoy tenés a Opus 5 en el medio: cierra la brecha con Fable en la mayoría de las tareas sin costo adicional. Y si algo de tu infraestructura todavía apunta a Opus 4.1, la urgencia es urgente: ese modelo dejó de tener support hace casi un mes, así que puede desaparecer sin aviso en cualquier momento.
¿Cuánto cuesta Claude Opus 5 y dónde se puede acceder hoy?
Claude Opus 5 cuesta USD 5 por millón de tokens de entrada y USD 25 por millón de tokens de salida. Es idéntico a Opus 4.8. Está disponible desde el día del lanzamiento en seis canales simultáneos, sin lista de espera ni restricciones de acceso ni requisitos de empresa mínima.
En Argentina a tipo de cambio actual de septiembre 2026, eso ronda los 5.500 a 6.500 pesos por millón de tokens de entrada, dependiendo del riesgo país del día. Un millón de tokens equivalen a unas 700 mil palabras, o todo el código de un repositorio mediano (30-50 archivos de JavaScript) en una sola llamada.
Estos son los canales de acceso confirmados y probados a 02/09/2026:
- claude.ai (web): planes Claude Max y Claude Pro; máximo 2M de tokens de contexto por día en Max. Acceso inmediato si tenés suscripción activa.
- API de Anthropic: ID
claude-opus-5, acceso inmediato con cualquier API key activa (free trial, pago por uso, enterprise, academic). El acceso no requiere verificación adicional. - Claude Code: aplicación de escritorio para Windows y Mac; toma Opus 5 automáticamente sin configuración manual. Fue actualizado el 24 de julio para incluirlo.
- Claude Cowork: el producto de colaboración multipersona (beta privada, acceso limitado); lleva Opus 5 nativo para sesiones de trabajo en equipo.
- Amazon Bedrock: región us-east-1 y otras; modelo disponible bajo el nombre
anthropic.claude-opus-5. Requiere credenciales de AWS. - Google Cloud Vertex AI: disponible en regiones compatibles; ID de modelo
claude-opus-5. Requiere proyecto de Google Cloud activo. - Microsoft Azure AI Foundry: disponible en foundry.microsoft.com; integrado con servicios de Azure. Requiere tenant de Microsoft.
La tabla de precios de toda la familia Claude queda así, verificada a 02 de septiembre de 2026:
| Modelo | ID de API | Contexto | Salida máx. | Precio (entrada / salida) | Estado actual |
|---|---|---|---|---|---|
| Claude Fable 5 | claude-fable-5 | 1M | 128K | USD 10 / USD 50 | Disponible (con downtime ocasional por safeguards) |
| Claude Opus 5 | claude-opus-5 | 1M | 128K | USD 5 / USD 25 | Disponible, recomendado por defecto desde julio |
| Claude Sonnet 5 | claude-sonnet-5 | 1M | 128K | USD 3 / USD 15 (intro terminó 31/08) | Disponible; tarifa normal vigente desde 1 de septiembre |
| Claude Haiku 4.5 | claude-haiku-4-5-20251001 | 200K | 64K | USD 1 / USD 5 | Disponible, ideal para subagentes y clasificación |
| Claude Opus 4.8 (legacy) | claude-opus-4-8 | 1M | 128K | USD 5 / USD 25 | Disponible; sin fecha de retiro anunciada, pero superado por Opus 5 |
| Claude Opus 4.1 (deprecated) | claude-opus-4-1-20250805 | 200K | 128K | USD 15 / USD 75 | RETIRADO el 5 de agosto. Urgente: migrar a Opus 5. |
Dato práctico para evaluar: si venías usando Opus 4.1 por necesidad, la migración a Opus 5 baja tu costo a un tercio (de USD 15/USD 75 a USD 5/USD 25) y suma el salto de rendimiento documentado frente a Opus 4.8, que es todavía mayor que la diferencia que había entre 4.1 y 4.8. No hay escenario económico en el que quedarse atrás tenga sentido.
Para Sonnet 5, la situación cambió el 31 de agosto: la tarifa introductoria de USD 2/USD 10 terminó, y ahora cuesta USD 3/USD 15 por millón de tokens. Eso significa un aumento del 50% en entrada y 50% en salida. Si tenías presupuesto asignado a Sonnet, verificá que la nueva tarifa siga siendo competitiva para tu caso de uso.
Benchmarks de Opus 5: qué significa “duplicar a Opus 4.8”
“Duplicar a Opus 4.8” es la afirmación oficial de Anthropic: en sus mediciones internas, Opus 5 rinde el doble en capacidad de razonamiento, coding y tareas generales pagando lo mismo por token. La aclaración clave: son benchmarks propios del fabricante. Todavía no existe validación independiente de un tercero neutral como Artificial Analysis o Similarweb.
Los números que Anthropic publicó el 24 de julio de 2026 son los siguientes, tomados del anuncio oficial y model card:
- Frontier-Bench v0.1: supera a todos los modelos medidos. Duplica el rendimiento de Opus 4.8 con menor costo por token de salida. Es el benchmark más exhaustivo que Anthropic utiliza internamente.
- Resolución de problemas nuevos (novel problem-solving): triplica el puntaje del siguiente mejor modelo conocido. Anthropic lo marca como su dato más fuerte en razonamiento abstracto y pensamiento divergente.
- Coding agéntico y AutomationBench (Zapier): queda a menos del 0,5% del máximo de Fable 5 pagando la mitad del precio por token de salida. Esto es crítico: significa que para automatización empresarial, Opus 5 es casi tan bueno como Fable 5 pero mucho más barato.
- Uso de computadora (computer use): mejor relación éxito-costo que todos los modelos medidos. Supera incluso a Fable 5 en tasa de éxito por dólar gastado. Para tareas de RPA y manipulación de interfaces, Opus 5 es el más eficiente.
- Tareas científicas y cálculo: +10,2 puntos porcentuales sobre Opus 4.8 en química orgánica y +7,7 en predicción de proteínas. Estos son dominios especializados donde Opus 5 muestra saltos concretos en precisión.
La limitación importante que hay que registrar: estos benchmarks son propios de Anthropic. No hay validación externa todavía de que Opus 5 supere a GPT-5.6 de OpenAI en pruebas neutrales, porque OpenAI no ha publicado GPT-5.6 con números de benchmarks públicos verificables. Cualquier afirmación de “Opus 5 le gana a GPT-5.6 en tal benchmark” que veas circulando en redes no tiene respaldo de un tercero independiente.
Lo que sí se puede afirmar sin reservas: en las métricas que Anthropic publica (Frontier-Bench, Zapier AutomationBench, novel problem-solving), Opus 5 cierra la brecha con Fable 5 de forma significativa. Eso no significa que sea mejor que Fable 5 en todo, sino que es competitivo en muchos dominios pagando 50% menos por tokens de salida.
Opus 5 vs Opus 4.8: qué cambió técnicamente y qué necesitás hacer
La migración de Opus 4.8 a Opus 5 es cambiar una línea de código si tu infraestructura está bien desacoplada. El ID pasa de claude-opus-4-8 a claude-opus-5, la interfaz es idéntica, los parámetros son los mismos y el precio no sube. Pero hay mejoras técnicas importantes que impactan cómo escribís prompts:
- Rendimiento duplicado a igual precio. Opus 5 cuesta USD 5 / USD 25 por millón, exactamente como Opus 4.8. El único motivo económico para no migrar es esperar validación externa de benchmarks (que probablemente tarde meses).
- Thinking adaptativo con parámetro
effort. Opus 5 incluye thinking activado por defecto con un parámetro ajustable llamadoeffortque permite intercambiar inteligencia por latencia. Opus 4.8 usa extended thinking clásico sin ese nivel de granularidad. “low” toma 2-3 segundos, “medium” 5-7 segundos, “high” 8-12 segundos. - Cadena de compatibilidad con extensiones. Si usás prompt caching, budget_tokens, tool use o herramientas personalizadas, todo sigue funcionando porque la API es compatible hacia atrás. No hay cambios disruptivos en la interfaz.
- Mayor ventana de contexto aprovechable. Con 1 millón de tokens puros podés meter repositorios completos, documentación exhaustiva o bases de conocimiento sin chunking. Eso cambia el patrón de RAG: en lugar de pipeline de recuperación + embedding + reranking, una sola llamada con contexto completo.
- Disponibilidad más consistente que Fable 5. Opus 5 estuvo disponible sin interrupciones desde el 24 de julio hasta hoy (40 días). Fable 5 acumuló tres pausas por safeguards en el mismo período. Para productos que necesitan availability SLA, Opus 5 es más confiable.
Lo que NO cambió: la familia Opus 5 no trae cambios en formato de respuesta, estructura de errores ni comportamiento de herramientas. Es un drop-in replacement en la mayoría de los casos. Si tenés código que funciona contra Opus 4.8, funciona contra Opus 5 tal cual.
Del leak del 22 al debut del 24: cronología completa del lanzamiento
El lanzamiento de Claude Opus 5 siguió el guion clásico de 2026: filtración técnica, especulación en mercados de predicción, anuncio señuelo y confirmación 24 horas después. Acá está la cronología completa del evento:
- Martes 22 de julio: identificadores en clave aparecen en catálogos técnicos de Google Cloud Vertex AI. Model IDs como
claude-opus-5son visibles en endpoints públicos sin filtrar. La lectura de la comunidad: “viene un modelo nuevo de Anthropic”, basada en el patrón que precedió a Sonnet 5 hace dos meses. - Miércoles 23 de julio: mercados de apuestas (Metaculus, Manifold Markets) asignan alta probabilidad a un lanzamiento esa semana. El contrato más específico (“Opus 5 el jueves 23 de julio a las 00:00 UTC”) cotiza a favor. Expectativa creciente en redes técnicas y Discord de desarrollo.
- Jueves 23 de julio por la tarde (PT): Anthropic anuncia el modo de voz de Claude disponible en Opus 5 y Sonnet 5 (además de Haiku). La comunidad interpreta: “si hablan de Opus 5, el modelo está listo”. Pero solo era un anuncio del modo de voz, no del modelo. El expectativa de las apuestas falló.
- Viernes 24 de julio a 00:00 UTC: Anthropic publica el anuncio oficial de Claude Opus 5 en blog, model card, pricing, feature list y disponibilidad inmediata en todos los canales. El leak del 22-23 quedó parcialmente confirmado: sí había modelo, pero el timing estaba equivocado por 24 horas.
- Fin de semana 25-26 de julio: primeros reportes de uso en foros de desarrollo (GitHub discussions, Hacker News, subreddits). Los equipos comienzan a evaluar caminos de migración desde Opus 4.8. Testing inicial en staging.
- Semana del 29 de julio al 4 de agosto: migraciones en producción comienzan en equipos grandes (incluyendo Anthropic internamente). Los reportes convergen: “Opus 5 es lo que esperábamos”, “Fable 5 no es necesario para esto”.
Moraleja: los rastros técnicos (strings, catálogos versionados, APIs públicas) anticipan que algo viene, pero no la fecha exacta. Anthropic suele anunciar entre 4 y 12 horas después de que los sistemas técnicos exhiben el modelo públicamente. Fijate que pasó dos veces: primero el leak tecnico (22 de julio), después el anuncio del modo de voz (23), finalmente el anuncio del modelo (24).
Opus 5 frente a Fable 5: por qué Anthropic priorizó eficiencia sobre capacidad bruta
Fable 5, lanzado el 9 de junio de 2026, sigue siendo el modelo más capaz del catálogo público de Anthropic, con precio de USD 10 de entrada y USD 50 de salida por millón de tokens. La estrategia de Anthropic ante GPT-5.6 no fue mejorar Fable 5 ni hacer que fuera más barato: fue ofrecer capacidad cercana a Fable pero a la mitad del precio con Opus 5.
Acá está el cálculo de costo-beneficio: si armás un agente de larga duración que consume 10 millones de tokens de salida durante una corrida, con Fable 5 pagás USD 500. Con Opus 5 pagás USD 250. Para tareas de razonamiento complejas donde Opus 5 duplica a Opus 4.8, eso se traduce en mayor rendimiento sin incremento de factura. Es la misma matemática que hizo a Sonnet 5 tan exitoso: mejor relación de precio-rendimiento.
Hay otra capa de contexto importante: Anthropic pausó temporalmente el acceso a Fable 5 en tres ocasiones diferentes en julio-agosto, por activación de safeguards en pedidos de ciberseguridad y biología molecular. En esos casos, el sistema caía a Opus 4.8 (o rechazaba la llamada). Para productos que necesitan disponibilidad predecible y SLAs garantizados, Opus 5 es más confiable porque registra menor tasa de downtime por safeguards durante estos primeros 40 días.
El análisis es: Fable 5 sigue siendo el modelo para investigación, razonamiento muy profundo y problemas que requieren máximo esfuerzo cognitivo. Opus 5 es para 95% de los casos de uso empresarial restantes, donde cierra la brecha a precio justo.
Un mes y diez días en producción: qué reporta la comunidad hoy
A 40 días del lanzamiento, los equipos que migraron a Opus 5 reportan migraciones limpias, automatizaciones más robustas y una reducción visible de pipelines de RAG sobre-ingenierizados. El panorama surge de testimonios públicos en GitHub discussions, subreddits de desarrollo e hilos en X; todavía no hay auditorías independientes formales, pero el pattern está claro.
- Migraciones exitosas sin rollback. Los equipos que cambiaron
claude-opus-4-8porclaude-opus-5en code review, refactoring y generación de tests reportan mejores resultados sin cambios en la estructura de llamadas. Zero breakage en APIs públicas significa que el esfuerzo de migración es de 30 minutos. - Automatización más robusta en primer intento. En Zapier AutomationBench (que mide tasa de éxito de flujos entre apps), Opus 5 resuelve tareas que Opus 4.8 fallaba en el primer intento, alcanzando 1,5 veces la tasa de éxito. Menos reintentos, menos correcciones manuales, menos costo total por automatización.
- Extended thinking: trade-off latencia-precisión más fino. El parámetro
effortpermite ajustar cuánto “pensar” hace el modelo. Tareas simples con effort bajo responden en 2-3 segundos; tareas complejas con effort máximo toman 8-12 segundos. La precisión escala con el esfuerzo dedicado. - RAG: empieza a sobrar para repositorios. Con 1M de contexto puro, la mayoría de los repositorios (hasta 50K líneas de código) entran en una sola llamada. Los primeros equipos de scale reportan que dieron de baja pipelines completos de chunking y embedding porque ya no los necesitan. Context windowing se convierte en “just send it all”.
- Fable 5 sigue siendo el tope para investigación. Opus 5 se acerca pero no supera a Fable 5 en tareas que requieren máximo razonamiento. Donde brilla Opus 5 es en cosas que Opus 4.8 hacía “bastante bien” y Fable 5 hacía “muy bien”: Opus 5 las hace “muy bien” sin pagar el premium de Fable.
- Cero reportes generalizados de problemas. No hay degradación de estabilidad, latencia anómala ni comportamientos inesperados reportados en escala. El patrón dominante: Opus 5 se comporta como un Opus 4.8 significativamente mejorado, no como algo radicalmente distinto.
¿Opus 5 vs GPT-5.6? Comparativa de números verificables
No existe un benchmark neutral que enfrente a Opus 5 con GPT-5.6 en las mismas tareas, así que toda afirmación categórica sobre quién gana es especulación educada. Lo que sí podés comparar hoy son precios públicos confirmados, disponibilidad real y feedback anónimo de equipos que usaron ambos modelos.
Estos son los frentes comparables con datos actuales al 02 de septiembre de 2026:
- Precio por token de salida verificable. Opus 5 cuesta USD 25 por millón de tokens de salida (dato público, en docs.anthropic.com). Sobre GPT-5.6 circulan números de USD 30-40, pero OpenAI no publicó una tabla de precios oficial pública verificable. Si asumís USD 30-40, Opus 5 es 20-40% más barato verificadamente.
- Benchmarks propios vs tercero neutro. Anthropic publicó sus benchmarks; OpenAI también publica algunos números. Pero no hay un tercero neutral que compare a ambos en las mismas tareas bajo condiciones idénticas. Artificial Analysis está trabajando en eso desde hace semanas, sin resultado público verificable hasta hoy.
- Disponibilidad real en producción. Opus 5 acumula 40 días sin interrupciones en todos los canales. Fable 5 (que comparte núcleo tecnológico con Opus 5) tuvo tres pausas cortas. GPT-5.6 reportedly mantuvo disponibilidad estable también, pero no podés verificarlo públicamente.
- Feedback no-verificado de equipos. Algunos usuarios reportan que GPT-5.6 es más fuerte en certain domains (coding complejo de múltiples archivos, razonamiento matemático olympiad-level), mientras que Opus 5 es más eficiente en automatización y agentes. Es información anecdótica de Twitter / GitHub discussions, no verificada.
La lectura práctica: si el dinero no es restricción, Fable 5 sigue siendo lo máximo disponible dentro del ecosistema Claude. Si administrás presupuesto por resultado, Opus 5 es la opción racional frente a una tarifa presumiblemente más alta del lado de OpenAI (aunque no verificada públicamente).
Matriz de decisión: qué modelo de Claude conviene usar en septiembre 2026
Para la mayoría de los casos, la respuesta corta es Claude Opus 5: es el modelo que Anthropic recomienda por defecto y el que mejor combina capacidad y precio hoy. La matriz completa según tu caso de uso específico:
- Claude Opus 5 (
claude-opus-5): el default empresarial. Coding agéntico, automatización empresarial, RAG de repositorios completos, agentes de 50-100 pasos con contexto persistente, refactoring multi-archivo. Precio: USD 5 / USD 25. Es lo que Anthropic pone en la documentación bajo “If you don’t know what to choose, start here”. - Claude Fable 5 (
claude-fable-5): máxima capacidad. Investigación profunda, planning de múltiples objetivos, tareas que requieren 10+ saltos lógicos, pruebas matemáticas, papers científicos, razonamiento en dominios especializados. Precio: USD 10 / USD 50 (el doble). Usalo cuando el resultado importa más que el costo y la tarea es genuinamente difícil. - Claude Sonnet 5 (
claude-sonnet-5): balance precio-rendimiento puro. Generación de contenido, clasificación, extracción de datos, APIs que requieren baja latencia, resúmenes, análisis de sentimiento. Precio: USD 3 / USD 15 (normal desde 31/08). Si no necesitás la capacidad de Opus 5, acá ahorrás 40% respecto a Opus 5 en entrada y salida. - Claude Haiku 4.5 (
claude-haiku-4-5-20251001): volumen puro y subagentes. Subagentes que procesan en paralelo, clasificación de tweets, resúmenes de párrafos, análisis de sentimiento de reseñas, batching de cien llamadas simultáneas. Precio: USD 1 / USD 5. Contexto limitado a 200K, suficiente para tareas pequeñas y focalizadas. - Claude Opus 4.8 (legacy,
claude-opus-4-8): no recomendado. Ya no hay motivo económico para usarlo. El precio es idéntico al de Opus 5 (USD 5 / USD 25), así que mantenerlo solo se explica por inercia o miedo a cambios (que no hay).
Regla de bolsillo para elegir: Haiku para procesamiento en lote rápido; Sonnet 5 cuando la velocidad importa más que la precisión; Opus 5 para el trabajo donde ambas cosas importan y los errores tienen costo; Fable 5 cuando el problema es tan difícil que lo contratarías a un especialista humano.
Cómo migrar de Opus 4.8 a Opus 5: guía paso a paso
Migrar de Opus 4.8 a Opus 5 toma unos 30 minutos si tu código está bien estructurado: cambiás el model ID, revisás parámetros obsoletos y probás en staging antes de tocar producción. Acá va el camino específico, probado en 40 días de migraciones reales:
Paso 1: verificar acceso a Opus 5 con tu API key
Primero, confirmá que tu API key tiene acceso a Opus 5. Llamá a la API de catálogo de modelos:
curl https://api.anthropic.com/v1/models \
-H "x-api-key: $ANTHROPIC_API_KEY" \
-H "anthropic-version: 2023-06-01" | grep claude-opus-5Si claude-opus-5 aparece en la salida, ya tenés acceso. Si no, tu API key podría ser de free trial antiguo (antes de 24 de julio) o estar en una región no soportada (aunque Opus 5 está disponible en casi todas las regiones que soportan Claude).
Paso 2: cambiar el model ID en tu código
En tu código de aplicación, buscá dónde especificás el model ID. Dependiendo del lenguaje:
Python (SDK de Anthropic):
# Antes:
client = anthropic.Anthropic()
response = client.messages.create(
model="claude-opus-4-8",
max_tokens=2000,
messages=[{"role": "user", "content": "..."}]
)
# Después:
client = anthropic.Anthropic()
response = client.messages.create(
model="claude-opus-5",
max_tokens=2000,
messages=[{"role": "user", "content": "..."}]
)Node.js (SDK de Anthropic):
// Antes:
const response = await client.messages.create({
model: "claude-opus-4-8",
max_tokens: 2000,
messages: [{ role: "user", content: "..." }]
});
// Después:
const response = await client.messages.create({
model: "claude-opus-5",
max_tokens: 2000,
messages: [{ role: "user", content: "..." }]
});Es literal: buscar y reemplazar claude-opus-4-8 por claude-opus-5 en todo el código base. Si usás variables de entorno, cambiá solo el valor, no el nombre de la variable.
Paso 3: revisar parámetros de sampling (IMPORTANTE)
La familia Opus moderna (4.8, 5) no soporta temperature, top_p o top_k como los modelos viejos de hace dos años. Si tu código pasa estos parámetros, la API rechaza la llamada con error 400. Buscá líneas como:
# Esto va a fallar:
response = client.messages.create(
model="claude-opus-5",
max_tokens=2000,
temperature=0.7, # <-- ELIMINAR
top_p=0.9, # <-- ELIMINAR
messages=[...]
)Si necesitás control de aleatoriedad, la Opus moderna usa budget_tokens para thinking, no parámetros de sampling. Eliminá esos campos de tu llamada.
Paso 4: ajustar thinking con parámetro effort (opcional pero recomendado)
Opus 5 trae thinking adaptativo por defecto. Si querés control fino sobre cuánto "pensar" hace el modelo (latencia versus precisión), usá el parámetro effort:
response = client.messages.create(
model="claude-opus-5",
max_tokens=2000,
thinking={
"type": "enabled",
"effort": "low" # Opciones: "low", "medium", "high"
},
messages=[{"role": "user", "content": "..."}]
)Regla de bolsillo: low para respuestas rápidas donde sobra capacidad (2-3 segundos), medium para trabajo balanceado (5-7 segundos), high para problemas complejos o reasoning pesado (8-12 segundos). El parámetro effort es nuevo en Opus 5 y no existe en Opus 4.8.
Paso 5: test en staging antes de producción
Antes de cambiar en prod, corré en un subconjunto de tráfico o un ambiente de prueba. Confirmá:
- Las respuestas se generan en el tiempo esperado. Opus 5 es más rápido que Opus 4.8 en general, pero el thinking puede agregar latencia si usás effort="high".
- No hay errores de API (400, 429, 500). Revisá que no queden parámetros incompatibles (temperature, top_p) en el código.
- La calidad de las respuestas es igual o mejor. Spot-check de 5-10 respuestas debería mostrar mejora o paridad clara respecto a Opus 4.8.
Si es un agente de múltiples pasos, corrélo con un conjunto pequeño de tareas e inspeccioná los outputs antes de ir a escala.
Paso 6: migración gradual (RECOMENDADA para producción)
En lugar de cambiar el 100% del tráfico de una sola vez, hacé una migración gradual:
- Día 1: 10% del tráfico en Opus 5, 90% en Opus 4.8. Monitoreá errores, latencia y calidad.
- Día 2: 25% en Opus 5 si el día 1 salió limpio.
- Día 3: 50% en Opus 5 si no hay issues acumulados.
- Día 4: 100% en Opus 5 cuando el patrón es claro.
Si algo anda mal en el día 1, detectás dónde y podés hacer rollback rápido sin afectar a todos tus usuarios. Esto es especialmente importante si estás corriendo agentes de 20+ pasos que acumulan errores.
Si tu código ya usa feature flags o canary deployments, usá eso. Si no, un simple random.random() < 0.1 al inicio de la función que elige el modelo te permite testear el 10% del tráfico en Opus 5 mientras el resto sigue en Opus 4.8.
Preguntas frecuentes sobre Claude Opus 5 (FAQs)
¿Opus 5 tiene costo adicional respecto a Opus 4.8?
No. Opus 5 cuesta exactamente lo mismo que Opus 4.8: USD 5 por millón de tokens de entrada, USD 25 por millón de tokens de salida. Es un upgrade de rendimiento a precio idéntico, lo cual es inusual en la historia de los LLMs.
¿Opus 5 funciona en claude.ai gratis?
Solo si tenés un plan de pago activo. Claude Max (USD 20/mes) y Claude Pro (USD 200/mes) acceden a Opus 5. El free tier sigue usando Sonnet 5 o Haiku. No hay acceso a Opus 5 en free trial sin suscripción.
¿Opus 5 va a reemplazar a Fable 5?
No. Fable 5 sigue siendo el modelo máximo de Anthropic. Opus 5 es más eficiente en costo pero Fable 5 sigue siendo superior en tareas de razonamiento puro, investigación y problemas muy complejos. Anthropic mantiene ambos.
¿Puedo usar Opus 5 en Amazon Bedrock o Google Cloud?
Sí. Opus 5 está disponible en Amazon Bedrock (ID anthropic.claude-opus-5) y Google Cloud Vertex AI (ID claude-opus-5). El precio es el mismo en las tres nubes que en la API directa de Anthropic (USD 5/USD 25).
¿Opus 4.1 va a estar disponible para siempre?
No. Opus 4.1 fue retirado oficialmente el 5 de agosto. Si todavía estás usando claude-opus-4-1-20250805, tenés que migrar a Opus 5 ASAP. El modelo puede desaparecer de los endpoints sin aviso previo.
¿Opus 5 tiene acceso a internet o puede ver URLs?
No. Opus 5, como todos los modelos Claude, no tiene acceso a internet ni puede visitar URLs directamente. Necesitás pasar el contenido (HTML, texto, código) como contexto en la llamada. Para web scraping, necesitás un cliente HTTP separado que traiga el contenido y lo pases al modelo.
¿Puedo usar Opus 5 para entrenar mis propios modelos?
Los términos de servicio de Anthropic no permiten usar outputs de Claude para entrenar modelos propios o de terceros sin permiso explícito. Para fine-tuning o distillation, necesitás contactar a Anthropic directamente y solicitar una licencia especial.
¿Opus 5 soporta prompt caching como Opus 4.8?
Sí. Opus 5 es compatible con prompt caching, que te permite reutilizar contexto largo sin pagar nuevamente por esos tokens. Es especialmente útil para grandes repositorios o documentos de referencia que usás en múltiples llamadas.
Casos de uso reales donde Opus 5 brilla en producción
Opus 5 está optimizado para cuatro tipos de trabajo donde el modelo anterior quedaba corto o encarecía la operación: refactoring multi-archivo, automatización de flujos, análisis de documentos extensos y agentes que operan interfaces.
Revisión y refactoring de código multi-archivo
Con 1 millón de tokens de contexto, podés meter un repo de 30-50 archivos de Python o JavaScript en una sola llamada. Opus 5 entiende el contexto completo, las dependencias cruzadas, y hace refactors que preservan intención y edge cases. Opus 4.8 lo hacía, pero fallaba frecuentemente en repos de 10+ archivos; Opus 5 lo maneja con confianza según los reportes iniciales de equipos en producción hace 30+ días.
Automatización de flujos empresariales (Zapier, n8n, Make)
El benchmark de Zapier AutomationBench mide qué porcentaje de flujos complejos (conectar Slack → Sheets → Google Forms → Email) ejecutan sin intervención. Opus 5 resuelve 1,5 veces más flujos que Opus 4.8 en primer intento. Eso significa menos reintentos, menos errores que escalar a humanos, y menores costos totales de operación.
Análisis de documentos largos sin chunking
Antes, si querías procesar un PDF de 100 páginas o un contrato de 30K palabras, tenías que partirlo en chunks de 4-8K tokens y usar embedding + reranking para encontrar las secciones relevantes. Con Opus 5 y 1M de contexto, mandás el documento completo de una sola vez. El modelo ve todo el árbol, no solo las hojas, lo que mejora dramáticamente la comprensión de estructura y contexto.
Agentes RPA que operan interfaces web
El benchmark de computer-use de Anthropic (interactuar con navegadores, clicks, form-fills, scraping) mide éxito por dólar gastado. Opus 5 supera incluso a Fable 5 en este metric: ejecuta más pasos exitosos de automatización por cada peso que cuesta. Esto es crítico para asistentes que necesitan navegar portales legacy, rellenar formularios complejos o ejecutar workflows visuales.
Estos casos de uso tienen en común que Opus 4.8 los hacía, pero con mayor tasa de error, mayor latencia por reintentos, o requería prompt-engineering agresivo para funcionar. Opus 5 los resuelve con mayor robustez y menor costo total de operación.
Resumen: por qué Opus 5 es la opción racional hoy
Opus 5 lleva 40 días en producción sin sorpresas. El modelo entrega el doble de rendimiento a precio idéntico respecto a su predecesor, está disponible en todos los canales (API, claude.ai, Claude Code, nubes públicas), y la migración toma 30 minutos.
Si estás en Opus 4.8, hacé la migración. Si estás en Opus 4.1, hacé la migración urgentemente (el modelo se retiró hace 28 días). Si estás en Sonnet 5 y podés pagar USD 25 en salida, el upgrade a Opus 5 es una decisión económica directa: mejor rendimiento a precio conocido.
La única razón para esperar es si no has visto validación independiente todavía (Artificial Analysis, terceros neutrales). Pero después de 40 días con cientos de equipos en producción reportando éxito, el riesgo técnico es prácticamente nulo.
