Dos modelos de Anthropic, una diferencia de precio que decide tu presupuesto: Claude Opus 5 cuesta 5 dólares por millón de tokens de entrada, Claude Fable 5 cuesta 10. Un token es la unidad de texto que el modelo lee y escribe, y es sobre ella que se calcula tu factura. Fable 5 vale exactamente el doble, con una calidad de contexto idéntica. Así que la verdadera pregunta no es cuál de los dos es más inteligente, sino cuál merece que pagues por él para tus desarrolladores, tarea por tarea.
- 💰 Factura duplicada: Fable 5 cuesta 10/50 $ por millón, exactamente el doble que Opus 5.
- 🎯 Opus 5 por defecto: pensado para la codificación agéntica, absorbe la inmensa mayoría de las tareas.
- ⚡ La palanca oculta: bajar el nivel de esfuerzo de Opus 5 reduce la cuenta sin pérdida visible.
- 🧠 Fable 5 enfocado: resérvalo para los razonamientos más difíciles y las ejecuciones más largas.
Esta es la nota que le enviaría a un CEO que paga la factura, no al dev que programa. Sin benchmark técnico, sin curvas: costo, plazos, riesgo y un veredicto que puedes aplicar el lunes por la mañana.
La única cifra que debe guiar tu elección: el doble
Pongamos los precios lado a lado, porque todo parte de ahí. Opus 5 factura 5 dólares por millón de tokens de entrada y 25 de salida. Fable 5 sube a 10 de entrada y 50 de salida. Los dos modelos comparten la misma ventana de contexto de 1 millón de tokens (la cantidad de código y documentos que el modelo lee de una sola pasada, el equivalente a un repositorio muy grande) y el mismo límite de 128.000 tokens de salida. El recipiente es idéntico. Solo cambia el precio por litro.
A igual trabajo, elegir Fable 5 por defecto es duplicar tu factura de API sin ninguna garantía de duplicar el resultado entregado.
No es un detalle contable. El potencial económico de la IA generativa se cifra entre 2,6 y 4,4 billones de dólares al año según McKinsey, pero ese valor solo cae en tu bolsillo si controlas el costo unitario de cada tarea. Un modelo dos veces más caro que te aporta un 5 % de calidad percibida es un mal negocio dentro de un presupuesto de desarrollo.
¿Cuánto sale por desarrollador y por mes?
Tomemos una hipótesis baja y honesta: un desarrollador potenciado con IA que consume 50 millones de tokens de entrada y 5 millones de salida en un mes de misión activa. En Opus 5, la factura de API ronda los 375 dólares (250 de entrada, 125 de salida). En Fable 5, sube a 750 dólares. 375 dólares de diferencia por dev y por mes, mecánicamente, por el mismo volumen de trabajo.
Con un equipo de cinco desarrolladores, hablas de cerca de 1.900 dólares mensuales que se van en humo si conectas Fable 5 por reflejo. Es el sueldo de un becario, cada mes, a cambio de una ganancia que nada demuestra en el día a día de la programación.
| Modelo | Entrada ($/M tokens) | Salida ($/M tokens) | Costo relativo | Campo de acción |
|---|---|---|---|---|
| Opus 5 | 5 | 25 | x1 (referencia) | Codificación agéntica, trabajo de equipo cotidiano |
| Fable 5 | 10 | 50 | x2 | Razonamientos extremos, ejecuciones agénticas muy largas |
| Sonnet 5 | 3 | 15 | x0,6 | Tareas acotadas, volumen, rapidez |
| Haiku 4.5 | 1 | 5 | x0,2 | Clasificación, extracción, bucles simples |
FUENTE: tabla de precios de Anthropic · ACT. 07/2026
Mira la última columna: Opus 5 es la línea base, aquella en torno a la cual se posiciona todo lo demás. Fable 5 no es el modelo estándar pero más caro, es el modelo de gama alta. El matiz cuesta dinero.
Lo que el razonamiento permanente de Fable 5 te hace pagar
Ese precio doble no es arbitrario: compra razonamiento, y ahí es donde se cierra la trampa presupuestaria. El razonamiento es el tiempo que el modelo pasa «pensando» antes de responder, produciendo tokens intermedios que pagas a la tarifa de salida. Cuanto más piensa, más elaborada es la respuesta, más sube la cuenta y más tarda la respuesta.
En Fable 5, ese razonamiento está siempre activo y es imposible de desactivar. Pagas el modo de reflexión máxima en cada solicitud, incluso para reformatear un archivo o corregir una errata en el código. En las tareas difíciles, además, un turno puede durar varios minutos: muy bien para un problema de arquitectura, ruinoso para un bucle de corrección rápida en el que esperas para retomar el control.
Un nivel de esfuerzo, ¿qué significa en concreto?
Es el cursor que decide cuánto piensa el modelo antes de entregar. Opus 5 ofrece cinco escalones: low, medium, high, xhigh, max. Incluso puedes desactivar el razonamiento hasta el nivel «high». Traducido a lenguaje de negocio: ajustas el compromiso velocidad/costo/calidad tarea por tarea, en lugar de sufrirlo.
Es exactamente la palanca que Fable 5 te quita. Donde Opus 5 te deja bajar a un escalón bajo para una tarea simple y subir para un problema difícil, Fable 5 factura a plena potencia de forma permanente. Fíjate, de paso, en que Opus 5 dispone de un «fast mode» a 10/50 dólares, es decir, la tarifa de Fable 5: hay que activarlo solo cuando la velocidad prima de verdad sobre el costo.
Opus 5, el modelo de trabajo de tu equipo
Una vez con ese cursor en la mano, la elección por defecto se vuelve evidente. Anthropic posiciona explícitamente Opus 5 para la codificación agéntica compleja y el trabajo de empresa. La codificación agéntica es cuando el modelo planifica, escribe, prueba y corrige por sí solo a través de varios archivos, en lugar de escupir un fragmento de código aislado. Es precisamente lo que hace un desarrollador potenciado en una misión real.
El punto que cambia el cálculo: los niveles de esfuerzo bajos de Opus 5 (low y medium) son anormalmente eficaces. En concreto, buena parte del trabajo cotidiano funciona muy bien en un escalón bajo, a un costo reducido y con una latencia corta. Es tu principal palanca de ahorro, incluso antes de la elección del modelo.
Transparencia: yo facturo desarrolladores senior potenciados con IA, así que tengo interés en que estas herramientas cumplan sus promesas. También por eso miro la factura de API de cerca, no solo la demo. En julio de 2026, en las misiones que dirijo, pasar las tareas corrientes un escalón de esfuerzo hacia abajo redujo la cuenta de API casi a la mitad sin que la calidad entregada se moviera. El desperdicio no estaba en el modelo, estaba en el ajuste.
¿Por qué empezar en el nivel de esfuerzo más bajo?
Porque subir un escalón cuesta unos segundos, mientras que pagar el máximo por defecto cuesta todos los meses. Mi regla es simple: arranco con Opus 5 en esfuerzo bajo, y solo subo cuando la tarea se atasca de verdad. Un dev senior sabe reconocer ese momento, y ahí es donde ocho años de experiencia mínima sirven para algo. Si quieres el detalle de las tarifas de API y suscripciones, lo dejé en esta comparativa del pricing de Claude Code, y la cuestión de la velocidad real de un equipo se trata en esta guía sobre cómo medir la velocidad.
Cuándo pagar Fable 5 no es un desperdicio
Todo lo anterior presupone tareas normales. Cuando esa hipótesis cae, Fable 5 recupera su lugar. Es el modelo más capaz ampliamente disponible de Anthropic, y apunta a dos casos concretos: los razonamientos más exigentes y las tareas agénticas más largas, esas en las que una ejecución se sostiene durante decenas de minutos sin descarrilar. Migración pesada, rediseño de una arquitectura retorcida, problema algorítmico donde un fallo de Opus 5 te costaría más caro que el sobrecosto de la factura: ahí, pagar el doble se justifica.
Fable 5 también arrastra restricciones operativas que un CEO debe conocer antes de firmar. Tres puntos concretos.
Primero, Fable 5 impone una retención de datos de 30 días y no está disponible en modo cero retención. Después, ciertas solicitudes pueden ser rechazadas por sus clasificadores de seguridad, en particular sobre ciberseguridad y biología: una auditoría de código de seguridad puede acabar bloqueada. Por último, esos turnos de varios minutos rompen el bucle de retroalimentación corto del que vive un equipo que entrega rápido.
¿Hay que preocuparse por la retención de datos a 30 días?
Para la mayoría de los proyectos, no. Para un cliente regulado (salud, finanzas, defensa) que exige un modo cero retención por contrato, sí: Fable 5 queda entonces fuera de juego, y Opus 5 se vuelve no solo más barato sino la única opción conforme. Este tipo de restricción pesa más en el costo real de un proyecto que el precio por token, como detallo en este análisis del verdadero presupuesto de los agentes IA en producción.
Mi veredicto: Opus 5 a diario, Fable 5 con el contador en la mano
Recomendación clara, la que yo aplico. Opus 5 por defecto, en esfuerzo bajo, para toda la codificación agéntica del equipo. Subes un escalón cuando una tarea se resiste, y solo sacas Fable 5 en los problemas de razonamiento extremo o las ejecuciones muy largas, tratándolo como un gasto excepcional que se justifica línea por línea.
¿Cómo aplicar este veredicto desde el lunes?
El criterio de decisión cabe en una frase: si no puedes nombrar la tarea precisa que exige Fable 5, es que Opus 5 basta. Pagar el doble «por si acaso» no es prudencia, es desperdicio asumido. Pregúntale a tu lead dev en qué modelo y qué nivel de esfuerzo corren tus agentes hoy: si nadie sabe responder, probablemente estás pagando la tarifa máxima sin saberlo.
«Las empresas no quieren IA. Quieren entregar más rápido y gastar menos. El modelo más caro casi nunca es la respuesta a esa demanda.»
Vincent Roye, julio de 2026
Elegir un modelo no es comprar el más prestigioso, es industrializar una cadena de producción de software en torno al costo unitario correcto. La verdadera ventaja se juega en el ajuste y el pilotaje, no en la línea premium del catálogo. Para el ángulo puramente de negocio de este razonamiento (staffing, tarifa diaria, estructuración de equipo), el blog GoLive Software prolonga la reflexión desde el lado del desarrollo.
En Extra Dev, un desarrollador senior potenciado (ocho años de experiencia mínima) cuesta 180 euros al día todo incluido, y lo asigno a Opus 5 ajustado con precisión, no al modelo más caro por comodidad. Es esa disciplina, más que la elección del modelo, la que marca la diferencia en tu factura de fin de mes.
Preguntas frecuentes
¿Claude Opus 5 existe de verdad, o sigue siendo Opus 4.8?
Sí, Opus 5 existe con el identificador claude-opus-5, a 5 dólares por millón de tokens de entrada y 25 de salida, con una ventana de contexto de 1 millón de tokens. Algunas fuentes en línea, caducas, afirman lo contrario o siguen hablando de Opus 4.8 como el modelo vigente. Esas fuentes son falsas: fíate de la tabla de precios oficial de Anthropic.
¿Se puede desactivar el razonamiento en Fable 5 para pagar menos?
No. En Fable 5, el razonamiento está siempre activo y no puede desactivarse, y su cadena de razonamiento en bruto nunca se devuelve, solo un resumen. Únicamente Opus 5 te deja desactivar el razonamiento y elegir un nivel de esfuerzo más bajo. Es la principal razón por la que Opus 5 sale más barato en las tareas corrientes.
¿Fable 5 es dos veces más inteligente ya que cuesta el doble?
No, el precio no sigue el rendimiento de forma lineal. Fable 5 es el modelo más capaz ampliamente disponible de Anthropic, pero su plus se nota sobre todo en la parte alta del espectro: razonamientos extremos y tareas agénticas muy largas. En la codificación diaria, la diferencia de resultado no suele justificar el doble de costo.
¿Qué modelo elegir para un equipo pequeño con presupuesto ajustado?
Opus 5 en nivel de esfuerzo bajo como base, Sonnet 5 (3/15 dólares por millón) para las tareas acotadas de gran volumen, y Fable 5 únicamente como recurso puntual ante un problema realmente difícil. Esta combinación te da lo esencial de la capacidad sin la factura premium permanente. El ajuste del nivel de esfuerzo cuenta más que el nombre del modelo.
¿La ventana de contexto de 1 millón de tokens cambia el cálculo del costo?
Es idéntica en Opus 5 y Fable 5, así que no los diferencia. En cambio, cuanto más llenes ese contexto de código y documentos, más pagas de entrada, sea cual sea el modelo. El precio por token sigue siendo el verdadero factor diferenciador, y en ese terreno Opus 5 gana a igual volumen.


