Fable 5 vs Sonnet 5: cuánto te cuesta realmente una diferencia de precio de 3x por token
La respuesta breve
Claude Fable 5 (lanzado el 9 de junio de 2026) es el modelo más capaz de Anthropic disponible de forma general, con un precio de $10 por millón de tokens de entrada y $50 por millón de tokens de salida. Sonnet 5 (lanzado el 30 de junio) tiene una tarifa introductoria de $2/$10 hasta el 31 de agosto, y luego su tarifa estándar $3/$15.
En precio de lista, Fable 5 es ~3.3–5x Sonnet 5 según la ventana. Esa diferencia es real y aparece incluso con prompts triviales —pero no cuenta toda la historia.
La prueba "Hello" y por qué es engañosa
Una comparación de costes que circuló ampliamente encontró que un único prompt "Hello" costaba más de 3x más en Fable 5 que en Sonnet 5 ($0.47 vs ~$0.15). El titular es fiel a la tarifa, pero enmarcarlo por tarea oculta lo que realmente impulsa el coste:
- Los tokens de salida dominan. Fable 5 devolvió ~80 tokens de salida en "Hello" frente a 141 de Sonnet —así que por token Fable era más caro, pero el coste bruto por prompt estuvo dominado por el contexto de la sesión, no por la respuesta de una palabra.
- El comportamiento de caché cambia el número real. Sonnet leyó muchos más tokens desde caché (las lecturas cacheadas son ~90% más baratas), por eso su factura fue menor incluso con más salida. Quien cachea mejor, gana —modelo a modelo.
- Un único "Hello" es un mal benchmark. Mide la tarifa, no la carga de trabajo. Lo que importa es la proporción, no los céntimos absolutos.
Dónde aparece realmente la brecha de coste
En tareas reales de programación el patrón se mantiene pero se complica, porque no es solo el precio de lista:
- Volumen de salida. El modelo de gama alta suele escribir más (comentarios más largos, más explicación). Más salida a 5x el precio de salida se compone rápido.
- Arranques lentos / peor caché. Si el modelo caro vuelve a leer el contexto en lugar de golpear la caché, cada turno subsiguiente es más caro.
- Bucles de agentes. En Claude Code, una "tarea" puede ser muchas llamadas al modelo. Una brecha de 3x por token se convierte en una brecha de 3x en cada llamada a herramientas dentro del bucle.
La regla práctica: la categoría del modelo domina al ajuste del prompt como palanca de coste. No puedes salvar una diferencia de 5x escribiendo un mejor prompt.
La trampa del tokenizador
Sonnet 5 lanzó un tokenizador actualizado que puede mapear la misma entrada a aproximadamente 1.0–1.35x más tokens, según el contenido. Esto importa cuando se migra entre modelos o se comparan totales de tokens entre dos modelos: prompts idénticos pueden facturar totales de tokens de entrada diferentes. Cualquier comparación de costes que no controle esto está comparando peras con manzanas.
Cuándo pagar por la clase Fable
El caso de Fable 5 es estrecho y caro:
- El trabajo autónomo de conocimiento más difícil / programación en horizontes largos, donde una sola ejecución de Fable reemplaza muchas ejecuciones más baratas.
- Problemas en los que bases de código de 50 millones de líneas o razonamiento de frontera realmente necesitan la capacidad extra.
- Cuando la eficiencia en tokens compensa la tarifa: Anthropic informa que Fable 5 hizo en un día lo que le llevó más de dos meses al equipo a mano, usando un tercio de los tokens de razonamiento en investigación de física de frontera.
Para la programación cotidiana —nuevas funciones, refactorizaciones, tests, depuración— el nivel Sonnet es la opción por defecto en relación coste/rendimiento. Esto concuerda con la evidencia de que Opus 5 se lanzó deliberadamente a la mitad del precio de Fable 5, posicionado como "similar a Fable 5 a ~la mitad del coste".
El único hábito que vale la pena adoptar
No confíes en el benchmark de nadie —incluido el de este artículo. La medida fiable es una comprobación de coste en sesión nueva con tu propia carga de trabajo:
- Elige 3–5 tareas representativas.
- Ejecuta cada una en una sesión nueva por modelo (para que la caché empiece fría).
- Registra el coste por sesión, tokens de salida y lecturas/escrituras de caché.
- Compara el coste por tarea, no el precio por token.
Importa que las sesiones estén con caché fría porque en cuanto dos modelos tienen historiales de caché distintos, sus números dejan de ser comparables.
Conclusión
Sonnet 5 es la opción sensata para la mayoría del trabajo de Claude Code; Fable 5 queda reservado para las tareas más difíciles y autónomas donde su eficiencia en tokens puede pagar la tarifa. Los equipos cuidadosos con el presupuesto deberían tratar la categoría del modelo, no la calidad del prompt, como la palanca de coste principal —y medir el coste en sesión nueva con sus propias tareas antes de decidir.
Fuentes primarias: Claude Fable pricing y la página de precios de Anthropic. Precios de modelos y fechas de lanzamiento verificados contra fuentes de Anthropic el 2026-08-07; las cifras de coste por sesión del artículo son medidas del autor secundario, no de Anthropic.