Ir al contenido

El medio de los artesanos de la web sábado, 5 de septiembre de 2026

MailStudio
IA para la web

Fable 5.1: Anthropic reduce un 75 % el coste de las lecturas de caché

Anthropic publicó Fable 5.1 el 1 de septiembre de 2026 con un contexto de un millón de tokens y una rebaja del 75 % en las lecturas de caché. Para los equipos que ejecutan agentes en bucle, lo que cambia es el…

Couverture Fable 5.1 - baisse du coût des lectures de cache

Anthropic publicó Fable 5.1 el 1 de septiembre de 2026, junto a una variante de acceso restringido llamada Mythos 5.1. El modelo mantiene la tarifa base de Fable 5, pero reduce en tres cuartas partes el precio de las lecturas de caché. Para los equipos que ejecutan agentes en bucle, lo que cambia es el coste de cada ejecución, más que la puntuación en las pruebas de referencia.

Qué cambia el 1 de septiembre

Fable 5.1 llega con una ventana de contexto de un millón de tokens por defecto y una salida máxima de 128 000 tokens. El razonamiento adaptativo está siempre activo y el modelo está disponible de inmediato con el identificador claude-fable-5-1 en la API de Claude, Amazon Bedrock, Google Cloud y Microsoft Foundry. Fable 5.1 y Mythos 5.1 designan el mismo modelo subyacente: la primera es la versión de disponibilidad general, con las salvaguardas de producción, y la segunda queda abierta a organizaciones verificadas en ciberseguridad y ciencias de la vida.

El movimiento sigue la línea observada en toda la gama, donde la tarifa de lanzamiento de Claude Sonnet 5 se volvió permanente: Anthropic ajusta ya su lista de precios casi con la misma frecuencia que sus capacidades.

La caché, el nervio de la guerra de los agentes

Un agente que trabaja sobre una base de código, un expediente de cliente o un hilo de conversación largo relee en cada turno un contexto estable: instrucciones de sistema, definiciones de herramientas, archivos de referencia. Sin caché, ese contexto se factura al precio pleno de la entrada en cada llamada. El almacenamiento en caché del prompt memoriza esos bloques en el servidor y los reproduce a tarifa reducida, siempre que se marquen los segmentos reutilizables.

Es justamente esa partida la que Fable 5.1 aligera. La lectura de caché pasa de 1,00 $ a 0,25 $ por millón de tokens, es decir, 0,025 veces el precio de la entrada base. Anthropic cifra el efecto en torno al 25 % de ahorro en una carga habitual y hasta el 45 % en un uso agéntico, donde la parte releída domina la factura. La misma lógica ya recorría las experiencias sobre agentes editoriales en producción: el gasto no está en la generación, sino en la relectura.

curl https://api.anthropic.com/v1/messages \
  -H "x-api-key: $ANTHROPIC_API_KEY" \
  -H "anthropic-version: 2023-06-01" \
  -H "content-type: application/json" \
  -d '{
    "model": "claude-fable-5-1",
    "max_tokens": 1024,
    "system": [
      {
        "type": "text",
        "text": "Contexto estable: specs, herramientas, base de código...",
        "cache_control": { "type": "ephemeral" }
      }
    ],
    "messages": [
      { "role": "user", "content": "Pregunta del turno actual" }
    ]
  }'

El bloque marcado con cache_control se factura al precio de escritura en la primera llamada y luego como lectura (ahora 0,25 $ por millón) en cada turno posterior mientras no cambie. Cuanto más largo es el bucle y más pesado el contexto, más cuenta la rebaja.

Lo que dicen las cifras en bruto

La lista base no se mueve: la entrada sigue en 10 $ y la salida en 50 $ por millón de tokens. Solo se revisa la lectura de caché.

PartidaPrecio por millón de tokens
Entrada10 $
Salida50 $
Lectura de caché (Fable 5)1,00 $
Lectura de caché (Fable 5.1)0,25 $

En capacidad, Anthropic destaca una puntuación del 52,6 % en Terminal-Bench-Science 0.1, frente al 24,7 % de Fable 5 y el 29,0 % de Opus 5. La mejora anunciada es clara, pero se apoya en una prueba propia, orientada a resolver problemas científicos en la terminal.

ModeloTerminal-Bench-Science 0.1
Fable 524,7 %
Opus 529,0 %
Fable 5.152,6 %

En cargas agénticas, una lectura de caché a 0,25 $ por millón de tokens pesa más en la factura que un punto de referencia.

Punto de atención. La cifra del 52,6 % procede de una prueba publicada por el propio proveedor, y el razonamiento adaptativo siempre activo puede inflar el número de tokens de salida, facturados al precio pleno. El ahorro anunciado depende de la parte realmente almacenada en caché: medir sobre la carga de producción sigue siendo imprescindible antes de generalizar un modelo a toda una flota de agentes.

Lo que hay que recordar

Fable 5.1 no cambia el precio de entrada ni de salida; hace que releer el contexto sea cuatro veces más barato. Para un sitio de presentación que llama a un modelo de vez en cuando, el efecto es marginal. Para un equipo que explota agentes de contexto largo y muchos bucles, la rebaja desplaza el umbral de rentabilidad y vuelve viables arquitecturas hasta ahora demasiado costosas.

En mis propios pipelines de agentes, la lectura de caché ya representaba más de la mitad de la factura mensual, así que observo esta rebaja con un interés muy concreto. Aun así, desconfío del titular de ahorro «hasta el 45 %»: presupone una disciplina de caché que pocos equipos mantienen de verdad. Antes de migrar una flota entera, mido la tasa real de aciertos de caché durante una semana de tráfico; es ella la que decide, no la ficha del producto. — Simon Janvier

Para profundizar

Detalle de los modelos y de la tarifa en la fuente primaria: sala de prensa de Anthropic.

Compartir LinkedIn Bluesky Hacker News E-mail

Leer también