Passa al contenuto principale

Claude Fable 5.1: cosa è cambiato e come migrare

Intermedio

Il 1° settembre 2026 Anthropic ha rilasciato Claude Fable 5.1 (claude-fable-5-1) e il suo gemello riservato a Glasswing Claude Mythos 5.1 (claude-mythos-5-1). Se scorri il lancio di fretta lo archivierai come "Fable, ma meglio" e andrai avanti. Non farlo. È il primo point release di Claude in cui un semplice cambio di ID modello può restituire 400 in produzione: il tool_choice forzato è sparito, i blocchi di thinking sono ora legati al modello e alla conversazione che li ha prodotti, e modificare la cronologia della conversazione è applicato come errore per i nuovi account. È anche il primo rilascio in cui la riga più economica della tabella dei prezzi è quella interessante: le letture da cache sono scese da 1 $ a 0,25 $ per MTok, ed è per questo che Anthropic può affermare che i carichi di lavoro tipici costano circa il 25% in meno e quelli fortemente agentici fino al 45% in meno a un listino invariato di 10 $ / 50 $.

Questa pagina è la guida di migrazione sul campo: cosa è cambiato, cosa si rompe, cosa ottieni e una checklist che puoi eseguire in un pomeriggio.

What you'll learn
  • Conoscere i tre breaking change che trasformano uno swap claude-fable-5 → claude-fable-5-1 in un 400, e il rimedio per ciascuno
  • Usare le cinque funzionalità additive: effort per messaggio, messaggi di sistema a scope di turno, aggiornamenti di progresso, letture da cache più economiche, provenienza dei contenuti
  • Riconoscere i sette cambiamenti di comportamento che emergono senza modifiche al codice (meno chiamate di tool parallele, meno narrazione, prosa più densa, riscritture di interi file)
  • Leggere i benchmark del lancio rispetto a Fable 5, Opus 5 e GPT-5.6 Sol senza farsi vendere nulla
  • Decidere tra Fable 5.1, Opus 5 e Fable 5 per il tuo carico di lavoro, poi eseguire la checklist di migrazione

La versione in un paragrafo

Fable 5.1 è il successore di Fable 5: stesso livello di classe Mythos sopra Opus, stesso contesto da 1M token, stesso output massimo da 128K, stessi 10 $ in input / 50 $ in output, stesso tokenizer, stesso thinking adattivo sempre attivo, stesso comportamento in-band con stop_reason: "refusal", stesso requisito di retention a 30 giorni (niente ZDR). La guida di Anthropic è invariata nello spirito: parti da Opus 5 per la maggior parte del lavoro, usa Fable 5.1 "per ragionamento impegnativo e lavoro agentico a lungo orizzonte, o quando le tue eval su Claude Opus 5 a effort più alto restano insufficienti". Cosa c'è di nuovo: tre breaking change, cinque funzionalità additive, una lettura da cache più economica del 75% e un insieme di cambiamenti comportamentali che dovresti conoscere prima che te li dica la tua suite di eval.

Tre breaking change

Sono i motivi per cui non puoi semplicemente cambiare l'ID. Ciascuno è un 400, non un degrado silenzioso.

1. L'uso forzato dei tool restituisce un errore

tool_choice: {"type": "any"} e {"type": "tool", "name": "..."} ora restituiscono un 400 invalid_request_error:

tool_choice: type "tool" and "any" are not supported for this model.

La ragione è istruttiva: il thinking è sempre attivo, e una chiamata di tool forzata lo salterebbe, così il modello farebbe il suo ragionamento dentro gli argomenti del tool e la qualità degli argomenti calerebbe. Il controllo si applica alla Messages API, alla Message Batches API e all'endpoint di conteggio token. auto (il default) e none sono invariati.

Il rimedio è una modifica di due righe: lascia tool_choice su auto, imposta strict: true sul tool con additionalProperties: false nello schema, e di' nel prompt quando il tool si applica. La nota di Anthropic è che Fable 5.1 "segue in modo affidabile le istruzioni esplicite sui tool". Se ciò che volevi davvero era JSON valido rispetto a uno schema piuttosto che una chiamata di tool, passa invece agli output strutturati.

Chiamata di tool forzata → tool strict + istruzione esplicita

# Before (Fable 5) — now a 400 on Fable 5.1
"tool_choice": {"type": "tool", "name": "record_summary"}

# After (Fable 5.1)
"tools": [{
"name": "record_summary",
"description": "Record the structured summary of the document.",
"strict": true,
"input_schema": {
  "type": "object",
  "properties": {"summary": {"type": "string"}},
  "required": ["summary"],
  "additionalProperties": false
}
}],
"tool_choice": {"type": "auto"},
"messages": [{"role": "user",
"content": "Summarize: The meeting moved to Thursday. Call the record_summary tool with your result."}]

2. I blocchi di thinking sono a senso unico

Ogni blocco di thinking ora registra quale modello lo ha prodotto, e la preservazione è unidirezionale: Fable 5.1 può leggere i blocchi di thinking di Opus 5, Fable 5, Mythos 5 e di ogni Claude precedente; nessuno di questi può leggere quelli di Fable 5.1. Una conversazione che passa a Fable 5.1 conserva il suo ragionamento. Una conversazione che lascia Fable 5.1 (un router, un fallback a Opus 5, un downgrade per risparmiare a metà sessione) perde il ragionamento dei turni di Fable 5.1.

L'API gestisce la cosa scartando i blocchi che il modello di destinazione non può leggere prima che il modello li veda. I blocchi scartati non vengono fatturati e non contano in input_tokens. Senza l'header beta thinking-binding-controls-2026-08-01 lo scarto è silenzioso; con l'header, lo scarto viene riportato in un array di primo livello input_transformations. Se instradi tra modelli, invia l'header e logga quell'array. La perdita silenziosa di ragionamento è esattamente il tipo di cosa che in un bug report compare come "il modello è diventato più stupido dopo il passo 12".

3. Modificare i turni precedenti invalida i blocchi di thinking

Questo è quello da leggere due volte. Modificare qualsiasi cosa prima di un blocco di thinking di Fable 5.1, cioè il prompt system, l'array tools o qualsiasi messaggio precedente, invalida ogni blocco di thinking successivo. Dove il controllo è applicato, la richiesta successiva viene rifiutata con un 400 il cui messaggio dice The block is bound to a different conversation.

Regole di enforcement a oggi:

  • Account creati dal 31 agosto 2026 in poi: applicato.
  • Account più vecchi: l'API registra la discrepanza ma agisce solo quando imposti tu thinking.block_binding.prefix_mismatch_behavior.
  • Mythos 5.1 non esegue affatto questo controllo.
  • Claude Code, claude.ai, Managed Agents e l'Agent SDK mantengono il prefisso intatto per te. Solo gli array messages costruiti a mano sono a rischio.

L'elenco di Anthropic di cosa invalida i blocchi, parafrasato, è un elenco di abitudini comuni degli harness agentici:

Invalida ogni blocco di thinking successivoLi mantiene validi
Modificare, riordinare o rimuovere un turno precedente mantenendo quelli successiviRimuovere una sequenza iniziale di blocchi di thinking, dal più vecchio
Iniettare un promemoria o una riga di stato per richiesta in un turno precedente, poi rimuoverla alla richiesta successivaCompattazione lato server o context editing che taglia la cronologia
Ricostruire system o tools di primo livello tra richieste nella stessa conversazioneSpostare i marker cache_control
Un URL di immagine o documento che serve byte diversi in seguito (il controllo è sui byte, quindi un URL firmato a rotazione per lo stesso file va bene)Cambiare effort tra richieste

I rimedi si riducono tutti a una regola: tratta la conversazione come append-only. I promemoria per turno diventano messaggi di sistema a scope di turno (sotto). Le modifiche a tool e istruzioni diventano messaggi di sistema e modifiche ai tool a metà conversazione. Il taglio diventa compattazione lato server. Per continuare invece di andare in errore, invia l'header thinking-binding-controls-2026-08-01 con prefix_mismatch_behavior: "drop_block"; lo scarto viene quindi riportato in input_transformations con reason: "prefix_binding_mismatch".

Anthropic inquadra la cosa in parte come misura anti-distillazione: il post di lancio dice che i nuovi account API non possono più modificare manualmente il contesto precedente preservando la trascrizione, il che chiude una tecnica di distillazione documentata pubblicamente. Il vantaggio pratico per te è che la stessa disciplina mantiene anche caldo il prompt cache.

Cinque funzionalità additive

Effort per messaggio (beta)

Ora puoi cambiare effort a metà conversazione senza invalidare il prompt cache. Alzalo per il passo difficile, abbassalo per quelli di routine. Invia l'header beta mid-conversation-output-config-2026-07-01 e inserisci un messaggio di sistema con solo l'effort; il nuovo livello ha effetto dal turno utente successivo. Supportato su Fable 5.1, Mythos 5.1 e Opus 5 sulla Claude API e su Google Cloud.

Abbassare l'effort per un turno di riepilogo senza rompere la cache

{
"model": "claude-fable-5-1",
"max_tokens": 4096,
"output_config": {"effort": "high"},
"messages": [
  {"role": "user", "content": "Plan a migration from SQLite to PostgreSQL in three short steps."},
  {"role": "assistant", "content": "1. Export the SQLite data. 2. Create the PostgreSQL schema. 3. Import the data and verify row counts."},
  {"role": "system", "content": [], "output_config": {"effort": "low"}},
  {"role": "user", "content": "Summarize the plan in one sentence."}
]
}
# header: anthropic-beta: mid-conversation-output-config-2026-07-01

Si abbina alla guida sull'effort in Thinking ed effort e Tuning dell'effort: il default è high, e "un livello per tutta la sessione" è ora l'opzione pigra, non l'unica.

Messaggi di sistema a scope di turno (beta)

Imposta clear_at: "next_user_message" su un messaggio role: "system" e questo porta autorità da system prompt solo per il turno corrente, poi smette di essere renderizzato una volta che esiste un messaggio user successivo. Continui a reinviarlo tale e quale, quindi nulla di precedente cambia, la cache continua a corrispondere, i blocchi di thinking successivi restano validi, e un messaggio cancellato non costa token di input. Header: mid-conversation-system-clear-at-2026-08-21.

{
"role": "system",
"clear_at": "next_user_message",
"content": "Results have landed in your inbox. Check it before running more code."
}

È il sostituto sanzionato del pattern "inietta un promemoria, cancellalo alla richiesta successiva" che il breaking change 3 ora punisce.

Aggiornamenti di progresso tra chiamate di tool (beta)

Fable 5.1, come Fable 5, scrive brevi note di progresso tra le chiamate di tool, ciascuna come proprio blocco thinking subito prima della chiamata. Con il default thinking.display: "omitted" queste tornano vuote, quindi un lungo turno agentico appare silenzioso ai tuoi utenti. Novità: display: "updates" (header thinking-display-updates-2026-08-18) restituisce le note di progresso come testo mentre il ragionamento resta nascosto. Qualsiasi blocco di thinking con testo non vuoto è quindi una riga di stato che puoi renderizzare. "summarized" le restituisce anch'esso, mescolate al ragionamento riassunto. La chain of thought grezza continua a non essere mai restituita.

Letture da cache a 0,25 $ per MTok

Input baseScrittura cache 5mScrittura cache 1hLettura cacheOutput
Fable 510 $12,50 $20 $1,00 $50 $
Fable 5.110 $12,50 $20 $0,25 $50 $

Le letture da cache sono 0,025× l'input base su Fable 5.1 e Mythos 5.1 contro 0,1× su ogni altro modello Claude. Le scritture e il minimo di 512 token per prompt memorizzabile in cache sono invariati; il batch è ancora scontato del 50% (5 $ / 25 $). Per un lungo loop agentico che rilegge un grande prefisso in cache a ogni turno, è da qui che viene il "fino al 45% più economico" del post di lancio. Nota cross-modello: GPT-6 Astra di OpenAI, lanciato tre giorni dopo allo stesso listino di 10 $ / 50 $, fa pagare 1,00 $ per le letture da cache, quattro volte la tariffa di Fable 5.1; vedi la guida sul campo ad Astra.

Provenienza dei contenuti

Tutto il testo di Fable 5.1 e Mythos 5.1 porta il watermark statistico testuale di Anthropic su ogni piattaforma. I file che Claude produce (via esecuzione di codice, ad esempio) portano Content Credentials C2PA firmate quando recuperati tramite la Files API. Anthropic dichiara che il watermark non aggiunge token né caratteri nascosti, non porta informazioni su di te o sulla tua org, e non richiede modifiche alle richieste. Contesto: Anthropic ha firmato il Codice di condotta dell'EU AI Act sulla trasparenza dei contenuti generati dall'AI a luglio 2026, e un'API di rilevamento è in private preview per regolatori, fact-checker, ricercatori e aziende che hanno bisogno di verifica.

Sette cambiamenti di comportamento che vedrai senza modifiche al codice

Anthropic li documenta apertamente, e ciascuno ha un rimedio di prompting nella guida ufficiale Prompting Claude Fable 5.1. Cercali nelle eval prima che lo facciano i tuoi utenti.

Premi Invio o Spazio per girare la carta. Usa le frecce sinistra e destra per spostarti tra le carte.Termine mostrato.
1 / 7

Cosa resta esattamente uguale a Fable 5

Se avevi già cablato correttamente Fable 5, tutto questo si trasferisce intatto:

  • Il thinking adattivo è sempre attivo. thinking: {"type": "enabled"} con budget_tokens, e {"type": "disabled"}, restituiscono entrambi 400. Ometti thinking o invia {"type": "adaptive"}.
  • thinking.display ha default "omitted"; la chain of thought grezza non viene mai restituita.
  • L'interleaved thinking è automatico, nessun header beta.
  • Il prefill restituisce 400. temperature, top_p, top_k non di default restituiscono 400.
  • I rifiuti arrivano come HTTP 200 con stop_reason: "refusal" e una stop_details.category; non ti viene fatturato un rifiuto che arriva prima di qualsiasi output. Le destinazioni di fallback consentite sono Opus 5 e Opus 4.8, e il credito di fallback rimborsa il costo di prompt cache del cambio. Pattern completo in Rifiuti e sicurezza.
  • La retention a 30 giorni è obbligatoria; una richiesta da un'org o workspace senza di essa restituisce 400. Entrambi i modelli sono Covered Model.
  • Una divergenza da conoscere: né Fable 5.1 né Mythos 5.1 sono supportati su Priority Tier. Fable 5 lo è. Se hai comprato capacità prioritaria, è un motivo per restare su Fable 5 per ora.

I benchmark del lancio, letti onestamente

Numeri di Anthropic, harness di Anthropic. I confronti con GPT-5.6 Sol sono quelli che OpenAI contesterebbe per primi, e il GPT-6 Astra di OpenAI è arrivato tre giorni dopo, quindi trattali come lo stato delle cose al 1° settembre, non al 14 settembre.

BenchmarkFable 5.1Fable 5Opus 5GPT-5.6 Sol
Terminal-Bench 4.055,8% (Mythos 5.1: 60,9%)42,0%52,3%37,3%
Terminal-Bench-Science 0.152,6%24,7%29,0%22,4%
GDPval-AA v2 (Elo)1853172318241711
OSWorld 2.0, parziale / stretto77,9% / 41,7%72,9% / 36,1%75,4% / 39,6%
Humanity's Last Exam, senza tool / con tool60,9% / 65,0%57,8% / 63,8%56,6% / 63,6%
AutomationBench31,4%17,1%26,9%19,6%
CursorBench 3.2.073,4%70,5%70,0%67,2%

Tre letture che contano più di qualsiasi singola riga:

  1. Il salto da Fable 5 a 5.1 è massimo sul lavoro agentico a lungo orizzonte (Terminal-Bench-Science raddoppiato, AutomationBench quasi raddoppiato). È coerente con il posizionamento di Anthropic "usalo quando Opus 5 a effort più alto resta insufficiente": la vittoria è sulle esecuzioni di ore, non sulla chat.
  2. Opus 5 è più vicino di quanto suggerisca il titolo su diverse righe (Terminal-Bench 4.0: 52,3 contro 55,8; GDPval: 1824 contro 1853) a metà del prezzo di listino. Anthropic continua a dirti di partire da Opus 5 per un motivo.
  3. Le citazioni dei clienti parlano di token, non solo di accuratezza. Cognition, Rogo, Browserbase e Block citano tutti meno token per risultati uguali o migliori. Combinato con le letture da cache a 0,25 $, "Fable 5.1 è più economico di Fable 5 per lo stesso lavoro" è l'affermazione più difendibile rispetto a "Fable 5.1 è più intelligente".

Gli esempi scientifici nel post di lancio (binder proteici con ~50% di hit rate su 12 target contro un tipico 10–15%, una mappa di elevazione di Venere a risoluzione 2–3 km da dati radar Magellan vecchi di 30 anni, speedup di 2,5× su sette modelli open source di genomica) sono risultati di ricerca riportati da Anthropic, non benchmark. Segnale interessante per carichi di lavoro di ricerca, non un input per il procurement.

Fable 5.1 vs Opus 5 vs Fable 5: la decisione

La tua situazioneScegliPerché
La maggior parte del lavoro in produzione, sensibile al costoOpus 5Raccomandazione di default di Anthropic stessa; metà del prezzo; legge i blocchi di thinking di Fable 5.1 se mai instradi verso l'alto
Coding autonomo di ore, ricerca, o costruzione di documenti/fogli/slide dove Opus 5 a effort high ancora sbagliaFable 5.1I delta maggiori sono esattamente qui; le letture da cache rendono i loop lunghi più economici che su Fable 5
Dipendi da Priority TierFable 5 (per ora)Fable 5.1 e Mythos 5.1 non sono su Priority Tier
Forzi tool_choice e non puoi cambiare l'harness in questo sprintFable 5Fable 5.1 restituisce 400; migra prima l'harness, poi il modello
Instradi o fai fallback tra modelli a metà conversazioneQualsiasi, ma invia l'header thinking-bindingAltrimenti il downgrade da Fable 5.1 scarta silenziosamente il suo ragionamento
La zero data retention è contrattualeOpus 5Fable 5.x e Mythos 5.x richiedono retention a 30 giorni
Ricerca in cyber difensiva o scienze della vita che richiede meno interventi dei classificatoriMythos 5.1 via Glasswing, se approvatoStesso modello, configurazione di safeguard diversa; organizzazioni USA, programmi di verifica richiesti

Checklist di migrazione

Anthropic distribuisce una skill integrata che fa la maggior parte di questo in Claude Code. Eseguila prima, poi verifica gli elementi che non può vedere.

Automatizzare lo swap dell'ID e le correzioni dei parametri

/claude-api migrate this project to claude-fable-5-1
Guided walkthrough1 of 6
  1. claude-fable-5 → claude-fable-5-1 (Bedrock: anthropic.claude-fable-5-1). Poi cerca tool_choice con type any o tool. Ogni occorrenza diventa strict: true + additionalProperties: false + un'istruzione esplicita 'chiama il tool X', oppure un passaggio agli output strutturati. Non dimenticare le chiamate di conteggio token: anche loro validano.

Mythos 5.1: stesso modello, safeguard diverse

Anthropic dichiara che Fable 5.1 e Mythos 5.1 sono lo stesso modello sottostante con configurazioni di safeguard diverse, con specifiche e prezzi condivisi. Mythos 5.1 è offerto solo ai partecipanti approvati al Project Glasswing, attualmente limitato a organizzazioni USA, tramite un Cyber Verification Program per il lavoro di sicurezza difensiva e un Life Sciences Verification Program gestito con il governo USA. Due cose sono cambiate per tutti sul fronte delle safeguard: a Fable 5.1 è ora consentito identificare vulnerabilità software per lavoro difensivo (Anthropic riporta circa il 60% in meno di interventi delle safeguard cyber per sessione), mentre i task dual-use come penetration testing, generazione di exploit e scansione di vulnerabilità su binari sono ancora reindirizzati ai modelli Opus; e le safeguard biologiche scattano circa l'85% meno spesso su query benigne di biologia elementare e medicina. Mythos 5.1 salta anche il controllo di binding della conversazione sui blocchi di thinking. Se non puoi ottenere l'accesso a Glasswing, l'istruzione di Anthropic è semplicemente: usa Fable 5.1.

Attenzione ai nomi: la guida sul campo a Fable 5 spiegava Mythos 5 come "Fable 5 senza i classificatori di sicurezza". Per la 5.1 la formulazione di Anthropic è "configurazioni di safeguard diverse", e Mythos 5.1 alimenta ancora il prodotto Claude Security di Anthropic stessa. Trattalo come un deployment configurato diversamente, non come uno non filtrato.

Verifica rapida

Check yourself

0/4
  1. Migri un'integrazione Fable 5 a claude-fable-5-1 e ogni richiesta con tool_choice type "tool" ora fallisce. Qual è il rimedio sanzionato?
  2. Un router sposta una conversazione da Fable 5.1 a Opus 5 per risparmiare. Cosa succede ai blocchi di thinking di Fable 5.1?
  3. Il tuo loop agentico inietta un promemoria di stato di una riga nel turno utente precedente a ogni richiesta e lo rimuove alla successiva. Su un nuovo account API questo ora va in errore. Cosa lo sostituisce?
  4. Fable 5.1 mantiene il listino di 10 $ / 50 $ di Fable 5. Da dove viene l'affermazione di Anthropic 'fino al 45% più economico sul lavoro fortemente agentico'?

Punti chiave

Key takeaways
  • Fable 5.1 è un drop-in per Fable 5 SOLO se non forzi mai tool_choice, non modifichi mai la cronologia della conversazione e non instradi mai blocchi di thinking a un modello più vecchio. Cerca tutti e tre prima di cambiare l'ID.
  • Tratta le conversazioni come append-only: messaggi di sistema a scope di turno per i promemoria per turno, messaggi a metà conversazione per modifiche a istruzioni e tool, compattazione lato server per il taglio. Mantiene validi i blocchi di thinking E calda la cache.
  • La storia dei prezzi sono le letture da cache a 0,25 $. I loop agentici lunghi diventano più economici; le chat brevi no. Opus 5 a 5 $ / 25 $ è ancora il 'parti da qui' di Anthropic stessa.
  • Aspettati meno chiamate di tool parallele, meno narrazione, prosa più densa e riscritture di interi file; ciascuno ha un rimedio di prompt di una riga, e thinking.display: "updates" ripristina il progresso visibile.
  • Priority Tier e ZDR sono i due motivi contrattuali per restare su Fable 5 o Opus 5.

Prossimi passi