Scegliere un modello Claude
Il compromesso Opus/Sonnet/Haiku e come scegliere — senza tirare a indovinare.
Token, contesto e prezzi
Conta correttamente i token, max_tokens contro finestra di contesto e come stimare il costo.
La tua prima chiamata API
Installa l'SDK, autenticati ed esegui una chiamata reale a Claude in Python, TypeScript o cURL.
Streaming e conversazioni multi-turno
Esegui lo streaming delle risposte e gestisci la cronologia su un'API stateless.
Uso degli strumenti / Function calling
Definisci gli strumenti, esegui il loop agentico e gestisci i risultati.
Vision, PDF e input di file
Invia immagini e documenti e riutilizza gli upload tramite file_id.
Output strutturato
Ottieni JSON conforme a uno schema su cui puoi fare affidamento — non il prompt-e-prega.
Extended Thinking ed Effort
Ragionamento adattivo e il controllo dell'effort — scegliere la profondità in base al carico di lavoro.
Effort tuning: 5 livelli, default per modello e la trappola della cache
Il parametro effort di luglio 2026 ha cinque livelli — low, medium, high, xhigh, max — e vive dentro output_config, non al livello superiore. Influenza le tool call (non solo il thinking), invalida la prompt cache se cambi a metà conversazione e ogni modello ha un punto di partenza consigliato diverso. La guida pratica al tuning.
Il tool advisor: Sonnet lavora, Fable pensa
Il server-tool advisor (beta advisor-tool-2026-03-01) permette a un modello executor veloce di consultare un modello più forte a metà turno. Reference completa dei campi, la trappola del conteggio token che quasi tutti gli integratori si perdono, la matrice di abbinamento dei modelli e i prompt esatti che Anthropic usa in produzione.
Prompt Caching e Ottimizzazione dei Costi
Riutilizza un prefisso di prompt stabile per ridurre costo e latenza — e l'insidia che lo rompe.
Messaggi di sistema a metà conversazione
Guida una sessione agentica lunga senza far esplodere la prompt cache — il nuovo ruolo system che puoi accodare dopo qualsiasi turno utente.
Modifiche ai Tool a Metà Conversazione
Aggiungi e ritira tool tra un turno e l'altro senza invalidare la prompt cache — la beta di Opus 5 che chiude la tassa nascosta più pesante delle sessioni agent lunghe.
Costruire agenti sull'API
Chiamata singola vs workflow vs agente personalizzato — il test decisionale e la progettazione del loop.
Agent gestiti
Loop di agent ospitato da Anthropic: agent vs sessioni, ambienti, memoria, vault e deployment pianificati (cron).
Memory Store per Managed Agents
La beta di luglio 2026 — memoria persistente server-side che si monta nella sandbox dei Managed Agents, con versioning, audit trail e redaction.
Cowork e team di agent
Lo spazio di lavoro desktop agentico e la collaborazione multi-agent come prodotti.
MCP e collegamento agli strumenti
Chiama server MCP remoti direttamente dalla Messages API — la forma della richiesta, allowlist e denylist, caricamento differito e i limiti che fanno male in produzione.
MCP 2026-07-28: la specifica stateless
La più grande revisione di MCP dal lancio: la sessione sparisce, ogni richiesta si autodescrive, e qualsiasi istanza del server può rispondere a qualsiasi chiamata. Cosa è cambiato davvero il 28 luglio 2026, e come migrare senza rompere i server di oggi.
MCP Apps: UI interattive dentro una tool call
MCP Apps (SEP-1865) permette a un server MCP di inviare una UI HTML che il client renderizza in un iframe sandboxed — con ogni azione che passa comunque per il normale audit path JSON-RPC. Cosa dice davvero la spec, cosa costruirci e cosa rifiutarsi di costruire.
MCP Tasks: lavoro long-running senza sessione
La spec stateless MCP del 2026-07-28 ha eliminato la sessione — e allora come modelli un job CI da 20 minuti, un import batch o un gate di approvazione umana? Con l'estensione ufficiale Tasks (SEP-2663). Lifecycle completo, protocollo wire, migrazione dalla vecchia Tasks API sperimentale e i pattern di polling/notifica che funzionano davvero in produzione.
Playwright MCP: la guida pratica approfondita (2026)
Playwright MCP di Microsoft è oggi il server MCP #1 al mondo — davanti a GitHub e Figma. Il dettaglio che quasi nessuno spiega: la modalità di default con accessibility snapshot non è solo più veloce della vision, è un paradigma di automazione completamente diverso. Profili, capability opt-in, la modalità estensione browser che si aggancia al tuo Chrome reale, la battaglia sul costo in token contro Playwright-as-a-Skill, e la linea di sicurezza da non superare.
Sicurezza, rifiuti e fallback
Gestisci i rifiuti con eleganza e distinguili dai blocchi dei classificatori.
Fallback lato server e Credito di fallback
La beta di Opus 5 che trasforma un rifiuto di Fable 5 / Opus 5 in una risposta normale dentro una singola chiamata API — più il token di credito che ti evita di pagare due volte la prompt cache al retry.
Errori, rate limit e affidabilità
La mappa degli errori, i retry con backoff, i tier di rate limit e la migrazione dei modelli.
Memoria e Context Editing
Dai agli agenti una memoria persistente e un contesto auto-potato — il memory tool lato client più il context editing che cancella i risultati degli strumenti ormai obsoleti per sopravvivere alle esecuzioni lunghe.
Programmatic Tool Calling
Lascia che Claude chiami i tuoi tool da Python dentro la sandbox di code execution — meno round-trip e risultati intermedi fuori dal contesto.
L'Admin API: automatizza la tua org Claude
La guida operativa alla Admin API di Anthropic — elenca i membri, invita utenti, gestisci gruppi RBAC, esegui offboarding puliti. Console + Claude Enterprise, con le insidie del seat-pool e dell'SSO che fanno inciampare i team veri.
Inference Hooks: DLP inline per Claude Enterprise
La guida operativa agli Inference Hooks di Claude Enterprise — il webhook HTTPS che consente al tuo server DLP di autorizzare o negare ogni prompt su chat, Claude Code e Cowork, prima che il modello lo veda. Spec completa, schema dei verdetti, firma, playbook di rollout.