Choisir un modèle Claude
Le compromis Opus/Sonnet/Haiku et comment choisir — sans deviner.
Tokens, contexte et tarification
Comptez correctement les tokens, max_tokens vs fenêtre de contexte, et l'estimation du coût.
Votre premier appel à l'API
Installez le SDK, authentifiez-vous et effectuez un véritable appel à Claude en Python, TypeScript ou cURL.
Streaming et conversations multi-tours
Diffusez les réponses en streaming et gérez l'historique sur une API sans état.
Utilisation des outils / appel de fonctions
Définissez des outils, exécutez la boucle agentique et traitez les résultats.
Vision, PDF et fichiers en entrée
Envoyez des images et des documents, et réutilisez les téléversements grâce à file_id.
Sortie structurée
Obtenez du JSON conforme à un schéma sur lequel vous pouvez compter — pas du « prie pour que ça marche ».
Réflexion étendue et effort
Le raisonnement adaptatif et le contrôle de l'effort — choisir la profondeur selon la charge de travail.
Réglage de l'effort : 5 niveaux, défauts par modèle, et le piège du cache
Le paramètre effort de juillet 2026 a cinq niveaux — low, medium, high, xhigh, max — et vit à l'intérieur d'output_config, pas au niveau supérieur. Il affecte les appels d'outils (pas juste la réflexion), invalide le cache de prompt quand il est changé en cours de conversation, et chaque modèle a un point de départ recommandé différent. Le guide de réglage pratique.
L'outil advisor : Sonnet fait le travail, Fable fait la réflexion
L'outil serveur advisor (beta advisor-tool-2026-03-01) permet à un modèle exécuteur rapide de consulter un modèle plus fort en milieu de tour. Référence complète des champs, le piège de comptabilité de tokens que la plupart des intégrateurs manquent, la matrice d'appariement de modèles, et les prompts exacts qu'Anthropic livre en production.
Mise en cache des prompts et optimisation des coûts
Réutilisez un préfixe de prompt stable pour réduire le coût et la latence — et le piège qui casse tout.
Messages système en cours de conversation
Piloter une longue session d'agent sans faire exploser le cache de prompt — le nouveau rôle système que vous pouvez ajouter après n'importe quel tour utilisateur.
Changements d'outils en cours de conversation
Ajouter et retirer des outils entre les tours sans invalider le cache de prompt — la beta Opus 5 qui corrige la plus grosse taxe cachée sur les longues sessions d'agent.
Construire des agents sur l'API
Appel unique vs workflow vs agent personnalisé — le test de décision et la conception de la boucle.
Agents gérés
Boucle d'agent hébergée par Anthropic : agents vs sessions, environnements, mémoire, vaults et déploiements planifiés (cron).
Managed Agents Memory Stores
La bêta de juillet 2026 — mémoire persistante côté serveur qui se monte dans un sandbox Managed Agents, avec versioning, piste d'audit et rédaction.
Cowork et équipes d'agents
L'espace de travail bureautique agentique et la collaboration multi-agents en tant que produits.
MCP et connexion aux outils
Appelez des serveurs MCP distants directement depuis la Messages API — la forme de la requête, allowlists et denylists, chargement différé, et les limites qui piquent en production.
MCP 2026-07-28 : la spec stateless
La plus grosse révision MCP depuis le lancement : la session a disparu, chaque requête s'auto-décrit, et n'importe quelle instance de serveur peut répondre à n'importe quel appel. Ce qui a réellement changé le 28 juillet 2026, et comment migrer sans casser les serveurs d'aujourd'hui.
MCP Apps : UIs interactives dans un appel d'outil
MCP Apps (SEP-1865) permet à un serveur MCP de livrer une UI HTML que le client rend dans une iframe sandboxée — chaque action passant toujours par le chemin d'audit standard JSON-RPC. Ce que dit vraiment la spec, ce qu'il faut construire avec, et ce qu'il faut refuser de construire.
MCP Tasks : travail long sans la session
La spec MCP sans état 2026-07-28 a tué la session — alors comment modéliser un job CI de 20 minutes, un import batch, ou une porte d'approbation humaine ? Avec l'extension officielle Tasks (SEP-2663). Cycle de vie complet, protocole wire, migration depuis l'ancienne API Tasks expérimentale, et les patterns de polling/notification qui marchent vraiment en production.
Playwright MCP : le guide pratique approfondi (2026)
Le Playwright MCP de Microsoft est maintenant le serveur MCP n°1 au monde — devant GitHub et Figma. Le bit que presque personne n'enseigne : le mode snapshot d'accessibilité par défaut n'est pas juste plus rapide que la vision, c'est un paradigme d'automatisation complètement différent. Profils, caps opt-in, mode extension navigateur qui s'attache à votre vrai Chrome, la bataille du coût en tokens contre Playwright-comme-Skill, et la ligne de sécurité à ne pas franchir.
Sécurité, refus et solutions de repli
Gérez les refus avec élégance et distinguez-les des blocages du classifieur.
Fallbacks côté serveur & Fallback Credit
La bêta Opus 5 qui transforme un refus Fable 5 / Opus 5 en réponse normale à l'intérieur d'un seul appel API — plus le token de crédit qui vous empêche de payer le cache de prompt deux fois sur le retry.
Erreurs, limites de débit et fiabilité
La carte des erreurs, les nouvelles tentatives avec backoff, les paliers de limite de débit et la migration de modèle.
Mémoire et édition du contexte
Donnez aux agents une mémoire persistante et un contexte auto-élagué — l'outil memory côté client plus l'édition du contexte qui efface les résultats d'outils périmés pour survivre aux exécutions longues.
Appel d'outils par programme
Laissez Claude appeler vos outils depuis du Python exécuté dans le bac à sable d'exécution de code — moins d'allers-retours, et les résultats intermédiaires restent hors du contexte.
L'Admin API : automatisez votre org Claude
Le guide de l'opérateur pour l'Admin API d'Anthropic — lister les membres, inviter des utilisateurs, gérer les groupes RBAC, offboarder proprement. Console + Claude Enterprise, avec les pièges seat-pool et SSO qui font trébucher les vraies équipes.
Inference Hooks: inline DLP for Claude Enterprise
The operator's guide to Claude Enterprise Inference Hooks — the HTTPS webhook that lets your DLP server allow or deny every prompt across chat, Claude Code, and Cowork, before the model sees it. Full spec, verdict schema, signing, rollout playbook.