Ein Claude-Modell auswählen
Der Opus/Sonnet/Haiku-Tradeoff und wie du wählst — ohne zu raten.
Tokens, Kontext & Preise
Tokens korrekt zählen, max_tokens vs. Kontextfenster und Kosten abschätzen.
Dein erster API-Aufruf
Installiere das SDK, authentifiziere dich und führe einen echten Aufruf an Claude in Python, TypeScript oder cURL aus.
Streaming & Konversationen über mehrere Runden
Antworten streamen und den Verlauf bei einer zustandslosen API selbst verwalten.
Tool-Nutzung / Function Calling
Tools definieren, die agentische Schleife ausführen und Ergebnisse verarbeiten.
Vision, PDF & Datei-Eingabe
Sende Bilder und Dokumente und verwende Uploads per file_id wieder.
Strukturierte Ausgabe
Erhalte schemakonformes JSON, auf das du dich verlassen kannst — kein Prompt-and-Pray.
Extended Thinking & Effort
Adaptives Reasoning und die Effort-Steuerung — die Tiefe nach Arbeitslast wählen.
Effort-Tuning: 5 Level, Modell-Defaults und die Cache-Falle
Der Juli-2026-Effort-Parameter hat fünf Level — low, medium, high, xhigh, max — und lebt in output_config, nicht auf Top-Level. Er beeinflusst Tool-Calls (nicht nur Denken), invalidiert Prompt-Cache bei Mid-Conversation-Änderung, und jedes Modell hat einen anderen empfohlenen Startpunkt. Der praktische Tuning-Guide.
Das Advisor-Tool: Sonnet macht die Arbeit, Fable macht das Denken
Das Advisor-Server-Tool (Beta advisor-tool-2026-03-01) lässt ein schnelles Executor-Modell während des Turns ein stärkeres Modell konsultieren. Vollständige Feld-Referenz, die Token-Abrechnungs-Falle, die die meisten Integratoren verpassen, die Modell-Paarungs-Matrix und die exakten Prompts, die Anthropic in Produktion ausliefert.
Prompt-Caching & Kostenoptimierung
Einen stabilen Prompt-Präfix wiederverwenden, um Kosten und Latenz zu senken — und die Falle, die es zunichtemacht.
System-Nachrichten mitten in der Konversation
Eine lange Agent-Sitzung steuern, ohne den Prompt-Cache zu sprengen — die neue System-Rolle, die du nach jedem User-Turn anhängen kannst.
Mid-Conversation Tool Changes
Tools zwischen Runden hinzufügen und zurückziehen, ohne den Prompt-Cache zu invalidieren — die Opus-5-Beta, die die größte versteckte Steuer auf lange Agenten-Sessions behebt.
Agenten auf der API bauen
Einzelaufruf vs. Workflow vs. eigener Agent — der Entscheidungstest und das Design der Schleife.
Verwaltete Agenten
Von Anthropic gehosteter Agent-Loop: Agenten vs. Sessions, Umgebungen, Memory, Vaults und geplante Deployments (Cron).
Managed Agents Memory Stores
Die Beta vom Juli 2026 — serverseitiger persistenter Speicher, der in eine Managed-Agents-Sandbox eingehängt wird, mit Versionierung, Audit-Trail und Redaction.
Cowork & Agententeams
Der agentische Desktop-Arbeitsbereich und Multi-Agenten-Zusammenarbeit als Produkte.
MCP & Verbindung zu Tools
Remote-MCP-Server direkt aus der Messages-API aufrufen — Request-Form, Allowlists und Denylists, verzögertes Laden und die Grenzen, die in der Produktion beißen.
MCP 2026-07-28: Die zustandslose Spezifikation
Die größte MCP-Revision seit dem Start: die Session ist weg, jede Anfrage beschreibt sich selbst, und jede Serverinstanz kann jeden Aufruf beantworten. Was sich am 28. Juli 2026 tatsächlich geändert hat — und wie du migrierst, ohne die heutigen Server zu brechen.
MCP Apps: Interaktive UIs innerhalb eines Tool-Calls
MCP Apps (SEP-1865) erlaubt einem MCP-Server, eine HTML-UI auszuliefern, die der Client in einem sandboxed iframe rendert — wobei jede Aktion weiterhin über den standardmäßigen JSON-RPC-Audit-Pfad läuft. Was die Spec tatsächlich sagt, was man damit bauen soll und was man abzulehnen hat.
MCP Tasks: Langlaufende Arbeit ohne Session
Die 2026-07-28 stateless MCP-Spec hat die Session getötet — wie modelliert man also einen 20-minütigen CI-Job, einen Batch-Import oder ein menschliches Approval-Gate? Mit der offiziellen Tasks-Extension (SEP-2663). Vollständiger Lifecycle, Wire-Protocol, Migration von der alten experimentellen Tasks-API und die Polling-/Notification-Muster, die in Produktion tatsächlich funktionieren.
Playwright MCP: Der praxisnahe Deep-Dive (2026)
Microsofts Playwright MCP ist inzwischen der weltweit meistinstallierte MCP-Server – noch vor GitHub und Figma. Der Teil, den fast niemand erklärt: Der voreingestellte Accessibility-Snapshot-Modus ist nicht nur schneller als Vision, er ist ein komplett anderes Automatisierungsparadigma. Profile, opt-in Caps, Browser-Extension-Modus, der sich an Ihr echtes Chrome hängt, der Token-Cost-Kampf gegen Playwright-als-Skill – und die Sicherheitsgrenze, die Sie nicht überschreiten dürfen.
Sicherheit, Verweigerungen & Fallbacks
Verweigerungen souverän behandeln und sie von Classifier-Blocks unterscheiden.
Serverseitige Fallbacks & Fallback Credit
Die Opus-5-Beta, die eine Fable-5- / Opus-5-Refusal innerhalb eines API-Aufrufs in eine normale Antwort verwandelt — plus das Credit-Token, das dich davor bewahrt, den Prompt-Cache beim Retry doppelt zu bezahlen.
Fehler, Rate Limits & Zuverlässigkeit
Die Fehlerübersicht, Wiederholungen mit Backoff, Rate-Limit-Stufen und Modellmigration.
Memory & Context Editing
Gib Agenten persistentes Gedächtnis und automatisch beschnittenen Kontext — das clientseitige memory tool plus Context Editing, das veraltete Tool-Ergebnisse löscht, um lange Läufe zu überstehen.
Programmatisches Tool Calling
Claude ruft deine Tools aus Python heraus in der Code-Execution-Sandbox auf — das spart Roundtrips und hält Zwischenergebnisse aus dem Kontext heraus.
Die Admin-API: automatisiere deine Claude-Org
Der Operator-Leitfaden für Anthropics Admin-API — Mitglieder listen, Nutzer einladen, RBAC-Gruppen führen, sauber offboarden. Console + Claude Enterprise, mit den Seat-Pool- und SSO-Fallstricken, die echte Teams treffen.
Inference Hooks: Inline-DLP für Claude Enterprise
Der Betreiberleitfaden zu Claude Enterprise Inference Hooks – der HTTPS-Webhook, mit dem Ihr DLP-Server jeden Prompt in Chat, Claude Code und Cowork freigeben oder ablehnen kann, bevor das Modell ihn sieht. Vollständige Spezifikation, Verdict-Schema, Signierung, Rollout-Playbook.