Modell-Veröffentlichung

Claude Opus 4.8: Was Anthropic tatsächlich ausgeliefert hat

Claude Opus 4.8 wurde am 28. Mai 2026 veröffentlicht und bietet stärkeres agentisches Coding, mehr Ehrlichkeit bezüglich der eigenen Arbeit, standardmäßig „high effort“, dynamische Workflows in Claude Code und einen günstigeren Fast Mode. Diese Analyse verwendet ausschließlich offizielle Quellen von Anthropic und Claude.

Redaktionelle Helden-Illustration für Claude Opus 4.8, die Benchmark-Panels, Dashboards für Code-Reviews und lang laufende agentische Aufgaben zeigt.

Get the latest on AI, LLMs & developer tools

New MCP servers, model updates, and guides like this one — delivered weekly.

Was es ist

Claude Opus 4.8 ist das neueste allgemein verfügbare Opus-Modell von Anthropic. Die offizielle Dokumentation beschreibt es als das leistungsfähigste Modell des Unternehmens für komplexes Schlussfolgern, langfristiges agentisches Coding und hochautonome Arbeit. Einfach ausgedrückt: Dieses Release richtet sich an Aufgaben, bei denen das Modell den Status beibehalten, Tools verwenden, seine eigene Arbeit überprüfen und über einen normalen Chat-Turn hinaus fortfahren muss.

Die Modell-ID lautet claude-opus-4-8Die Dokumentation führt ein 1M Token Kontextfenster für die Claude API, Amazon Bedrock und Vertex AI auf, sowie ein 200k Token Kontextfenster für Microsoft Foundry zum Start. Der maximale synchrone Messages API Output liegt bei 128k Token.

Model:        Claude Opus 4.8
API ID:       claude-opus-4-8
Context:      1M tokens on Claude API, Bedrock, Vertex AI
Output:       128k tokens on synchronous Messages API
Default effort: high
Regular API:  $5 input / $25 output per MTok
Fast mode:    $10 input / $50 output per MTok

Offizielle Ankündigung

Der Start begann mit dem offiziellen Claude-Account auf X und dem Launch-Beitrag von Anthropic. Die Aussage ist spezifisch: Opus 4.8 baut auf Opus 4.7 auf und bietet ein schärferes Urteilsvermögen, mehr Ehrlichkeit bezüglich des Fortschritts sowie die Fähigkeit, länger unabhängig zu arbeiten.

Der Launch-Beitrag von Anthropic ergänzt drei damit verbundene Produktänderungen: Effort Control in claude.ai und Cowork, dynamische Workflows in Claude Code sowie den Fast Mode für Opus 4.8. Das ist wichtig, da die Modellveröffentlichung nicht nur ein einfacher Austausch des Checkpoints ist. Sie verändert, wie Entwickler den Aufwand festlegen, Prompts cachen und längere Agent-Runs strukturieren sollten.

Benchmark-Tabelle

Die System Card von Anthropic liefert die nützlichste verifizierte Tabelle. Die unten stehenden Zahlen wurden als Fakten aus der offiziellen System Card übernommen und sollten als Evaluierungen vor der Bereitstellung verstanden werden, nicht als Versprechen, dass sich jede Produktions-Workload im gleichen Maße verbessert.

EvaluierungOpus 4.8Opus 4.7Worauf man achten sollte
SWE-bench Verified88.687.6Leichte Verbesserung bei verifizierten echten GitHub Issues.
SWE-bench Pro69.264.3Der signifikante Coding-Sprung aus dem ClaudeDevs-Thread.
Terminal-Bench 2.174.666.1Deutlicher Zuwachs bei Aufgaben für Command-Line-Agents.
OSWorld-Verified83.482.8Leichter Zuwachs bei realen Computer-Use-Aufgaben unter Ubuntu.
GraphWalks BFS 256K85.976.9Die Graph-Traversierung bei langem Kontext verbessert sich deutlich.
GraphWalks Parents 256K99.393.6Starkes Ergebnis bei der Zustandsverfolgung (State-Tracking) mit langem Kontext.

Die System Card berichtet zudem, dass Opus 4.8 bei FrontierSWE sowohl bei mean@5 als auch bei best@5 den ersten Platz belegt. Da dieser Benchmark den Agents 20 Stunden pro Aufgabe einräumt, deckt er sich mit der Positionierung von Anthropic: Dieses Release ist am stärksten, wenn die Arbeit umfangreich, komplex und tool-intensiv ist.

Was hat sich geändert

Für Entwickler sind die wichtigsten Änderungen nicht kosmetischer Natur. Opus 4.8 verwendet standardmäßig high effort auf allen Oberflächen, unterstützt Systemnachrichten während laufender Konversationen, senkt die Mindestlänge für den prompt-cache auf 1.024 Token und behält die Einschränkungen von Opus 4.7 bezüglich Sampling und Thinking bei. Wenn Ihre Anfrage weiterhin temperature, top_p, top_k mit Werten ungleich der Standardeinstellungen sendet, lehnt die Messages API diese ab.

Manuelle Budgets für erweitertes Thinking werden unter Opus 4.8 ebenfalls nicht unterstützt. Verwenden Sie adaptives Thinking mit thinking: {type: "adaptive"}, und steuern Sie die Tiefe dann über output_config.effort. Anthropic empfiehlt xhigh für Programmierung und high der Standard für die meisten intelligenzsensiblen Aufgaben ist.

client.messages.create({
  model: "claude-opus-4-8",
  max_tokens: 64000,
  thinking: { type: "adaptive" },
  output_config: { effort: "xhigh" },
  messages: [{ role: "user", content: "Audit this migration plan." }]
})

Preisgestaltung

Die reguläre API-Preisgestaltung für Opus 4.8 ist gegenüber Opus 4.7 unverändert: 5 $ pro Million Input-Token und 25 $ pro Million Output-Token. Der Fast-Modus für Opus 4.8 ist günstiger als der Fast-Modus bei früheren Opus-Modellen: Der Launch-Beitrag nennt 10 $ pro Million Input-Token und 50 $ pro Million Output-Token.

Die praktische Interpretation ist einfach. Der Standard-Modus ist die Voreinstellung für lange autonome Aufgaben. Der Fast-Modus ist für latenzempfindliche Interaktionen, Live-Debugging und schnelle Iterationen gedacht, bei denen sich die höheren Kosten für die Ausgabegeschwindigkeit lohnen.

Sicherheitshinweise

The official system card is not pure launch marketing. It says Opus 4.8 improves over Opus 4.7 on most alignment measures and is much less likely to leave flaws in its own code unreported. The launch post summarizes that as roughly four times less likely than Opus 4.7 to let flaws in written code pass unremarked.

Dieselbe Systemkarte weist auf einen Vorbehalt hin: Opus 4.8 war in einigen Kontexten von agentischen Prompt-Injections vor der Implementierung zusätzlicher Schutzmaßnahmen etwas weniger robust als Opus 4.7. Anthropic gibt an, dass die bereitgestellten Schutzmaßnahmen diese Lücke in der Praxis schließen. Wenn Sie einen Agenten entwickeln, der nicht vertrauenswürdige Webseiten, E-Mails, Tickets oder Repository-Inhalte liest, sollte dieser Hinweis in Ihr Bedrohungsmodell aufgenommen werden.

Wer sollte es verwenden

Verwenden Sie Opus 4.8 primär für lange Programmiersitzungen, Refactorings auf Repository-Ebene, tiefgreifende Code-Reviews, professionelle Dokumentenanalyse, Recherchen mit vielen Quellen sowie Agenten-Schleifen, die einen stabilen Plan über viele Tool-Aufrufe hinweg benötigen. Verwenden Sie Sonnet oder Haiku, wenn Latenz, Kosten oder ein hoher Durchsatz wichtiger sind als maximale Reasoning-Qualität.

Das Fazit ist präzise, aber klar: Opus 4.8 ist keine dramatisch neue Produktkategorie. Es ist ein besseres Opus für die Bereiche, in denen Opus bereits wichtig war: anspruchsvolle Entwicklungsarbeit, langer Kontext und Agenten, die Unsicherheit eingestehen müssen, bevor sie Fehler verursachen.

Migrationshinweise

  • Aktualisiere den Modell-String auf claude-opus-4-8.
  • Entferne nicht standardmäßige Sampling-Parameter, falls du diese noch übergibst.
  • Nutze adaptives Denken statt manueller Vorgaben budget_tokens.
  • Lege den Aufwand (effort) für Produktions-Workloads explizit fest.
  • Entferne alte 1M-Context-Beta-Header bei der Claude API, Bedrock und Vertex AI.
  • Erwäge Systemnachrichten mitten im Gespräch für lang laufende Prozesse.
  • Führe eine neue Baseline-Messung für Kosten und Latenz durch, da sich die Aufwandsebenen geändert haben.

FAQ

Was ist Claude Opus 4.8?

Claude Opus 4.8 ist das neueste allgemein verfügbare Opus-Modell von Anthropic, das am 28. Mai 2026 veröffentlicht wurde. Anthropic positioniert es für komplexes Schlussfolgern, langfristige agentische Programmierung und hochautonome Aufgaben.

Wie lautet die API-Modell-ID für Claude Opus 4.8?

Die Claude API-Modell-ID lautet claude-opus-4-8. Anthropic listet zudem passende First-Party-IDs für Vertex AI und Claude Platform auf AWS sowie ein Bedrock-spezifisches ID-Format auf.

Wie viel kostet Claude Opus 4.8?

Die reguläre API Nutzung bleibt gegenüber Opus 4.7 unverändert: 5 $ pro Million Input-Token und 25 $ pro Million Output-Token. Der Fast Mode für Opus 4.8 kostet 10 $ pro Million Input-Token und 50 $ pro Million Output-Token.

Was ist die größte Änderung für Entwickler in Opus 4.8?

Die wichtigsten Plattform-Änderungen sind standardmäßig „high effort“, standardmäßig 1M Kontext bei der Claude API, adaptives Denken, System-Nachrichten mitten im Gespräch, niedrigere Mindestwerte für den Prompt-Cache und eine verbesserte Wiederherstellung bei langem Kontext.

Ist Claude Opus 4.8 besser als Opus 4.7?

Anthropic bezeichnet es als eine moderate, aber spürbare Verbesserung. Die System-Card weist in den meisten Fähigkeitsbewertungen höhere Werte als Opus 4.7 auf, darunter SWE-bench Pro, Terminal-Bench 2.1 und GraphWalks.

Offizielle Quellen

Verwandt: der Leitfaden für dynamische Workflows in Claude Code und der API-Migrationsleitfaden für Opus 4.8.