Anthropic hat Claude Sonnet 4.6 und Opus 4.6 veröffentlicht: Beide Modelle verfügen erstmals über ein 1-Million-Token-Kontextfenster (Beta) und erzielen laut Anthropic auf dem Agentic-Coding-Benchmark Terminal-Bench 2.0 sowie dem Reasoning-Test “Humanity’s Last Exam” Spitzenwerte unter allen Frontier-Modellen. Für Unternehmen, die KI-gestützte Workflows automatisieren, bedeutet das 1M-Token-Fenster, dass deutlich größere Codebasen, Dokumente und Datensätze in einem einzigen Kontext verarbeitet werden können. Opus 4.6 übertrifft laut Anthropic GPT-5.2 auf dem Praxis-Benchmark GDPval-AA für Wissensarbeit in Finanzen und Recht um rund 144 Elo-Punkte. Sonnet 4.6 ist zum gleichen Preis wie sein Vorgänger erhältlich (ab 3 US-Dollar pro Million Input-Token), was leistungsfähige Agenten-Anwendungen auch für breitere Nutzergruppen zugänglich macht.
Anthropic bringt Claude 4.6: Opus und Sonnet mit 1-Millionen-Token-Kontextfenster und erweitertem Agentic Reasoning
Anthropic hat im Jahr 2025 zwei neue Modelle der 4.6-Generation veröffentlicht: Claude Sonnet 4.6 und Claude Opus 4.6. Beide erweitern das Kontextfenster auf eine Million Token (derzeit in der Beta-Phase) und verbessern die Fähigkeiten für agentic Tasks, Langzeit-Reasoning und Codierung gegenüber ihren Vorgängern.
Was Anthropic zu den Modellen mitteilt
Claude Sonnet 4.6 ersetzt laut Anthropic das bisherige Standardmodell für Free- und Pro-Nutzer auf claude.ai sowie in Claude Cowork. Der Preis bleibt unverändert bei 3 US-Dollar je Million Input-Token und 15 US-Dollar je Million Output-Token, identisch mit Sonnet 4.5. Anthropic beschreibt Sonnet 4.6 als vollständiges Upgrade in den Bereichen Coding, Computer Use, Long-Context-Reasoning, Agent Planning, Knowledge Work und Design. Entwickler, die frühzeitig Zugang hatten, bevorzugten Sonnet 4.6 nach eigenen Unternehmensangaben gegenüber dem Vorgänger und teils sogar gegenüber Claude Opus 4.5.
Claude Opus 4.6 ist als smartestes Modell der Produktlinie positioniert. Laut Anthropic plant es sorgfältiger, hält agentic Tasks länger durch, arbeitet verlässlicher in großen Codebasen und erkennt eigene Fehler beim Code Review und Debugging besser. Opus 4.6 erreicht nach Unternehmensangaben den höchsten Wert auf dem agentic Coding-Benchmark Terminal-Bench 2.0 und führt auf “Humanity’s Last Exam”, einem komplexen multidisziplinären Reasoning-Test. Auf dem GDPval-AA-Benchmark, der Leistung bei ökonomisch relevanten Wissensarbeitsaufgaben in Finanzen und Recht misst, übertrifft Opus 4.6 laut Anthropic das nächstbeste Konkurrenzmodell um rund 144 Elo-Punkte.
Das 1-Millionen-Token-Kontextfenster steht bei Opus 4.6 erstmalig für ein Modell der Opus-Klasse zur Verfügung, bisher war dieses Feature nur kleineren Modellen vorbehalten. Für den Vorgänger Claude 4.5 hatte Anthropic das Kontextfenster noch auf 200.000 Token begrenzt.
Praktische Implikationen für Entscheider
1. Agentic Workflows mit deutlich mehr Kontextkapazität
Das 1-Millionen-Token-Fenster erlaubt es, sehr lange Dokumente, große Codebasen oder umfangreiche Gesprächsverläufe in einem einzigen API-Aufruf zu verarbeiten. Für Anwendungen wie automatisierte Code-Reviews großer Repositories, umfassende Finanz- oder Rechtsanalysen oder mehrstufige Recherche-Workflows entfallen damit viele bisher notwendige Segmentierungsschritte. Wichtig: Das Feature befindet sich laut Anthropic noch in der Beta-Phase, produktive Zuverlässigkeit sollte vorab geprüft werden.
2. Sonnet auf Opus-Niveau bei vielen Office-Aufgaben
Anthropic selbst stellt fest, dass Leistungen, die bisher Opus-Modelle erforderten, nun mit Sonnet 4.6 erreichbar sind. Da Sonnet 4.6 deutlich günstiger als Opus 4.6 ist, können Unternehmen bei nicht-kritischen Knowledge-Work-Aufgaben auf das kostengünstigere Modell wechseln, ohne signifikante Leistungseinbußen in Kauf nehmen zu müssen. Dies beeinflusst direkt die Total Cost of Ownership beim API-Einsatz.
3. Verbessertes Computer Use für automatisierte UI-Steuerung
Sonnet 4.6 verzeichnet laut Anthropic einen deutlichen Sprung bei Computer-Use-Fähigkeiten, also der Steuerung von Desktop-Anwendungen und Browser-Interfaces durch das Modell. Dies ist relevant für Prozessautomatisierung ohne dedizierte RPA-Infrastruktur, etwa in der Sachbearbeitung oder im Datenabgleich.
4. Sicherheitsbewertung laut Anthropic stabil
Anthropic gibt an, Sonnet 4.6 umfangreichen Safety-Evaluierungen unterzogen zu haben. Das Modell sei demnach mindestens so sicher wie andere aktuelle Claude-Modelle. Unternehmen, die in regulierten Branchen tätig sind oder unter dem EU AI Act Compliance-Anforderungen erfüllen müssen, sollten eigene Bewertungen dennoch nicht durch Herstellerangaben ersetzen. Unabhängige Evaluierungsmethoden bleiben ein zentraler Bestandteil der Risikosteuerung.
Zur Einordnung der Modellentwicklung im breiteren Claude-Portfolio empfiehlt sich ein Blick auf die Architektur und Fähigkeiten von Claude 4.5 sowie auf die agentic vs. non-agentic API-Architektur von Claude 4. Wer die Kostenauswirkungen dieser Modellklassen im Unternehmenskontext beurteilen möchte, findet Orientierung in der API-Preisübersicht für Claude 2025 sowie im Kostenvergleich zwischen Anthropic und OpenAI. Für den direkten Vergleich auf Benchmark-Ebene bietet sich der Artikel zu OpenAI o3 vs. Claude 4.5 Reasoning und Multimodalität an.
Quellen
- Introducing Claude Sonnet 4.6 (Anthropic)
- Introducing Claude Opus 4.6 (Anthropic)
- Introducing Claude Opus 4.5 (Anthropic)
Häufige Fragen
Was unterscheidet Claude Sonnet 4.6 von seinem Vorgänger?
Claude Sonnet 4.6 ist laut Anthropic ein vollständiges Upgrade gegenüber Sonnet 4.5. Das Modell zeigt deutliche Verbesserungen in den Bereichen Coding, Computer Use, Long-Context-Reasoning, Agent-Planung, Wissensarbeit und Design. Entwickler mit frühem Zugang bevorzugen Sonnet 4.6 gegenüber seinem Vorgänger in einem klaren Verhältnis und stellten es vielfach sogar mit dem älteren Opus 4.5 vom November 2025 gleich. Der Preis bleibt unverändert bei 3 US-Dollar pro Million Input-Token und 15 US-Dollar pro Million Output-Token.
Was ist neu an Claude Opus 4.6 im Vergleich zu Opus 4.5?
Opus 4.6 verbessert die Programmierfähigkeiten des Vorgängers gezielt: Das Modell plant komplexe Aufgaben sorgfältiger, hält agentische Abläufe länger aufrecht, arbeitet zuverlässiger in größeren Codebasen und erkennt eigene Fehler durch verbesserte Code-Review- und Debugging-Funktionen. Hinzu kommt erstmals für ein Opus-Modell ein Kontextfenster von einer Million Token, das sich derzeit in der Beta-Phase befindet. Auf dem wirtschaftlich orientierten Benchmark GDPval-AA übertrifft Opus 4.6 den nächstbesten Mitbewerber, GPT-5.2 von OpenAI, um rund 144 Elo-Punkte.
Welche Kontextfenster-Größe bieten die neuen Claude-4.6-Modelle?
Sowohl Claude Sonnet 4.6 als auch Claude Opus 4.6 unterstützen in der Beta-Phase ein Kontextfenster von einer Million Token. Bei Opus 4.6 ist dies das erste Mal, dass ein Modell der Opus-Klasse von Anthropic diese Kapazität erhält. Ein Kontextfenster dieser Größe ermöglicht die Verarbeitung sehr umfangreicher Dokumente, langer Gesprächsverläufe und komplexer mehrstufiger Aufgaben in einem einzigen Modelldurchlauf.
Wie gut schlägt sich Opus 4.6 auf Benchmarks für Multi-Agent-Reasoning?
Anthropic gibt an, dass Opus 4.6 auf dem agentischen Coding-Benchmark Terminal-Bench 2.0 die höchste Punktzahl aller getesteten Modelle erzielt. Außerdem führt es das Feld bei Humanity’s Last Exam an, einem komplexen multidisziplinären Reasoning-Test. Auf GDPval-AA, das Leistung bei wirtschaftlich wertvollen Wissensaufgaben in Bereichen wie Finanzen und Recht misst, übertrifft Opus 4.6 den nächstplatzierten Konkurrenten deutlich.
Für welche Nutzergruppen sind die neuen Claude-4.6-Modelle verfügbar und was kostet das?
Claude Sonnet 4.6 ist ab sofort das Standardmodell auf claude.ai für Free- und Pro-Nutzer sowie in Claude Cowork. Der API-Preis bleibt gegenüber Sonnet 4.5 unverändert: 3 US-Dollar pro Million Input-Token und 15 US-Dollar pro Million Output-Token. Claude Opus 4.5, das Vorgängermodell der Opus-Linie, war zu 5 US-Dollar pro Million Input-Token und 25 US-Dollar pro Million Output-Token erhältlich und über die Claude-API sowie alle drei großen Cloud-Plattformen zugänglich. Zu den genauen Preisen von Opus 4.6 hat Anthropic zum Zeitpunkt der Ankündigung keine separaten Angaben gemacht.
Dieser Artikel wurde von einem KI-System automatisiert erstellt. Kennzeichnung gemäß Art. 50 der EU-KI-Verordnung.




