Claude Opus 4.6: Anthropics Angriff auf die Developer-Elite
Neue KI überholt GPT-5.2 bei Coding-Tasks. Agent-Teams arbeiten parallel. Der Preis bleibt gleich.
Claude Opus 4.6 ist verfügbar. Auf claude.ai, via API und auf allen grossen Cloud-Plattformen. Anthropic hat drei Monate nach Opus 4.5 nachgelegt. Das Tempo ist bemerkenswert.
Die Performance-Zahlen sprechen für sich. Terminal-Bench 2.0, der führende Benchmark für agentic coding: 65.4%. Höchste je gemessene Punktzahl. Bei GDPval-AA, das reale Profi-Tasks misst, liegt Opus 4.6 144 Elo-Punkte vor GPT-5.2. Das ist nicht knapp. Das ist eine Ansage.
Was bedeutet das konkret? Das Modell plant sorgfältiger. Es bleibt bei komplexen Tasks länger am Ball. Es navigiert grosse Codebasen zuverlässiger. Und es findet seine eigenen Fehler beim Code-Review. Weniger Babysitting nötig.
Agent-Teams: Die eigentliche Revolution
Claude Code führt Agent-Teams ein. Mehrere KI-Agenten arbeiten parallel an einem Projekt. Jeder übernimmt einen Teil, alle koordinieren sich selbst. Scott White, Head of Product bei Anthropic, vergleicht es mit einem talentierten Menschenteam. Nur schneller.
Die Teams laufen als Research Preview für API-User und Abonnenten. Der Vorteil liegt auf der Hand: Statt sequenziellem Abarbeiten gibt es echte Parallelisierung. Ein Agent prüft Security, einer refactored Code, einer schreibt Tests. Gleichzeitig.
1M Token Kontextfenster
Beta-Feature. Erster Opus mit dieser Kapazität. Verarbeitet massive Codebasen und Dokumentensammlungen ohne Performance-Einbruch. Premium-Pricing über 200k Tokens.
Adaptive Thinking
Modell entscheidet selbst, wann tieferes Nachdenken sinnvoll ist. Vier Effort-Levels: low, medium, high (Standard), max. Spart Kosten bei simplen Tasks.
Context Compaction
Beta. Fasst automatisch ältere Konversationsteile zusammen. Ermöglicht längere Tasks ohne Limit-Crash. Clever.
128k Output Tokens
Verdoppelt von 64k. Längere Thinking-Budgets, umfassendere Antworten. SDKs benötigen Streaming für grosse Requests.
Nicht nur für Devs
Opus 4.6 erweitert den Einsatzbereich. Finanzanalysen über regulatorische Dokumente, Marktberichte, interne Daten. Erstellt Dokumente, Spreadsheets, Präsentationen mit weniger Überarbeitungsschleifen. Besonders für Branchen wie Finanzen und Legal relevant, wo Präzision zählt.
Claude in PowerPoint ist neu. Research Preview für Max, Team und Enterprise. Das Modell liest Layouts, Schriften, Slide-Master. Bleibt on-brand. Generiert komplette Decks oder arbeitet mit Templates. Die Integration ist nativ, kein Export-Umweg mehr nötig.
Excel-Integration hat Updates bekommen. Claude bewältigt längere, anspruchsvollere Tasks. Plant vor der Ausführung. Verarbeitet unstrukturierte Daten, erkennt selbst die richtige Struktur. Multi-Step-Änderungen in einem Durchgang.
Early Access Partner berichten
Notion: "Fühlt sich weniger wie ein Tool an, mehr wie ein fähiger Mitarbeiter." GitHub: "Entsperrt Long-Horizon-Tasks an der Frontier." Replit: "Plant komplexe Aufgaben mit echter Präzision, identifiziert Blocker, führt Tools parallel aus." Asana: "Beste Modell, das wir getestet haben für AI Teammates."
Cursor: "Neue Frontier bei lang laufenden Tasks." Harvey (Legal): "90.2% BigLaw Bench Score. 40% perfekte Scores." Box: "10% Performance-Lift bei High-Reasoning-Tasks, 68% vs. 58% Baseline." Die Rückmeldungen sind konsistent: Opus 4.6 liefert bei komplexen, mehrstufigen Workflows.
Sicherheit bleibt Priorität
Anthropic hat das Modell durch die umfassendste Evaluation-Pipeline geschickt, die sie je eingesetzt haben. Ergebnis: Niedrigste Rate an misaligned behaviors in der Industrie. Weniger Over-Refusals als frühere Modelle. Das heisst, es lehnt harmlose Anfragen seltener ab.
Neue Cybersecurity-Probes erkennen potenziellen Missbrauch. Sechs neue Methoden für verschiedene Bedrohungsformen. Anthropic nutzt das Modell parallel, um Vulnerabilities in Open-Source-Software zu finden und zu patchen. Verteidigung wird beschleunigt.
Pricing und Verfügbarkeit
$5 pro Million Input-Tokens. $25 pro Million Output-Tokens. Unverändert trotz massiver Capability-Sprünge. US-only Inference kostet 1.1x. Verfügbar auf AWS, Google Cloud, Microsoft. API-Modellname: claude-opus-4-6.
Für Premium-Features wie 1M Context Window gilt Premium-Pricing: $10/$37.50 pro Million Tokens über 200k. Context Compaction und Agent-Teams laufen als Beta/Preview. Produktionseinsatz kommt.
Fazit: Anthropic setzt Standards
Claude Opus 4.6 ist kein Marketing-Gag. Es ist ein substanzieller Sprung in Coding-Intelligenz, Autonomie und praktischer Anwendbarkeit. Agent-Teams verändern die Art, wie KI komplexe Projekte angeht. Der Preis bleibt fair.