Anthropic veröffentlicht Claude Opus 4.8: Schneller, günstiger und zuverlässiger

Anthropic hat das neueste KI-Modell Claude Opus 4.8 veröffentlicht. Es erscheint weniger als zwei Monate nach der Vorgängerversion 4.7 und beschleunigt damit das Update-Tempo des Unternehmens. Das neue Modell soll als besserer Mitarbeiter arbeiten, mit schärferem Urteilsvermögen und größerer Ehrlichkeit bei Unsicherheiten. Parallel dazu führt Anthropic neue Features wie dynamische Workflows und Effort Control ein. Für Entwickler und professionelle Nutzer ist das Update relevant, weil es sowohl Geschwindigkeit als auch Zuverlässigkeit verbessert.
Schneller und günstiger
Das Fast-Mode von Opus 4.8 arbeitet rund 2,5-mal schneller als die Vorgängerversion und kostet gleichzeitig drei Mal weniger. Während der reguläre Modus mit 5 Dollar pro Million Eingabe-Token und 25 Dollar pro Million Ausgabe-Token priced bleibt, sinkt der Fast-Mode auf 10 Dollar pro Million Eingabe-Token und 50 Dollar pro Million Ausgabe-Token. In den Benchmarks zeigt sich der Fortschritt deutlich: Die Coding-Bewertung für agentic tasks steigt von 64,3 auf 69,2 Prozent, multidisziplinäre Reasoning mit Tools von 54,7 auf 57,9 Prozent. Bei agentic computer use improves von 82,8 auf 83,4 Prozent, Wissensarbeit von 1753 auf 1890 Punkte, und Finanzanalyse von 51,5 auf 53,9 Prozent. Auf dem Super-Agent-Benchmark ist Opus 4.8 das einzige Modell, das alle Fälle durchgängig abschließt und dabei GPT-5.5 bei gleichen Kosten übertrifft.
Ehrlicher und zuverlässiger
Eine der prominentesten Verbesserungen ist die Ehrlichkeit des Modells. Frühe Tester berichten, dass Opus 4.8 Unsicherheiten in seiner Arbeit häufiger markiert und weniger unbegründete Behauptungen aufstellt. Die Evaluierungen zeigen, dass das Modell rund vier Mal weniger wahrscheinlich Fehler in geschriebenem Code unkommentiert durchgehen lässt als sein Vorgänger. In der Alignment-Bewertung erreicht Opus 4.8 neue Höchstwerte bei prosozialen Eigenschaften wie Unterstützung der Nutzerautonomie und Handeln im besten Interesse des Nutzers. Die Raten für fehlalignedes Verhalten, etwa Täuschung oder Kooperation mit Missbrauch, liegen deutlich niedriger als bei Opus 4.7 und entsprechen dem Niveau des best-aligneden Modells Claude Mythos Preview. Auf dem Legal Agent Benchmark erzielt Opus 4.8 den höchsten je recorded Score und ist das erste Modell, das die 10-Prozent-Marke beim all-pass-Standard überschreitet.
Neue Features und Workflows
Parallel zum Modell-Update führt Anthropic mehrere neue Features ein. Dynamische Workflows in Claude Code, verfügbar in Research Preview, ermöglichen es dem Modell, extrem große Aufgaben zu bewältigen. Claude kann die Arbeit planen und dann Hunderte paralleler Subagents in einer einzigen Session ausführen, bevor es die Ergebnisse verifiziert und dem Nutzer zurückmeldet. So kann Claude Code mit Opus 4.8 Codebase-scale Migrations über Hunderttausende Codezeilen von Start bis Merge durchführen. Effort Control in claude.ai und Cowork erlaubt Nutzern, die Anstrengung des Modells zu steuern — höhere Settings führen zu tieferem Denken, niedrigere zu schnelleren Antworten. Die Messages API akzeptiert nun System-Einträge innerhalb des Messages Arrays, sodass Entwickler Anweisungen während einer Aufgabe aktualisieren können, ohne den Prompt Cache zu brechen. Opus 4.8 verwendet standardmäßig High Effort, was Anthropic als beste Balance zwischen Qualität und Nutzererfahrung bewertet. Nutzer können Extra oder Max wählen für schwierigere Aufgaben. Anthropic kündigt zudem ein Mythos-KI-Modell für alle Kunden in den kommenden Wochen an, das aktuell nur ausgewählten Stakeholdern für Cybersicherheitsarbeit zugänglich ist.
Zusammenfassung
Anthropic hat Claude Opus 4.8 veröffentlicht, das weniger als zwei Monate nach Vorgänger 4.7 erscheint. Das Fast-Mode ist 2,5-mal schneller und drei Mal günstiger, während das Modell insgesamt zuverlässiger und ehrlicher bei Unsicherheiten arbeitet. Neue Features wie dynamische Workflows in Claude Code und Effort Control in claude.ai ergänzen das Update. Ein Mythos-KI-Modell für alle Kunden steht in den kommenden Wochen an.
Das könnte dich auch interessieren
Weitere Geschichten aus Technik News.

Claude Cowork auf Mac: KI-Agent bricht aus Sandbox aus und greift auf alle Dateien zu
Sicherheitsforscher haben eine kritische Schwachstelle in Anthropics KI-Tool Claude Cowork entdeckt, die unbegrenzten Zugriff auf Mac-Daten ermöglichte. Anthropic hat gepatcht, aber lokale Nutzer müssen sich manuell absichern.

Apple-Strategie-Wende, KI-Integration und regulatorischer Druck: KW 30 im Rückblick
Apple bricht mit etablierten Veröffentlichungszyklen, die Software-Entwicklung priorisiert Effizienz und künstliche Intelligenz, während regulatorische Eingriffe die globalen Lieferketten unter Druck setzen.

Anthropic stellt Claude Opus 5 vor – fast Fable-5-Niveau zur Hälfte des Preises
Anthropic hat Claude Opus 5 veröffentlicht und damit sein Flaggschiff-Modell deutlich leistungsfähiger gemacht. Das Upgrade kostet nur die Hälfte des Top-Modells Fable 5 und wird von zwei neuen API-Features begleitet.

San Francisco fordert Entfernung von acht KI-Apps zur Nacktbild-Erzeugung
Der Stadtrechtsanwalt von San Francisco hat Apple und Google zur Entfernung von acht KI-Anwendungen aufgefordert, die nicht einvernehmliche Nacktbilder generieren. Beide Unternehmen stehen nun unter rechtlichem Druck.

OpenAI erklärt E-Mail-Chaos nach Apples Klage
OpenAI entkräftet den Vorwurf, man habe auf Apples rechtliche Schritte ignoriert. Die KI-Firma führt den Kommunikationsabbruch auf eine Verwechslung durch die Anwälte der Gegenpartei zurück.

iOS 27, Hardware-Split und regulatorischer Druck: KW 27 im Rückblick
iOS 27 priorisiert lokale Sicherheit und KI-Integration. Apple differenziert die iPhone-18-Hardware aus und passt sich neuen Compliance-Anforderungen an.
Kommentare
Sei der Erste, der hier kommentiert.
Du musst angemeldet sein, um zu kommentieren.