Claude Opus 5 übertrifft Fable 5 in den meisten Benchmarks – zum halben Preis

By: decrypt.co|2026/07/24 18:28:43

Claude Opus 5 ist heute erschienen. Es ist günstiger für Unternehmen zu betreiben als Anthropics führendes Modell, Claude Fable 5, das das Unternehmen als das alltägliche Spitzenprodukt für zahlende Nutzer positioniert hatte. Darüber hinaus übertrifft Opus 5 es auch in wichtigen Benchmarks.

Um zu verstehen, wo Opus 5 passt: Anthropics Produktpalette umfasst vier Stufen. Haiku ist schnell und günstig. Sonnet ist im mittleren Preissegment. Opus ist das Arbeitstier. Darüber hinaus gibt es die Mythos-Klasse – eine Stufe, die Anthropic diesen Frühling eingeführt hat – die Claude Fable 5 für die Öffentlichkeit und Claude Mythos 5, eine Version mit weniger Einschränkungen, die über Project Glasswing für geprüfte Cybersicherheitsforscher und Betreiber kritischer Infrastrukturen reserviert ist, umfasst.

Fable 5 hatte eine schwierige Zeit als Flaggschiff für Abonnenten. Es wurde am 9. Juni gestartet, drei Tage später weltweit zurückgezogen, nachdem die US-Regierung eine Notfall-Ausfuhrkontrollanordnung wegen einer Jailbreak-Sicherheitsanfälligkeit erlassen hatte, und kam am 30. Juni zurück – nur um sofort auf ein Modell nur mit Credits umzustellen, das nicht mehr in den Standardplänen enthalten war. Opus 5 füllt nun die Lücke, die Fable 5 nicht halten konnte.

Lovable, eine Entwicklerplattform mit Millionen von Nutzern, hat Opus 5 in ihren internen Bewertungen getestet und festgestellt, dass die Gewinne über die reinen Punktzahlen hinausgehen: "Es ist nicht nur besser bei unseren schwierigsten agentischen Codierungsaufgaben, 22 % besser als Opus 4.7, es ist auch stabiler, mit viel weniger Varianz von Lauf zu Lauf," sagte Fabian Hedin in einer von Anthropic geteilten Erklärung.

Die Benchmarks

Es mag seltsam erscheinen, aber Opus übertrifft Fable in fast allem, was für den alltäglichen Nutzer wichtig ist, ohne als Mythos-Klasse wie Fable gekennzeichnet zu sein.

Bei Frontier-Bench v0.1 – einem Benchmark, der testet, ob KI-Coding-Agenten echte Software-Engineering-Aufgaben von Anfang bis Ende abschließen können, bewertet als Prozentsatz der bestandenen Aufgaben – erreichte Opus 5 43,3 %. Fable 5 kam auf 33,7 %. OpenAIs GPT-5.6 Sol, Anthropics Hauptkonkurrent, erzielte 34,4 %.

Der größte Abstand besteht bei ARC-AGI-3, einem Test für echtes Problemlösen, der auf neuartigen Rätseln basiert, die ein Modell nicht aus Trainingsdaten hätte auswendig lernen können, bewertet als Prozentsatz der gelösten Rätsel. Opus 5 erreichte 30,2 %; GPT-5.6 Sol erzielte 7,8 %; und Fable 5 wurde überhaupt nicht getestet. Bei GDPval-AA v2 – einem Benchmark für Wissensarbeit, bewertet über Elo-Rankings, das Schach-ähnliche Rankingsystem zur Messung der relativen Leistung bei realen professionellen Aufgaben – erreichte Opus 5 1.861 gegenüber Fable 5s 1.747 und GPT-5.6 Sols 1.736.

Zapier testete Opus 5 auf AutomationBench, einer Bewertung, die misst, ob ein Modell einen vollständigen Geschäftsablauf von Anfang bis Ende ohne menschliche Hilfe durchführen kann. Ihr Urteil: Das Modell "nahm ein rohes Konto-Gesundheits-Arbeitsbuch und führte eine vollständige Abwanderungspräventionssequenz von Anfang bis Ende durch: Kennzeichnung gefährdeter Konten, Benachrichtigung des richtigen Eigentümers und Zusammenfassung für die Retentionsoperationen. Frühere Modelle bestanden nicht; Opus 5 erreichte 100 %."

Anthropic positioniert Opus 5 auch als Forschungsupgrade. Ultima Genomics, ein Unternehmen für DNA-Sequenzierung, sagte, das Modell "verhält sich mehr wie ein sorgfältiger Wissenschaftler als jedes Modell, das wir getestet haben. Es greift nach den richtigen statistischen Tests, um Störfaktoren auszuschließen, überprüft seine eigenen Ergebnisse mit unabhängigen Methoden und bleibt bei langen mehrstufigen Analysen auf Kurs."

Das gesagt, sind diese beiden Bereiche – Recht und Gesundheit – die einzigen, in denen Fable 5 mit einem kleinen Vorsprung glänzt.

Die Veröffentlichung erfolgt eine Woche, nachdem Moonshot AI, ein in Peking ansässiges Startup, das von Alibaba unterstützt wird, Kimi K3 vorgestellt hat – ein 2,8 Billionen Parameter umfassendes Open-Weight-Modell (was bedeutet, dass jeder den zugrunde liegenden Code herunterladen kann, um es unabhängig auszuführen), das Moonshot als das größte offene KI-System der Welt beschreibt. Unabhängige Benchmarks platzieren Kimi K3 konsequent auf dem dritten Platz, hinter sowohl Fable 5 als auch GPT-5.6 Sol, und übertrifft diese beiden in bestimmten Bereichen.

Opus 5 ist jetzt über API für 5 USD pro Million Eingabetokens und 25 USD pro Million Ausgabetokens verfügbar. (Tokens sind die grundlegende Informationseinheit, die ein KI-Modell sowohl bei Eingaben als auch bei Ausgaben verarbeiten kann). Ein schneller Modus, der mit etwa 2,5-mal der Standardgeschwindigkeit läuft, ist ebenfalls verfügbar, zum doppelten Basispreis – 10 USD pro Million Eingabetokens und 50 USD pro Million Ausgabetokens.

Diese Veröffentlichung könnte die Sorgen über die mangelnde öffentliche Verfügbarkeit von Fable 5 beenden. Opus ist auch für alle über ein Abonnement verfügbar.

---Preis

--
--
--

Dieser Inhalt wird nur zu allgemeinen Informationszwecken bereitgestellt und stellt keine finanzielle, Anlage-, Rechts- oder Steuerberatung dar. Alle erwähnten Ereignisse, Prämien, Online-Aktionen oder zugehörige Informationen sollten nicht als Empfehlung, Aufforderung oder Einladung zum Kauf, Verkauf, Handel oder anderweitigem Umgang mit Krypto-Assets betrachtet werden. Krypto-Assets sind sehr volatil und können zu Verlusten führen. Die Verfügbarkeit von WEEX Services, Produkten und zugehörigen Aktionen kann je nach Region unterschiedlich sein. Sie sind dafür verantwortlich sicherzustellen, dass Ihre Teilnahme mit geltenden lokalen Gesetzen und Vorschriften übereinstimmt.

Das könnte Ihnen auch gefallen

Das Altern verläuft nicht linear: Zellen durchlaufen koordinierte Phasen des Verfalls

Eine Analyse von über 20 Millionen Zellen von Mäusen legt nahe, dass das Altern in Phasen voranschreitet und jede Zellpopulation unterschiedlich betroffen ist.

Zellen entdecken eine unerwartete Verteidigung gegen Eisenüberladung

Ein Team des MIT und des Whitehead Institute entdeckte, dass Polyamine als molekulare Speicher fungieren, die Eisen in einem sicheren Zustand innerhalb der Zellen halten. Diese Entdeckung könnte neue Forschungen über Krebs anstoßen und Hinweise für das Studium neurodegenerativer Erkrankungen liefern...

Wenn die erste Charge von Stablecoin-Lizenzen in Hongkong wirklich nur an Banken vergeben wird, könnten wir im nächsten Jahrzehnt etwas verpassen

Es geht nicht um die Verteilung von Vorteilen aus wenigen Lizenzen, sondern darum, ob Hongkong an der Spitze stehen wird, reibungslos in der digitalen Wirtschaft des nächsten Jahrzehnts segeln kann oder bedauerlicherweise nur am Ufer steht und seufzt.

Daten: DNA Fund-zugehörige Wallet hebt über 11.000 ETH von Kraken ab

Laut Lookonchain-Überwachung hat vor etwa 2 Stunden eine mit dem DNA Fund verbundene Wallet 11.067 ETH im Wert von 22.830.000 USD von Kraken abgehoben.

Öffnung der asiatischen Märkte und die Volatilität von Kryptowährungen: Wie beeinflussen Nikkei 225, KOSPI und Yen-Carry-Trades Bitcoin?

Bei der Eröffnung der asiatischen Märkte kann die Volatilität von Bitcoin steigen, wenn Yen-Stärke, Nikkei 225-Futures, KOSPI-Futures und Veränderungen in den offenen Positionen von Kryptowährungen zusammentreffen.

Prognosen zu 'Dollar-Stablecoins' aus Jackson Hole: "Die Dollar-Hegemonie wird stärker werden"

Mit der zunehmenden Verbreitung von Dollar-basierten Stablecoins könnte die internationale Dominanz des US-Dollars sogar gestärkt werden, so eine Analyse. Einige Experten warnen, dass, wenn Bankeinlagen in Stablecoins umgeschichtet werden, die Wirksamkeit der Geldpolitik der Zentralbanken geschwächt...
...

Neueste Artikel

Mehr

Neueste Coin-Listings auf WEEX

iconiconiconiconiconiconicon
Kundenservice:@weikecs
Geschäftliche Zusammenarbeit:@weikecs
Quant-Trading & MM:[email protected]
VIP-Programm:[email protected]