Gerade veröffentlicht: Claude 5.1! Das weltweit stärkste Modell ist da

By: www.chaincatcher.com|2026/09/02 01:28:23

Original von Machine Heart, das sich mit KI beschäftigt
Gerade hat Anthropic die nächste Generation von Modellen, Claude Fable 5.1 und Claude Mythos 5.1, vorgestellt.

Anthropic bezeichnet Claude Fable 5.1 als eines der derzeit leistungsstärksten öffentlich verfügbaren Modelle, das für komplexe Schlussfolgerungen, langfristige Aufgaben und Agenten-Workflows entwickelt wurde. Claude Mythos 5.1 hingegen repräsentiert die Erkundung höherer Leistungsgrenzen.

Es ist wichtig zu beachten, dass beide Modelle zwar über dieselben grundlegenden Modellfähigkeiten verfügen, jedoch unterschiedliche Sicherheitsmaßnahmen für verschiedene Nutzungsszenarien implementiert wurden.

Fable 5.1 ist für allgemeine Benutzer, Entwickler und Unternehmen zugänglich, während Mythos 5.1 für geprüfte Partner in Hochrisikobereichen mit strengeren Zugangskontrollen vorgesehen ist.

Mit anderen Worten, eines ist dafür verantwortlich, in der realen Welt zu arbeiten, während das andere in einer strengeren kontrollierten Umgebung bleibt. Dies könnte auch eine Erkundung von Anthropic in Bezug auf zukünftige KI-Produktformen sein: das stärkste Modell wird nicht unbedingt in derselben Form für alle bereitgestellt.

Offiziell wird erklärt, dass diese beiden Modelle einen wichtigen Fortschritt in den Fähigkeiten der Claude-Serie darstellen und zeigen, wie sie die Modellfähigkeiten verbessern und gleichzeitig die sichere Bereitstellung vorantreiben.

Als das "stärkste" Modell bleibt Fable 5.1 leistungsstark, und offizielle Daten zeigen, dass Fable 5.1 in mehreren Benchmark-Tests besser abschneidet als die vorherige Flaggschiff-Version Fable 5.

Aber mit mehr Leistung ist der Preis gesunken. Anthropic gibt an, dass der Grundpreis von Fable 5.1 unverändert bleibt, die Kosten für das Caching sind im Vergleich zu Fable 5 um 75 % gesenkt worden. In der praktischen Anwendung senkt dies die Gesamtkosten des Modells für typische Arbeitslasten um etwa 25 %; für stark agentenbasierte Arbeitslasten können die Kosten um bis zu 45 % gesenkt werden.

Es scheint, dass selbst das stärkste Modell Wert auf das Preis-Leistungs-Verhältnis legt.

Schauen wir uns die Details an.

Niedrigere Stufen erreichen das Niveau der vorherigen Generation, Fable 5.1 setzt auf "Preis-Leistungs-Verhältnis"

Im Vergleich zu einer bloßen Aktualisierung der Rangliste möchte Anthropic diesmal betonen, dass Fable 5.1 mit niedrigeren Inferenzkosten Aufgaben erledigen kann, die zuvor nur mit den höheren Stufen von Fable 5 möglich waren.

Laut offiziellen Tests hat Fable 5.1 bei niedriger und mittlerer Inferenzintensität bereits Leistungen erzielt, die nahe an oder sogar über denen von Fable 5 liegen. Claude Code verwendet standardmäßig eine hohe Inferenzintensität, während Claude Cowork und Claude .ai standardmäßig eine mittlere Intensität verwenden. Benutzer können auch je nach Komplexität der Aufgabe zwischen Geschwindigkeit, Kosten und Effizienz anpassen.

Konkret hat Fable 5.1 im wissenschaftlichen Forschungs-Agenten-Benchmark Terminal - Bench - Science 0.1 eine Punktzahl von 52,6 % erreicht, was mehr als eine Verdopplung im Vergleich zu Fable 5 mit 24,7 % darstellt; im Terminal - Bench 4.0 erreichte Fable 5.1 55,8 %, während das offenere Mythos 5.1 weiter auf 60,9 % anstieg.

In Tests zur Wissensarbeit, Computeroperationen und Geschäftsprozessen erzielte das neue Modell ebenfalls Verbesserungen. Die AutomationBench-Punktzahl stieg von 17,1 % bei Fable 5 auf 31,4 %, während CursorBench 3.2.0 von 70,5 % auf 73,4 % anstieg.

In mehreren Benchmark-Tests übertraf Fable 5.1 die Ergebnisse von Fable 5, wobei die Verbesserungen bei wissenschaftlichen Forschungs-Agenten und Geschäftsabläufen am deutlichsten waren.

Im Terminal - Bench 4.0-Test übertraf Fable 5.1 zusammen mit Mythos 5.1 in verschiedenen Inferenzintensitäten die vorherige Generation Mythos 5.

Im Terminal - Bench - Science 0.1-Test erreichte Fable 5.1 die höchste Punktzahl von 52,6 %, was mehr als das Doppelte von Fable 5 ist.

Anthropic glaubt, dass eine wichtige Veränderung bei Fable 5.1 darin besteht, dass es eher bereit ist, die zugrunde liegenden Ursachen von Problemen zu verfolgen und besser geeignet ist, komplexe Aufgaben über mehrere Stunden oder sogar Tage hinweg auszuführen.

Die Investmentfirma Millennium stellte in Tests fest, dass ein interner Code etwa einmal pro Million Ausführungen abstürzt. Dieses Problem plagte das Ingenieurteam vier bis fünf Jahre lang, und andere Modelle konnten die Ursache nicht finden. Fable 5.1 konnte das Problem schließlich lokalisieren, indem es externe Programmbibliotheken disassemblierte und Kern-Dump-Dateien verglich, und fand einen Bug in einer Drittanbieter-Bibliothek.

Ramp ließ Fable 5.1 auch 38 Stunden lang ununterbrochen laufen. Das Modell erkannte, dass die ursprünglichen Ergebnisse des maschinellen Lernens durch fehlerhafte Labels beeinflusst wurden, korrigierte das Problem selbst und startete sechs Experimente gleichzeitig, um schließlich neue Ergebnisse und Empfehlungen zu erstellen.

Vom Programmieren bis zur wissenschaftlichen Forschung

In dieser Veröffentlichung widmete Anthropic einen erheblichen Teil der Präsentation der Leistung von Fable 5.1 und Mythos 5.1 in der wissenschaftlichen Forschung.

In einem Experiment zur Proteindesign ließ das Forschungsteam Mythos 5.1 Open-Source-Tools für Proteindesign und -faltung verwenden und die generierten Designs von zwei externen Institutionen experimentell validieren.

Bei drei Zielproteinen erreichte die von Mythos 5.1 entworfene Bindungsaffinität das Zehnfache des besten Ansatzes im Adaptyv Bio-Wettbewerb für Proteindesign. Bei 12 Zielproteinen lag die Trefferquote der vom Modell entworfenen effektiven Bindemittel bei fast 50 %, während Anthropic einen branchenüblichen Wert von 10 % bis 15 % angibt.

Fable 5.1 nutzte auch Radarbilder, die vor über 30 Jahren von der NASA-Mission Magellan gesammelt wurden, um eine neue hochauflösende Höhenkarte von etwa einem Drittel der Oberfläche der Venus zu erstellen.

Radarbild der Venus, aufgenommen von der NASA-Mission Magellan, zeigt in der Mitte einen kleinen Schildvulkan mit einem Durchmesser von etwa 15 Kilometern.

Die ursprüngliche Karte konnte nur Details im Maßstab von 10 bis 20 Kilometern darstellen, während die neue Karte die Auflösung auf 2 bis 3 Kilometer erhöht und die Genauigkeit der Höhenmessung um bis zu 25 % verbessert. Anthropic plant, diese Karte unter einer Wissensaustauschlizenz öffentlich zugänglich zu machen, um sie für nachfolgende Missionen wie NASA VERITAS und die European Space Agency EnVision zu verwenden.

Im Bereich der computergestützten Biologie hat Mythos 5.1 durch das Schreiben benutzerdefinierter GPU-Kerne und das Caching von Zwischenergebnissen die Ausführungsgeschwindigkeit von sieben Open-Source-Proteinen und Genom-Deep-Learning-Modellen um bis zu 2,5-fach erhöht, während die Ausgabeergebnisse konsistent blieben. Bei bestimmten Aufgaben zur vollständigen Genomanalyse wird erwartet, dass die GPU-Kosten um 30 % bis 60 % gesenkt werden können.

Nach der Optimierung von sieben Open-Source-Proteinen und Genom-Modellen durch Mythos 5.1 wurde die Inferenzgeschwindigkeit um 1,4 bis 2,5-fach erhöht.

Anthropic möchte mit diesen Beispielen beweisen, dass die Modelle von der Organisation von Informationen und dem Programmieren weiter zu Vorschlägen, dem Ausführen von Werkzeugen und der Bereitstellung von experimentell validierbaren Forschungsergebnissen übergehen.

Caching-Preise um 75 % gesenkt, Agentenaufgaben um bis zu 45 % günstiger

Neben der Leistung ist der Preis eine der direktesten Veränderungen bei Fable 5.1.

Die Preise für Eingaben und Ausgaben von Fable 5.1 wurden nicht angepasst und bleiben bei 10 USD pro Million Tokens für Eingaben und 50 USD für Ausgaben, während die Preise für das Caching um 75 % auf 0,25 USD pro Million Tokens gesenkt wurden.

Caching bezieht sich auf die wiederholte Verwendung bereits verarbeiteter Kontexte durch das Modell. Der Anteil in normalen Frage-Antwort-Szenarien könnte begrenzt sein, aber bei Agentenaufgaben, die häufige Wiederholungen von Codebibliotheken, historischen Dialogen und Werkzeugergebnissen erfordern, stellt das Caching oft die Hauptkosten dar.

Laut Anthropic basieren die Schätzungen für die tatsächliche Nutzung im August 2026 darauf, dass die Gesamtkosten für typische Aufgaben mit Fable 5.1 etwa 25 % niedriger sind als mit Fable 5; für komplexe Agentenaufgaben mit längeren Kontexten und häufigen Werkzeugaufrufen kann die Kostenreduktion bis zu 45 % betragen.

Nach der Senkung der Preise für das Caching sind die Gesamtkosten für typische Aufgaben mit Fable 5.1 um etwa 25 % gesenkt worden, während die Kosten für hoch agentenbasierte Aufgaben um bis zu 45 % gesenkt wurden.

Fable 5.1 ist jetzt auf Claude .ai, Claude Code und Claude API verfügbar und wird über AWS, Google Cloud und Microsoft Azure bereitgestellt. Entwickler können das neue Modell über claude - fable -5-1 aufrufen.

Verstärkter Schutz gegen Dystillierung

Fable 5.1 und Mythos 5.1 verwenden tatsächlich dasselbe zugrunde liegende Modell, wobei der Hauptunterschied in den Sicherheitsbeschränkungen liegt.

Fable 5.1 ist für allgemeine Benutzer und Unternehmen vollständig zugänglich; Mythos 5.1 hat jedoch lockerere Netzwerksicherheits- und biowissenschaftliche Einschränkungen und wird derzeit nur an geprüfte Einzelpersonen und Institutionen bereitgestellt.

Im Bereich der Netzwerksicherheit kann Fable 5.1 Benutzern helfen, Softwareanfälligkeiten zu entdecken, kann jedoch keine Exploit-Programme direkt generieren. Aufgaben mit doppeltem Verwendungszweck wie Penetrationstests, Exploit-Generierung und binärdateibasiertes Scannen von Schwachstellen müssen weiterhin von Modellen mit strengeren Einschränkungen bearbeitet werden.

Nach Anpassungen wurde die Anzahl der Fehlalarme im neuen Netzwerk-Sicherheitsmechanismus um etwa 60 % im Vergleich zu Fable 5 reduziert. Die Fehlalarmrate des biowissenschaftlichen Mechanismus bei grundlegenden biologischen und medizinischen Fragen wurde ebenfalls um 85 % gesenkt, während fortgeschrittene Fähigkeiten im Bereich der biowissenschaftlichen Forschung hauptsächlich über das Prüfprogramm von Mythos 5.1 bereitgestellt werden.

Anthropic hat auch die Enterprise Frontier Safeguards eingeführt. Unternehmen können ihre Daten in ihrer eigenen kontrollierten Cloud-Infrastruktur speichern, wobei das Unternehmen für die standardmäßige manuelle Überprüfung verantwortlich ist, um die Sicherheitsüberwachungsfähigkeiten zu erhalten und gleichzeitig eine nahezu "Null-Daten-Aufbewahrung"-Privatsphäre zu erreichen. Dieses System soll schrittweise ab diesem Herbst eingeführt werden.

Für die Dystillierung großer Modelle hat Fable 5.1 ebenfalls neue Einschränkungen eingeführt. API-Konten, die nach diesem Tag erstellt wurden, können den vorherigen Kontext in mehrstufigen Dialogen nicht mehr manuell ändern, während sie die Historie von Claude beibehalten. Anthropic erklärt, dass diese Änderung hauptsächlich dazu dient, eine bereits veröffentlichte Methode zur Extraktion von Fähigkeiten zu blockieren.

Darüber hinaus wird die Textausgabe von Fable 5.1 unsichtbare Wasserzeichen enthalten, um den Anforderungen des EU-Gesetzes über künstliche Intelligenz gerecht zu werden. Anthropic hat auch mit ersten Tests zur Erkennung von APIs begonnen, die zunächst für Regulierungsbehörden, Medien, Faktenprüfungsorganisationen und Forschungsinstitute geöffnet sind.

Schließlich haben die Nutzer recht: Der frühe Vogel nutzt 5.1 zuerst.

---Preis

--
--
--

Dieser Inhalt wird nur zu allgemeinen Informationszwecken bereitgestellt und stellt keine finanzielle, Anlage-, Rechts- oder Steuerberatung dar. Alle erwähnten Ereignisse, Prämien, Online-Aktionen oder zugehörige Informationen sollten nicht als Empfehlung, Aufforderung oder Einladung zum Kauf, Verkauf, Handel oder anderweitigem Umgang mit Krypto-Assets betrachtet werden. Krypto-Assets sind sehr volatil und können zu Verlusten führen. Die Verfügbarkeit von WEEX Services, Produkten und zugehörigen Aktionen kann je nach Region unterschiedlich sein. Sie sind dafür verantwortlich sicherzustellen, dass Ihre Teilnahme mit geltenden lokalen Gesetzen und Vorschriften übereinstimmt.

Das könnte Ihnen auch gefallen

iconiconiconiconiconiconicon
Kundenservice:@weikecs
Geschäftliche Zusammenarbeit:@weikecs
Quant-Trading & MM:[email protected]
VIP-Programm:[email protected]