Skip to content
Zurück zum Index
01FrontierVorläufige Punktzahl

Claude Fable 5

Claude Fable 5

Die beste Antwort, die Geld kaufen kann — und es ist viel Geld.

Aktualisiert am

Claude Fable 5 preview

Die Einschätzung

Anthropics Flaggschiff steht bei nahezu jedem Qualitäts-Benchmark, der noch zwischen Frontier-Modellen unterscheidet, ganz oben — und es ist das einzige, dem man vertraut, stundenlang ohne menschliche Kontrolle jeden einzelnen Schritt zu laufen. Es ist auch mit Abstand das teuerste Modell in diesem Index, und es ist nicht schnell. Greift man es, wenn die Kosten einer falschen Antwort höher sind als die Kosten der Token; nimmt man etwas anderes, wenn das nicht der Fall ist.

Wo es glänzt

  • Hält eine lange, unstrukturierte Aufgabe stundenlang zusammen, ohne abzudriften
  • Führt das Feld bei Software-Engineering-Benchmarks an, die noch nicht gesättigt sind
  • Lehnt sauber ab und erklärt sich, anstatt eine Antwort zu erfinden

Vorher wissenswert

  • Mit Abstand der höchste Preis pro Token von allem, was hier bewertet wird
  • Zu langsam, um der richtige Standard für interaktive Arbeit zu sein

Index-Punktzahl

89.2

Vorläufig. Diese Punktzahl beruht auf den öffentlich dokumentierten Fähigkeiten des Produkts, nicht auf dem Ein-Prompt-Nachbau, den die vollständig geprüften Einträge durchlaufen haben. Verstehen Sie sie als Einordnung, nicht als Urteil.

Craft98
Speed76
Control91
Value70
Rang
01 von 53
Baut für
LLMs
Kategorie
Frontier
Ergebnis
Text, Code und Tool-Aufrufe über eine API
Preis
Nur kostenpflichtig
Am besten für
Lange autonome Läufe, bei denen ein Fehler teuer wird

Die Punktzahlen sind unser eigenes redaktionelles Urteil, gewichtet nach Handwerk 55, Tempo 10, Kontrolle 15 und Preis-Leistung 20.