Skip to content
Zurück zum Index
43CodingVorläufige Punktzahl

Mercury 2

Mercury 2

Ein Diffusionsmodell für Text — und es ist um ein Vielfaches schneller als alles, was auf dem üblichen Weg gebaut wurde.

Aktualisiert am

Mercury 2

Die Einschätzung

Mercury erzeugt Text, indem es einen ganzen Entwurf auf einmal verfeinert statt Token für Token, und das Ergebnis ist die höchste gemessene Ausgaberate aller Modelle in diesem Index mit deutlichem Abstand. Für Code-Vervollständigung und andere Fälle, bei denen die Wartezeit die gesamte Nutzererfahrung ist, ist diese Architektur ein echter Vorteil, keine Kuriosität. Qualität ist gut, nicht Frontier, und das Ökosystem drumherum ist winzig.

Wo es glänzt

  • Mit Abstand die höchste gemessene Ausgabegeschwindigkeit von allem, was hier bewertet wird
  • Diffusions-Dekodierung verfeinert einen ganzen Entwurf statt eines Tokens nach dem anderen
  • Stark speziell bei Code-Vervollständigung

Vorher wissenswert

  • Qualität liegt unterhalb der Frontier bei anspruchsvollen Aufgaben
  • Ungewöhnliche Architektur, sodass Tooling-Unterstützung dünn ist

Index-Punktzahl

73.2

Vorläufig. Diese Punktzahl beruht auf den öffentlich dokumentierten Fähigkeiten des Produkts, nicht auf dem Ein-Prompt-Nachbau, den die vollständig geprüften Einträge durchlaufen haben. Verstehen Sie sie als Einordnung, nicht als Urteil.

Craft63
Speed98
Control74
Value88
Rang
43 von 53
Baut für
LLMs
Kategorie
Coding
Ergebnis
Text und Code über eine API
Preis
Nur kostenpflichtig
Am besten für
Code-Vervollständigung, bei der Latenz das Produkt ist

Die Punktzahlen sind unser eigenes redaktionelles Urteil, gewichtet nach Handwerk 55, Tempo 10, Kontrolle 15 und Preis-Leistung 20.