Logges Modellnotizen

Einsteiger

Mein aktueller Main Driver und ein datierter Kosten-/Qualitätsvergleich mit Daten von Artificial Analysis.

Zuletzt aktualisiert: 13. Sept. 2026

Mein Main Driver

GPT-6 Astra

GPT-6 Astra ist aktuell mein Main Driver.

Das ist meine persönliche Wahl. Die Zahlen unten zeigen separat, wie ausgewählte Konfigurationen bei Artificial Analysis abschneiden.

Drei weitere Modelle auf der Kostenfront

Eine Auswahl aus dem Artificial Analysis Intelligence Index v4.3. Reasoning-Stufe und Modellversion gehören jeweils zum Ergebnis.

Kleines Budget

GPT-5.6 Luna (max)

37,50 Indexpunkte · 0,18 $ pro AA-Aufgabe

Der günstigste Einstieg in dieser Auswahl. Der niedrigere Index bleibt ein Kompromiss, den die eigene Aufgabe rechtfertigen muss.

Modell bei Artificial Analysis

Mehr Indexpunkte pro Aufgabe

GLM-5.3-Flash

41,91 Indexpunkte · 0,25 $ pro AA-Aufgabe

Liegt beim Index über Luna max und kostet hier etwa 0,25 US-Dollar pro Aufgabe. Ein Kandidat für einen eigenen Praxistest.

Modell bei Artificial Analysis

Die höchste Punktzahl in dieser Auswahl

Claude Fable 5.1 (max with fallback)

53,37 Indexpunkte · 7,63 $ pro AA-Aufgabe

Liegt knapp über Astra max, bei mehr als doppelten Kosten pro Aufgabe. Der kleine Indexabstand belegt keinen sicheren Vorteil bei deiner Arbeit.

Modell bei Artificial Analysis

Qualität gegen Kosten

13 ausgewählte Konfigurationen im Vergleich. Ein Modell liegt auf der Pareto-Front, wenn kein anderes in dieser Auswahl mindestens gleich gut und höchstens gleich teuer ist, mit einem echten Vorteil bei mindestens einem der beiden Werte.

Artificial Analysis Intelligence Index v4.3
Intelligence Index und Kosten für 13 ModellkonfigurationenHöher bedeutet mehr Indexpunkte, weiter links geringere Kosten. Rauten markieren die Pareto-Front der Auswahl, Kreise die übrigen Modelle. Der Ring folgt der Auswahl darunter. Alle Zahlen stehen auch in der aufklappbaren Tabelle.35404550550,100,250,5012510Astra maxLuna maxGLM FlashFable max

Kosten pro AA-Index-Aufgabe (USD, logarithmisch)

Front in dieser Auswahl Von einer anderen Konfiguration übertroffen Ausgewählt

Die Kostenachse ist logarithmisch: Gleiche Abstände stehen für gleiche Preisverhältnisse. Die Indexachse beginnt bei 34. Alle Punkte verwenden ungerundete Quelldaten.

Artificial Analysis Intelligence Index v4.3
52,81
Kosten pro AA-Index-Aufgabe
3,26 $

Auf der Front dieser Auswahl

Keine der anderen gezeigten Konfigurationen verbessert einen dieser Werte, ohne den anderen zu verschlechtern.

Alle 13 Konfigurationen und Quellen
Anzeige auf zwei Nachkommastellen gerundet. Die Front wird vor dem Runden berechnet. Fallback gehört zur angegebenen Fable-Konfiguration.
Modell / KonfigurationIndexUSD / AA-AufgabeFront
GPT-6 Astra (low)45,990,82 $Ja
GPT-6 Astra (medium)49,671,54 $Ja
GPT-6 Astra (high)51,051,72 $Ja
GPT-6 Astra (xhigh)52,512,31 $Ja
GPT-6 Astra (max)52,813,26 $Ja
GPT-5.6 Luna (max)37,500,18 $Ja
GLM-5.3-Flash41,910,25 $Ja
Claude Fable 5.1 (xhigh with fallback)53,185,98 $Ja
Claude Fable 5.1 (max with fallback)53,377,63 $Ja
GPT-5.6 Sol (high)42,500,81 $Ja
GPT-5.6 Sol (max)47,061,99 $Nein
DeepSeek V4.1 Flash (max)39,550,27 $Nein
Muse Spark 1.3 (max)48,171,60 $Nein

Was dieser Vergleich aussagt

Der Index bündelt mehrere Benchmarks. Die Kosten pro Aufgabe berücksichtigen deren Tokenverbrauch und Gewichtung, einschließlich Reasoning und Caching. Sie sind kein Kostenvoranschlag für deine Prompts. Die Auswahl umfasst die fünf Astra-Stufen, zwei Fable-Stufen, zwei Sol-Stufen sowie Luna, GLM, DeepSeek und Muse.

Die Front gilt für diese Auswahl und diese zwei Kennzahlen. Tempo, lokale Nutzung, Datenschutz und die Qualität bei deiner konkreten Aufgabe sind darin nicht enthalten. Kleine Punktabstände können innerhalb der Messunsicherheit liegen. Benchmark-Ergebnisse sind keine persönlichen Erfahrungsberichte.

AA ordnet alle fünf Astra-Stufen auch auf seiner umfassenderen Kosten-/Index-Front ein. AA-Analyse vom 9. September 2026

Daten abgerufen am . Fester Datenstand. Keine automatische Live-Aktualisierung.

Archiv: persönliches Ranking vom 22. August 2026

Die damalige Einordnung bleibt hier erhalten: Fable 5 in S+, Sol in A und die separate Google-Reihe. Sie beschreibt diese früheren Versionen und meine damalige Bewertung. Mein aktueller Main Driver steht oben.

S+Der damalige Favorit

Fable 5

AExzellent — Top-Wahl für die meisten Aufgaben

gpt-5.6-sol

BGut — solide Leistung mit einigen Kompromissen

kimi k3

gpt-5.6-luna

deepseek v4 flash

CMittelmäßig — deutliche Schwächen halten sie zurück

Grok 4.6

Muse Spark 1.2

DEnttäuschend — viel versprochen, wenig geliefert

Opus 5

Composer 2.5

glm-5.3

gpt-5.6-terra

Sonnet 5

FUnterste Schublade — einfach nicht

deepseek v4 pro

GoogleGoogle-Modelle in einer eigenen Reihe in Logges Ranking

Gemini 3.7 Flash

Gemini 3.1 Pro