Navigation
Advertise here

GPT-6 Luna Decisions (default) vs Tev1 4B Experimental (default)

GPT-6 Luna Decisions (default) führt beim Durchschnittsscore mit 2.4 vs 1.0. Tev1 4B Experimental (default) hat die niedrigeren Benchmark-Kosten mit $0.002 vs $0.005. GPT-6 Luna Decisions (default) ist schneller mit 495ms vs 498ms, mit Erfolgsraten von 13.0% vs 13.0%.

Benchmarks aus AI BENCHY-Test-Suites generiert am: 2026-10-07

Verglichene Modelle

Rang
#390
Gesamte Ausgabe-Token
0
Antwortzeit (Durchschnitt)
495ms
Gesamtkosten
$0.005
Rang
#397
Gesamte Ausgabe-Token
96
Antwortzeit (Durchschnitt)
498ms
Gesamtkosten
$0.002
Empfohlenes Modell GPT-6 Luna Decisions (default)

Es hat die stärkste Punktzahl in diesem Vergleich (2.4) und die beste Gesamtbalance aus Kosten und Antwortzeit über alle 2 Modelle.

Detaillierter Vergleich

Metrik GPT-6 Luna Decisions GPT-6 Luna Decisions default Veröffentlichung: 2026-10-07 Tev1 4B Experimental Tev1 4B Experimental default Veröffentlichung: 2026-09-30
Punktzahl 2.4 1.0
Rang #390 #397
Zuverlässigkeit 10.0 10.0
Konsistenz 5.2 3.0
Versuche 36/69 21/69
Korrekte Tests
Erfolgsquote pro Versuch 13.0% 13.0%
Instabile Tests 0 0
Gesamtläufe 36 21
Kosten pro Ergebnis 0.159 0.048
Gesamtkosten $0.005 $0.002
Eingabepreis $0.100 / 1M $0.042 / 1M
Ausgabepreis $0.000 / 1M $0.000 / 1M
Preis für Cache-Lesen $0.000 / 1M k. A.
Preis für Cache-Schreiben $0.000 / 1M k. A.
Gesamte Eingabe-Token 47,583 33,864
Ausgabe-Token 0 96
Denk-Token 0 0
Antwortzeit (Durchschnitt) 495ms 498ms
Antwortzeit (Maximum) 842ms 602ms
Antwortzeit (Gesamt) 5.94s 3.49s
Parameter ~400B insgesamt (~17B aktiv) 4B
Verfügbarkeit Geschlossen Gewichte verfügbar

Cache-Preise gelten für Eingabetokens. Lesen nutzt gespeicherte Prompts erneut; Schreiben speichert sie und kann mehr kosten. Für Ausgabetokens gilt der Ausgabepreis.

Top-Modelle nach Score

Score vs. Gesamtkosten

Antwortzeit (Durchschnitt)

Punktzahl vs Antwortzeit (Durchschnitt)

Gesamte Ausgabe-Token

Punktzahl vs Gesamte Ausgabe-Token

Kategorieaufschlüsselung

Programmierung Punktzahl Konsistenz Erfolgsquote pro Versuch Instabile Tests Korrekte Tests Antwortzeit (Durchschnitt) Eingabe-Token Ausgabe-Token Denk-Token
GPT-6 Luna Decisions 2.5 6.7 0.0% 0 447ms 22,197 0 0
Tev1 4B Experimental 0.0 0.0 0.0% 0 0ms 0 0 0

Schnellvergleich

Vergleichspaar wechseln

Command A+lowvsGPT-6 Luna DecisionsdefaultCommand A+nonevsGPT-6 Luna DecisionsdefaultGemini 3 Flash PreviewhighvsGPT-6 Luna DecisionsdefaultCommand A+highvsGPT-6 Luna DecisionsdefaultGemini 3 Flash PreviewhighvsTev1 4B ExperimentaldefaultCommand A+mediumvsGPT-6 Luna DecisionsdefaultGPT-6 Luna DecisionsdefaultvsGrok 4.20noneLing 3.0 TinymediumvsGPT-6 Luna DecisionsdefaultLing 3.0 TinylowvsGPT-6 Luna DecisionsdefaultLing 3.0 TinyhighvsGPT-6 Luna DecisionsdefaultNemotron 3.5 LightningnoneKostenlos verfügbarvsGPT-6 Luna DecisionsdefaultGPT-6 Luna DecisionsdefaultvsQwen3.5-9Bmedium