Navigation
Advertise here

GPT-4o-mini vs Inkling Small

GPT-4o-mini führt beim Durchschnittsscore mit 5.0 vs 4.9. GPT-4o-mini hat die niedrigeren Benchmark-Kosten mit $0.024 vs $0.054. Inkling Small ist schneller mit 1.45s vs 4.16s, mit Erfolgsraten von 21.7% vs 23.2%.

Benchmarks aus AI BENCHY-Test-Suites generiert am: 2026-10-02

Verglichene Modelle

Rang
#304
Gesamte Ausgabe-Token
3,627
Antwortzeit (Durchschnitt)
4.16s
Gesamtkosten
$0.024
Rang
#307
Gesamte Ausgabe-Token
8,770
Antwortzeit (Durchschnitt)
1.45s
Gesamtkosten
$0.054
Empfohlenes Modell Inkling Small

Die Punktzahl bleibt nah an der besten hier (4.9 vs 5.0) und es antwortet etwa 2.9x schneller als GPT-4o-mini.

Detaillierter Vergleich

Metrik GPT-4o-mini GPT-4o-mini none Veröffentlichung: 2024-07-18 Inkling Small Inkling Small none Veröffentlichung: 2026-08-01 Kostenlos verfügbar
Punktzahl 5.0 4.9
Rang #304 #307
Zuverlässigkeit 10.0 10.0
Konsistenz 9.9 9.6
Versuche 69/69 69/69
Korrekte Tests
Erfolgsquote pro Versuch 21.7% 23.2%
Instabile Tests 0 1
Gesamtläufe 69 69
Kosten pro Ergebnis 0.480 1.158
Gesamtkosten $0.024 $0.054
Eingabepreis $0.150 / 1M $0.450 / 1M
Ausgabepreis $0.600 / 1M $1.200 / 1M
Preis für Cache-Lesen $0.075 / 1M $0.100 / 1M
Preis für Cache-Schreiben k. A. k. A.
Gesamte Eingabe-Token 145,180 94,733
Ausgabe-Token 3,627 8,770
Denk-Token 0 0
Antwortzeit (Durchschnitt) 4.16s 1.45s
Antwortzeit (Maximum) 39.99s 12.35s
Antwortzeit (Gesamt) 70.70s 33.24s
Parameter ~8B 276B insgesamt (12B aktiv)
Verfügbarkeit Geschlossen Geschlossen

Cache-Preise gelten für Eingabetokens. Lesen nutzt gespeicherte Prompts erneut; Schreiben speichert sie und kann mehr kosten. Für Ausgabetokens gilt der Ausgabepreis.

Modell-Generierungs-Showcase

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#304 GPT-4o-mini

none
Kosten
$0.001
Zeit
6.6s
Token
742 tok

#307 Thinking Machines: Inkling Small

none
Kosten
$0.008
Zeit
42.1s
Token
6,319 tok

Top-Modelle nach Score

Score vs. Gesamtkosten

Antwortzeit (Durchschnitt)

Punktzahl vs Antwortzeit (Durchschnitt)

Gesamte Ausgabe-Token

Punktzahl vs Gesamte Ausgabe-Token

Kategorieaufschlüsselung

Programmierung Punktzahl Konsistenz Erfolgsquote pro Versuch Instabile Tests Korrekte Tests Antwortzeit (Durchschnitt) Eingabe-Token Ausgabe-Token Denk-Token
GPT-4o-mini 3.2 9.6 0.0% 0 1.63s 7,314 367 0
Inkling Small 3.6 10.0 0.0% 0 759ms 7,356 454 0

Schnellvergleich

Vergleichspaar wechseln