Navigation
AI BENCHY
Vergleichen Diagramme
❤️ Made by XCS
Your ad here

AI BENCHY Compare

Google: Gemini 3.1 Flash Lite Preview vs OpenAI: GPT-5.4

Vergleichen:

Benchmarks aus AI BENCHY-Test-Suites generiert am: 2026-03-05

Metrik Google: Gemini 3.1 Flash Lite Preview low Veröffentlichung: 2026-03-03 OpenAI: GPT-5.4 medium Veröffentlichung: 2026-03-05
Ø-Score 7.6 8.2
Korrekte Tests
Rang #12 #7
Konsistenz 10.0 8.9
Kosten pro Ergebnis 0.170 6.533
Gesamtkosten $0.019 $0.784
Erfolgsquote pro Versuch 73.3% 86.7%
Instabile Tests 0 2
common.totalAttempts 45 (15 x 3) 45 (15 x 3)
Ausgabe-Token 1,542 1,611
Denk-Token 6,888 46,321
Antwortzeit (Durchschnitt) 3.49s 21.06s
Antwortzeit (Maximum) 11.91s 100.41s
Antwortzeit (Gesamt) 52.29s 315.95s

Top-Modelle nach Score

Score vs. Gesamtkosten

Antwortzeit (Durchschnitt)

Ø-Score vs Antwortzeit (Durchschnitt)

Kategorieaufschlüsselung

Anti-KI-Tricks Punktzahl Konsistenz Erfolgsquote pro Versuch Instabile Tests Korrekte Tests Antwortzeit (Durchschnitt) Ausgabe-Token Denk-Token
Google: Gemini 3.1 Flash Lite Preview 7.0 10.0 66.7% 0 2.18s 456 1,224
OpenAI: GPT-5.4 10.0 10.0 100.0% 0 5.02s 216 1,466
Kombiniert Punktzahl Konsistenz Erfolgsquote pro Versuch Instabile Tests Korrekte Tests Antwortzeit (Durchschnitt) Ausgabe-Token Denk-Token
Google: Gemini 3.1 Flash Lite Preview 10.0 10.0 0.0% 0 11.91s 225 762
OpenAI: GPT-5.4 10.0 10.0 100.0% 0 20.57s 301 3,543
Datenanalyse und -extraktion Punktzahl Konsistenz Erfolgsquote pro Versuch Instabile Tests Korrekte Tests Antwortzeit (Durchschnitt) Ausgabe-Token Denk-Token
Google: Gemini 3.1 Flash Lite Preview 9.9 10.0 100.0% 0 3.00s 291 696
OpenAI: GPT-5.4 9.9 10.0 100.0% 0 5.32s 234 804
Domänenspezifisch Punktzahl Konsistenz Erfolgsquote pro Versuch Instabile Tests Korrekte Tests Antwortzeit (Durchschnitt) Ausgabe-Token Denk-Token
Google: Gemini 3.1 Flash Lite Preview 4.0 10.0 33.3% 0 2.36s 18 1,212
OpenAI: GPT-5.4 4.0 7.2 44.4% 1 74.27s 61 34,748
Befolgung von Anweisungen Punktzahl Konsistenz Erfolgsquote pro Versuch Instabile Tests Korrekte Tests Antwortzeit (Durchschnitt) Ausgabe-Token Denk-Token
Google: Gemini 3.1 Flash Lite Preview 10.0 10.0 100.0% 0 1.49s 72 753
OpenAI: GPT-5.4 10.0 10.0 100.0% 0 3.11s 93 897
Puzzle Solving Punktzahl Konsistenz Erfolgsquote pro Versuch Instabile Tests Korrekte Tests Antwortzeit (Durchschnitt) Ausgabe-Token Denk-Token
Google: Gemini 3.1 Flash Lite Preview 10.0 10.0 100.0% 0 2.76s 243 1,248
OpenAI: GPT-5.4 7.0 7.2 88.9% 1 9.13s 442 3,832
Werkzeugaufrufe Punktzahl Konsistenz Erfolgsquote pro Versuch Instabile Tests Korrekte Tests Antwortzeit (Durchschnitt) Ausgabe-Token Denk-Token
Google: Gemini 3.1 Flash Lite Preview 10.0 10.0 100.0% 0 9.54s 237 993
OpenAI: GPT-5.4 10.0 10.0 100.0% 0 13.28s 264 1,031

Schnellvergleich

Vergleichspaar wechseln