Navigation
AI BENCHY
Your ad here

AI BENCHY Compare

Google: Gemini 3 Flash Preview vs Inception: Mercury 2

Benchmarks aus AI BENCHY-Test-Suites generiert am: 2026-04-16

Metrik Gemini 3 Flash Preview Gemini 3 Flash Preview medium Veröffentlichung: 2025-12-17 Mercury 2 Mercury 2 none Veröffentlichung: 2026-02-24
Punktzahl 10.0 4.8
Rang #1 #89
Konsistenz 10.0 9.0
Korrekte Tests
Erfolgsquote pro Versuch 100.0% 27.8%
Instabile Tests 0 2
Gesamtläufe 54 54
Kosten pro Ergebnis 1.740 0.165
Gesamtkosten $0.314 $0.007
Eingabepreis $0.500 / 1M $0.250 / 1M
Ausgabepreis $3.000 / 1M $0.750 / 1M
Ausgabe-Token 2,072 1,625
Denk-Token 97,041 0
Antwortzeit (Durchschnitt) 17.60s 613ms
Antwortzeit (Maximum) 79.71s 1.27s
Antwortzeit (Gesamt) 193.57s 11.04s

Top-Modelle nach Score

Score vs. Gesamtkosten

Antwortzeit (Durchschnitt)

Punktzahl vs Antwortzeit (Durchschnitt)

Gesamte Ausgabe-Token

Punktzahl vs Gesamte Ausgabe-Token

Kategorieaufschlüsselung

Anti-KI-Tricks Punktzahl Konsistenz Erfolgsquote pro Versuch Instabile Tests Korrekte Tests Antwortzeit (Durchschnitt) Ausgabe-Token Denk-Token
Gemini 3 Flash Preview 10.0 10.0 100.0% 0 4.13s 305 3,490
Mercury 2 3.0 10.0 0.0% 0 483ms 286 0
Programmierung Punktzahl Konsistenz Erfolgsquote pro Versuch Instabile Tests Korrekte Tests Antwortzeit (Durchschnitt) Ausgabe-Token Denk-Token
Gemini 3 Flash Preview 10.0 10.0 100.0% 0 79.71s 432 48,771
Mercury 2 3.6 8.9 0.0% 0 969ms 310 0
Kombiniert Punktzahl Konsistenz Erfolgsquote pro Versuch Instabile Tests Korrekte Tests Antwortzeit (Durchschnitt) Ausgabe-Token Denk-Token
Gemini 3 Flash Preview 10.0 10.0 100.0% 0 50.16s 351 12,645
Mercury 2 3.0 10.0 0.0% 0 606ms 131 0
Datenanalyse und -extraktion Punktzahl Konsistenz Erfolgsquote pro Versuch Instabile Tests Korrekte Tests Antwortzeit (Durchschnitt) Ausgabe-Token Denk-Token
Gemini 3 Flash Preview 10.0 10.0 100.0% 0 4.72s 279 5,333
Mercury 2 7.3 5.9 83.3% 1 667ms 180 0
Domänenspezifisch Punktzahl Konsistenz Erfolgsquote pro Versuch Instabile Tests Korrekte Tests Antwortzeit (Durchschnitt) Ausgabe-Token Denk-Token
Gemini 3 Flash Preview 10.0 10.0 100.0% 0 21.12s 12 14,908
Mercury 2 5.3 7.2 44.4% 1 534ms 46 0
Allgemeine Intelligenz Punktzahl Konsistenz Erfolgsquote pro Versuch Instabile Tests Korrekte Tests Antwortzeit (Durchschnitt) Ausgabe-Token Denk-Token
Gemini 3 Flash Preview 10.0 10.0 100.0% 0 4.09s 111 1,285
Mercury 2 4.8 10.0 0.0% 0 628ms 159 0
Befolgung von Anweisungen Punktzahl Konsistenz Erfolgsquote pro Versuch Instabile Tests Korrekte Tests Antwortzeit (Durchschnitt) Ausgabe-Token Denk-Token
Gemini 3 Flash Preview 10.0 10.0 100.0% 0 6.10s 72 4,558
Mercury 2 6.5 10.0 50.0% 0 551ms 82 0
Rätsellösen Punktzahl Konsistenz Erfolgsquote pro Versuch Instabile Tests Korrekte Tests Antwortzeit (Durchschnitt) Ausgabe-Token Denk-Token
Gemini 3 Flash Preview 10.0 10.0 100.0% 0 4.43s 276 4,921
Mercury 2 3.1 10.0 0.0% 0 533ms 234 0
Werkzeugaufrufe Punktzahl Konsistenz Erfolgsquote pro Versuch Instabile Tests Korrekte Tests Antwortzeit (Durchschnitt) Ausgabe-Token Denk-Token
Gemini 3 Flash Preview 10.0 10.0 100.0% 0 10.55s 234 1,130
Mercury 2 10.0 10.0 100.0% 0 1.27s 197 0

Schnellvergleich

Vergleichspaar wechseln