Navigare
AI BENCHY
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

AI BENCHY Compare

Google: Gemma 4 31B vs OpenAI: GPT-5.5

Benchmark-urile au fost generate din suitele de teste AI BENCHY la: 2026-05-22

Metrică Gemma 4 31B Gemma 4 31B none Lansare: 2026-04-02 Disponibil gratuit GPT-5.5 GPT-5.5 medium Lansare: 2026-04-24
Scor 6.7 8.7
Rang #76 #11
Fiabilitate 10.0 10.0
Consistență 10.0 8.8
Teste corecte
Rată de trecere pe încercare 50.0% 86.7%
Teste instabile 0 3
Rulări totale 60 60
Cost per rezultat 0.030 21.891
Cost total $0.003 $3.503
Preț de intrare $0.120 / 1M $5.000 / 1M
Preț de ieșire $0.370 / 1M $30.000 / 1M
Tokenuri de ieșire 1,398 1,973
Tokenuri de raționament 0 109,510
Timp de răspuns (mediu) 3.84s 37.89s
Timp de răspuns (maxim) 26.13s 332.10s
Timp de răspuns (total) 69.13s 757.71s

Top modele după scor

Scor vs cost total

Timp de răspuns (mediu)

Scor vs Timp de răspuns (mediu)

Total tokenuri de ieșire

Scor vs Total tokenuri de ieșire

Defalcare pe categorii

Trucuri anti-AI Scor Consistență Rată de trecere pe încercare Teste instabile Teste corecte Timp de răspuns (mediu) Tokenuri de ieșire Tokenuri de raționament
Gemma 4 31B 6.5 10.0 50.0% 0 1.85s 45 0
GPT-5.5 10.0 10.0 100.0% 0 4.66s 250 1,335
Programare Scor Consistență Rată de trecere pe încercare Teste instabile Teste corecte Timp de răspuns (mediu) Tokenuri de ieșire Tokenuri de raționament
Gemma 4 31B 6.8 10.0 50.0% 0 14.84s 726 0
GPT-5.5 8.2 6.7 83.3% 1 69.68s 341 19,515
Combinat Scor Consistență Rată de trecere pe încercare Teste instabile Teste corecte Timp de răspuns (mediu) Tokenuri de ieșire Tokenuri de raționament
Gemma 4 31B 3.0 10.0 0.0% 0 0ms 0 0
GPT-5.5 10.0 10.0 100.0% 0 19.29s 312 2,841
Parsare și extragere de date Scor Consistență Rată de trecere pe încercare Teste instabile Teste corecte Timp de răspuns (mediu) Tokenuri de ieșire Tokenuri de raționament
Gemma 4 31B 10.0 10.0 100.0% 0 2.25s 285 0
GPT-5.5 10.0 10.0 100.0% 0 4.18s 234 593
Specific domeniului Scor Consistență Rată de trecere pe încercare Teste instabile Teste corecte Timp de răspuns (mediu) Tokenuri de ieșire Tokenuri de raționament
Gemma 4 31B 7.7 10.0 66.7% 0 3.22s 27 0
GPT-5.5 5.3 7.2 44.4% 1 164.14s 67 79,625
Inteligență generală Scor Consistență Rată de trecere pe încercare Teste instabile Teste corecte Timp de răspuns (mediu) Tokenuri de ieșire Tokenuri de raționament
Gemma 4 31B 10.0 10.0 100.0% 0 2.09s 117 0
GPT-5.5 10.0 10.0 100.0% 0 4.16s 138 223
Respectarea instrucțiunilor Scor Consistență Rată de trecere pe încercare Teste instabile Teste corecte Timp de răspuns (mediu) Tokenuri de ieșire Tokenuri de raționament
Gemma 4 31B 6.5 10.0 50.0% 0 2.84s 78 0
GPT-5.5 10.0 10.0 100.0% 0 3.36s 93 538
Rezolvare de puzzle-uri Scor Consistență Rată de trecere pe încercare Teste instabile Teste corecte Timp de răspuns (mediu) Tokenuri de ieșire Tokenuri de raționament
Gemma 4 31B 6.5 10.0 33.3% 0 2.95s 108 0
GPT-5.5 10.0 10.0 100.0% 0 6.78s 250 2,254
Apelare instrumente Scor Consistență Rată de trecere pe încercare Teste instabile Teste corecte Timp de răspuns (mediu) Tokenuri de ieșire Tokenuri de raționament
Gemma 4 31B 3.0 10.0 0.0% 0 0ms 0 0
GPT-5.5 10.0 10.0 100.0% 0 10.57s 258 832
Cultură generală Scor Consistență Rată de trecere pe încercare Teste instabile Teste corecte Timp de răspuns (mediu) Tokenuri de ieșire Tokenuri de raționament
Gemma 4 31B 3.0 10.0 0.0% 0 1.25s 12 0
GPT-5.5 2.8 1.6 33.3% 1 37.86s 30 1,754

Comparație rapidă

Schimbă perechea de comparație