Navigare
AI BENCHY
Advertise here

AI BENCHY Compare

Google: Gemini 3.1 Flash Lite Preview vs OpenAI: GPT-5 Mini

Benchmark-urile au fost generate din suitele de teste AI BENCHY la: 2026-06-04

Metrică Gemini 3.1 Flash Lite Preview Gemini 3.1 Flash Lite Preview none Lansare: 2026-03-03 GPT-5 Mini GPT-5 Mini medium Lansare: 2025-08-07
Scor 7.2 7.3
Rang #58 #54
Fiabilitate 10.0 10.0
Consistență 9.7 9.1
Teste corecte
Rată de trecere pe încercare 60.3% 63.5%
Teste instabile 1 2
Rulări totale 63 63
Cost per rezultat 0.148 1.319
Cost total $0.018 $0.159
Preț de intrare $0.250 / 1M $0.250 / 1M
Preț de ieșire $1.500 / 1M $2.000 / 1M
Total tokenuri de intrare 37,582 37,100
Tokenuri de ieșire 5,547 6,801
Tokenuri de raționament 0 67,690
Timp de răspuns (mediu) 1.21s 23.64s
Timp de răspuns (maxim) 3.39s 88.15s
Timp de răspuns (total) 25.45s 496.44s

Top modele după scor

Scor vs cost total

Timp de răspuns (mediu)

Scor vs Timp de răspuns (mediu)

Total tokenuri de ieșire

Scor vs Total tokenuri de ieșire

Defalcare pe categorii

Trucuri anti-AI Scor Consistență Rată de trecere pe încercare Teste instabile Teste corecte Timp de răspuns (mediu) Tokenuri de intrare Tokenuri de ieșire Tokenuri de raționament
Gemini 3.1 Flash Lite Preview 7.5 8.4 66.7% 1 1.04s 504 1,092 0
GPT-5 Mini 7.1 7.6 66.7% 1 13.86s 606 1,715 6,378
Programare Scor Consistență Rată de trecere pe încercare Teste instabile Teste corecte Timp de răspuns (mediu) Tokenuri de intrare Tokenuri de ieșire Tokenuri de raționament
Gemini 3.1 Flash Lite Preview 5.5 10.0 33.3% 0 967ms 8,128 670 0
GPT-5 Mini 10.0 10.0 100.0% 0 27.63s 7,302 658 17,152
Combinat Scor Consistență Rată de trecere pe încercare Teste instabile Teste corecte Timp de răspuns (mediu) Tokenuri de intrare Tokenuri de ieșire Tokenuri de raționament
Gemini 3.1 Flash Lite Preview 3.0 10.0 0.0% 0 3.20s 13,026 339 0
GPT-5 Mini 10.0 10.0 100.0% 0 88.15s 14,118 754 11,520
Parsare și extragere de date Scor Consistență Rată de trecere pe încercare Teste instabile Teste corecte Timp de răspuns (mediu) Tokenuri de intrare Tokenuri de ieșire Tokenuri de raționament
Gemini 3.1 Flash Lite Preview 10.0 10.0 100.0% 0 1.22s 7,550 399 0
GPT-5 Mini 10.0 10.0 100.0% 0 12.58s 7,140 453 3,200
Specific domeniului Scor Consistență Rată de trecere pe încercare Teste instabile Teste corecte Timp de răspuns (mediu) Tokenuri de intrare Tokenuri de ieșire Tokenuri de raționament
Gemini 3.1 Flash Lite Preview 5.3 10.0 33.3% 0 942ms 641 568 0
GPT-5 Mini 3.6 7.2 22.2% 1 44.63s 515 293 14,016
Inteligență generală Scor Consistență Rată de trecere pe încercare Teste instabile Teste corecte Timp de răspuns (mediu) Tokenuri de intrare Tokenuri de ieșire Tokenuri de raționament
Gemini 3.1 Flash Lite Preview 4.0 10.0 0.0% 0 741ms 488 69 0
GPT-5 Mini 4.5 10.0 0.0% 0 13.50s 477 349 1,856
Respectarea instrucțiunilor Scor Consistență Rată de trecere pe încercare Teste instabile Teste corecte Timp de răspuns (mediu) Tokenuri de intrare Tokenuri de ieșire Tokenuri de raționament
Gemini 3.1 Flash Lite Preview 10.0 10.0 100.0% 0 1.13s 623 574 0
GPT-5 Mini 10.0 10.0 100.0% 0 11.59s 660 310 3,968
Rezolvare de puzzle-uri Scor Consistență Rată de trecere pe încercare Teste instabile Teste corecte Timp de răspuns (mediu) Tokenuri de intrare Tokenuri de ieșire Tokenuri de raționament
Gemini 3.1 Flash Lite Preview 10.0 10.0 100.0% 0 900ms 570 1,045 0
GPT-5 Mini 5.6 9.8 33.3% 0 15.20s 642 1,622 6,144
Apelare instrumente Scor Consistență Rată de trecere pe încercare Teste instabile Teste corecte Timp de răspuns (mediu) Tokenuri de intrare Tokenuri de ieșire Tokenuri de raționament
Gemini 3.1 Flash Lite Preview 10.0 10.0 100.0% 0 3.39s 5,894 782 0
GPT-5 Mini 10.0 10.0 100.0% 0 18.64s 5,445 487 1,600
Cultură generală Scor Consistență Rată de trecere pe încercare Teste instabile Teste corecte Timp de răspuns (mediu) Tokenuri de intrare Tokenuri de ieșire Tokenuri de raționament
Gemini 3.1 Flash Lite Preview 3.0 10.0 0.0% 0 814ms 158 9 0
GPT-5 Mini 3.0 10.0 0.0% 0 9.99s 195 160 1,856

Comparație rapidă

Schimbă perechea de comparație