Navigare
AI BENCHY
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

AI BENCHY Compare

DeepSeek: DeepSeek V4 Pro vs Google: Gemini 3.1 Flash Lite

Benchmark-urile au fost generate din suitele de teste AI BENCHY la: 2026-05-22

Metrică DeepSeek V4 Pro DeepSeek V4 Pro none Lansare: 2026-04-24 Gemini 3.1 Flash Lite Gemini 3.1 Flash Lite minimal Lansare: 2026-05-08
Scor 6.0 6.7
Rang #95 #78
Fiabilitate 8.1 10.0
Consistență 8.9 8.8
Teste corecte
Rată de trecere pe încercare 48.3% 56.7%
Teste instabile 3 3
Rulări totale 60 60
Cost per rezultat 0.564 0.123
Cost total $0.046 $0.013
Preț de intrare $0.435 / 1M $0.250 / 1M
Preț de ieșire $0.870 / 1M $1.500 / 1M
Tokenuri de ieșire 5,347 2,481
Tokenuri de raționament 0 0
Timp de răspuns (mediu) 13.48s 1.37s
Timp de răspuns (maxim) 58.65s 4.49s
Timp de răspuns (total) 269.56s 27.32s

Top modele după scor

Scor vs cost total

Timp de răspuns (mediu)

Scor vs Timp de răspuns (mediu)

Total tokenuri de ieșire

Scor vs Total tokenuri de ieșire

Defalcare pe categorii

Trucuri anti-AI Scor Consistență Rată de trecere pe încercare Teste instabile Teste corecte Timp de răspuns (mediu) Tokenuri de ieșire Tokenuri de raționament
DeepSeek V4 Pro 3.5 8.0 16.7% 1 14.02s 704 0
Gemini 3.1 Flash Lite 8.3 10.0 75.0% 0 1.10s 639 0
Programare Scor Consistență Rată de trecere pe încercare Teste instabile Teste corecte Timp de răspuns (mediu) Tokenuri de ieșire Tokenuri de raționament
DeepSeek V4 Pro 5.4 6.8 33.3% 1 8.27s 527 0
Gemini 3.1 Flash Lite 6.8 10.0 50.0% 0 951ms 660 0
Combinat Scor Consistență Rată de trecere pe încercare Teste instabile Teste corecte Timp de răspuns (mediu) Tokenuri de ieșire Tokenuri de raționament
DeepSeek V4 Pro 9.5 10.0 100.0% 0 25.49s 1,911 0
Gemini 3.1 Flash Lite 3.0 10.0 0.0% 0 2.53s 357 0
Parsare și extragere de date Scor Consistență Rată de trecere pe încercare Teste instabile Teste corecte Timp de răspuns (mediu) Tokenuri de ieșire Tokenuri de raționament
DeepSeek V4 Pro 8.8 10.0 100.0% 0 30.54s 170 0
Gemini 3.1 Flash Lite 10.0 10.0 100.0% 0 1.04s 279 0
Specific domeniului Scor Consistență Rată de trecere pe încercare Teste instabile Teste corecte Timp de răspuns (mediu) Tokenuri de ieșire Tokenuri de raționament
DeepSeek V4 Pro 5.3 10.0 33.3% 0 3.17s 18 0
Gemini 3.1 Flash Lite 2.9 7.2 11.1% 1 1.02s 15 0
Inteligență generală Scor Consistență Rată de trecere pe încercare Teste instabile Teste corecte Timp de răspuns (mediu) Tokenuri de ieșire Tokenuri de raționament
DeepSeek V4 Pro 4.3 9.9 0.0% 0 3.75s 132 0
Gemini 3.1 Flash Lite 4.0 10.0 0.0% 0 791ms 63 0
Respectarea instrucțiunilor Scor Consistență Rată de trecere pe încercare Teste instabile Teste corecte Timp de răspuns (mediu) Tokenuri de ieșire Tokenuri de raționament
DeepSeek V4 Pro 6.3 10.0 50.0% 0 8.23s 64 0
Gemini 3.1 Flash Lite 10.0 10.0 100.0% 0 932ms 72 0
Rezolvare de puzzle-uri Scor Consistență Rată de trecere pe încercare Teste instabile Teste corecte Timp de răspuns (mediu) Tokenuri de ieșire Tokenuri de raționament
DeepSeek V4 Pro 7.6 7.2 77.8% 1 19.72s 175 0
Gemini 3.1 Flash Lite 6.0 4.6 66.7% 2 2.15s 153 0
Apelare instrumente Scor Consistență Rată de trecere pe încercare Teste instabile Teste corecte Timp de răspuns (mediu) Tokenuri de ieșire Tokenuri de raționament
DeepSeek V4 Pro 10.0 10.0 100.0% 0 5.92s 219 0
Gemini 3.1 Flash Lite 10.0 10.0 100.0% 0 3.51s 234 0
Cultură generală Scor Consistență Rată de trecere pe încercare Teste instabile Teste corecte Timp de răspuns (mediu) Tokenuri de ieșire Tokenuri de raționament
DeepSeek V4 Pro 3.0 10.0 0.0% 0 15.59s 1,427 0
Gemini 3.1 Flash Lite 3.0 10.0 0.0% 0 724ms 9 0

Comparație rapidă

Schimbă perechea de comparație