Navigare
AI BENCHY
Compară Grafice
❤️ Made by XCS
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

AI BENCHY Compare

Inception: Mercury 2 vs Qwen: Qwen3.5 Plus 2026-02-15

Compară:

Benchmark-urile au fost generate din suitele de teste AI BENCHY la: 2026-03-05

Metrică Inception: Mercury 2 medium Lansare: 2026-02-24 Qwen: Qwen3.5 Plus 2026-02-15 none Lansare: 2026-02-15
Rang #35 #27
Scor mediu 5.4 6.4
Teste corecte
Consistență 8.3 10.0
Cost per rezultat 0.622 0.168
Cost total $0.044 $0.016
Rată de trecere pe încercare 57.8% 60.0%
Teste instabile 3 0
common.totalAttempts 45 (15 x 3) 45 (15 x 3)
Tokenuri de ieșire 3,571 1,898
Tokenuri de raționament 45,379 0
Timp de răspuns (medie) 2.47s 2.70s
Timp de răspuns (maxim) 14.63s 6.65s
Timp de răspuns (total) 34.56s 24.26s

Top modele după scor

Timp de răspuns (medie)

Scor vs cost total

Scor mediu vs Timp de răspuns (medie)

Defalcare pe categorii

Trucuri anti-AI Scor Consistență Rată de trecere pe încercare Teste instabile Teste corecte Timp de răspuns (medie) Tokenuri de ieșire Tokenuri de raționament
Inception: Mercury 2 7.3 9.8 66.7% 0 1.30s 2,531 2,410
Qwen: Qwen3.5 Plus 2026-02-15 4.0 10.0 33.3% 0 2.74s 514 0
Combinat Scor Consistență Rată de trecere pe încercare Teste instabile Teste corecte Timp de răspuns (medie) Tokenuri de ieșire Tokenuri de raționament
Inception: Mercury 2 10.0 10.0 100.0% 0 3.28s 268 4,887
Qwen: Qwen3.5 Plus 2026-02-15 10.0 10.0 0.0% 0 6.65s 314 0
Parsare și extragere de date Scor Consistență Rată de trecere pe încercare Teste instabile Teste corecte Timp de răspuns (medie) Tokenuri de ieșire Tokenuri de raționament
Inception: Mercury 2 5.5 5.9 83.3% 1 1.11s 183 1,656
Qwen: Qwen3.5 Plus 2026-02-15 9.9 10.0 100.0% 0 1.89s 243 0
Specific domeniului Scor Consistență Rată de trecere pe încercare Teste instabile Teste corecte Timp de răspuns (medie) Tokenuri de ieșire Tokenuri de raționament
Inception: Mercury 2 10.0 7.2 11.1% 1 6.48s 41 30,754
Qwen: Qwen3.5 Plus 2026-02-15 4.0 10.0 33.3% 0 1.17s 17 0
Respectarea instrucțiunilor Scor Consistență Rată de trecere pe încercare Teste instabile Teste corecte Timp de răspuns (medie) Tokenuri de ieșire Tokenuri de raționament
Inception: Mercury 2 10.0 10.0 100.0% 0 1.07s 14 958
Qwen: Qwen3.5 Plus 2026-02-15 10.0 10.0 100.0% 0 1.67s 72 0
Puzzle Solving Scor Consistență Rată de trecere pe încercare Teste instabile Teste corecte Timp de răspuns (medie) Tokenuri de ieșire Tokenuri de raționament
Inception: Mercury 2 1.7 7.5 22.2% 1 934ms 354 2,758
Qwen: Qwen3.5 Plus 2026-02-15 7.0 10.0 66.7% 0 2.82s 516 0
Apelare instrumente Scor Consistență Rată de trecere pe încercare Teste instabile Teste corecte Timp de răspuns (medie) Tokenuri de ieșire Tokenuri de raționament
Inception: Mercury 2 10.0 10.0 100.0% 0 1.89s 180 1,956
Qwen: Qwen3.5 Plus 2026-02-15 10.0 10.0 100.0% 0 3.33s 222 0

Comparație rapidă

Schimbă perechea de comparație