Navigare
AI BENCHY
Advertise here

AI BENCHY Compare

OpenAI: gpt-oss-120b vs Qwen: Qwen3.5-35B-A3B

Benchmark-urile au fost generate din suitele de teste AI BENCHY la: 2026-05-26

Metrică gpt-oss-120b gpt-oss-120b none Lansare: 2025-08-05 Disponibil gratuit Qwen3.5-35B-A3B Qwen3.5-35B-A3B none Lansare: 2026-02-24
Scor 5.4 5.8
Rang #119 #104
Fiabilitate 10.0 10.0
Consistență 9.1 8.9
Teste corecte
Rată de trecere pe încercare 38.6% 45.0%
Teste instabile 2 3
Rulări totale 133 98
Cost per rezultat 0.302 0.419
Cost total $0.019 $0.030
Preț de intrare $0.000 / 1M $0.139 / 1M
Preț de ieșire $0.000 / 1M $1.000 / 1M
Tokenuri de ieșire 91,564 10,794
Tokenuri de raționament 0 0
Timp de răspuns (mediu) 21.61s 3.50s
Timp de răspuns (maxim) 113.71s 47.43s
Timp de răspuns (total) 345.79s 70.00s

Top modele după scor

Scor vs cost total

Timp de răspuns (mediu)

Scor vs Timp de răspuns (mediu)

Total tokenuri de ieșire

Scor vs Total tokenuri de ieșire

Defalcare pe categorii

Trucuri anti-AI Scor Consistență Rată de trecere pe încercare Teste instabile Teste corecte Timp de răspuns (mediu) Tokenuri de ieșire Tokenuri de raționament
gpt-oss-120b 6.5 10.0 50.0% 0 32.84s 8,676 0
Qwen3.5-35B-A3B 3.4 7.9 16.7% 1 1.43s 574 0
Programare Scor Consistență Rată de trecere pe încercare Teste instabile Teste corecte Timp de răspuns (mediu) Tokenuri de ieșire Tokenuri de raționament
gpt-oss-120b 4.3 1.1 66.7% 1 9.57s 3,232 0
Qwen3.5-35B-A3B 6.8 10.0 50.0% 0 1.72s 562 0
Combinat Scor Consistență Rată de trecere pe încercare Teste instabile Teste corecte Timp de răspuns (mediu) Tokenuri de ieșire Tokenuri de raționament
gpt-oss-120b 3.0 10.0 0.0% 0 0ms 0 0
Qwen3.5-35B-A3B 3.0 10.0 0.0% 0 47.43s 1,833 0
Parsare și extragere de date Scor Consistență Rată de trecere pe încercare Teste instabile Teste corecte Timp de răspuns (mediu) Tokenuri de ieșire Tokenuri de raționament
gpt-oss-120b 6.5 10.0 50.0% 0 7.12s 598 0
Qwen3.5-35B-A3B 10.0 10.0 100.0% 0 1.16s 243 0
Specific domeniului Scor Consistență Rată de trecere pe încercare Teste instabile Teste corecte Timp de răspuns (mediu) Tokenuri de ieșire Tokenuri de raționament
gpt-oss-120b 3.0 10.0 0.0% 0 34.98s 29,483 0
Qwen3.5-35B-A3B 7.7 10.0 66.7% 0 485ms 15 0
Inteligență generală Scor Consistență Rată de trecere pe încercare Teste instabile Teste corecte Timp de răspuns (mediu) Tokenuri de ieșire Tokenuri de raționament
gpt-oss-120b 4.8 10.0 0.0% 0 10.79s 615 0
Qwen3.5-35B-A3B 6.5 3.4 66.7% 1 1.19s 114 0
Respectarea instrucțiunilor Scor Consistență Rată de trecere pe încercare Teste instabile Teste corecte Timp de răspuns (mediu) Tokenuri de ieșire Tokenuri de raționament
gpt-oss-120b 9.8 10.0 100.0% 0 5.06s 10,870 0
Qwen3.5-35B-A3B 6.3 10.0 50.0% 0 809ms 63 0
Rezolvare de puzzle-uri Scor Consistență Rată de trecere pe încercare Teste instabile Teste corecte Timp de răspuns (mediu) Tokenuri de ieșire Tokenuri de raționament
gpt-oss-120b 6.0 7.2 55.6% 1 8.21s 34,952 0
Qwen3.5-35B-A3B 3.7 7.4 22.2% 1 1.35s 7,115 0
Apelare instrumente Scor Consistență Rată de trecere pe încercare Teste instabile Teste corecte Timp de răspuns (mediu) Tokenuri de ieșire Tokenuri de raționament
gpt-oss-120b 3.0 10.0 0.0% 0 0ms 0 0
Qwen3.5-35B-A3B 10.0 10.0 100.0% 0 2.30s 264 0
Cultură generală Scor Consistență Rată de trecere pe încercare Teste instabile Teste corecte Timp de răspuns (mediu) Tokenuri de ieșire Tokenuri de raționament
gpt-oss-120b 3.0 10.0 0.0% 0 47.29s 3,138 0
Qwen3.5-35B-A3B 3.0 10.0 0.0% 0 493ms 11 0

Comparație rapidă

Schimbă perechea de comparație