Navigare
AI BENCHY
Your ad here

AI BENCHY Compare

OpenAI: GPT-5.5 vs Qwen: Qwen3.5 Plus 2026-02-15

Benchmark-urile au fost generate din suitele de teste AI BENCHY la: 2026-04-26

Metrică GPT-5.5 GPT-5.5 low Lansare: 2026-04-24 Qwen3.5 Plus 2026-02-15 Qwen3.5 Plus 2026-02-15 medium Lansare: 2026-02-15
Scor 9.0 8.5
Rang #5 #10
Fiabilitate 10.0 N/D
Consistență 9.6 9.1
Teste corecte
Rată de trecere pe încercare 87.0% 83.3%
Teste instabile 1 2
Rulări totale 54 54
Cost per rezultat 4.534 1.566
Cost total $0.681 $0.220
Preț de intrare $5.000 / 1M $0.260 / 1M
Preț de ieșire $30.000 / 1M $1.560 / 1M
Tokenuri de ieșire 1,959 2,121
Tokenuri de raționament 16,134 111,889
Timp de răspuns (mediu) 8.39s 46.56s
Timp de răspuns (maxim) 56.19s 120.91s
Timp de răspuns (total) 151.01s 512.20s

Top modele după scor

Scor vs cost total

Timp de răspuns (mediu)

Scor vs Timp de răspuns (mediu)

Total tokenuri de ieșire

Scor vs Total tokenuri de ieșire

Defalcare pe categorii

Trucuri anti-AI Scor Consistență Rată de trecere pe încercare Teste instabile Teste corecte Timp de răspuns (mediu) Tokenuri de ieșire Tokenuri de raționament
GPT-5.5 10.0 10.0 100.0% 0 4.15s 232 1,056
Qwen3.5 Plus 2026-02-15 8.2 7.9 83.3% 1 45.78s 205 21,236
Programare Scor Consistență Rată de trecere pe încercare Teste instabile Teste corecte Timp de răspuns (mediu) Tokenuri de ieșire Tokenuri de raționament
GPT-5.5 10.0 10.0 100.0% 0 7.79s 369 936
Qwen3.5 Plus 2026-02-15 10.0 10.0 100.0% 0 120.91s 367 19,367
Combinat Scor Consistență Rată de trecere pe încercare Teste instabile Teste corecte Timp de răspuns (mediu) Tokenuri de ieșire Tokenuri de raționament
GPT-5.5 10.0 10.0 100.0% 0 9.56s 303 717
Qwen3.5 Plus 2026-02-15 10.0 10.0 100.0% 0 46.85s 421 7,906
Parsare și extragere de date Scor Consistență Rată de trecere pe încercare Teste instabile Teste corecte Timp de răspuns (mediu) Tokenuri de ieșire Tokenuri de raționament
GPT-5.5 10.0 10.0 100.0% 0 3.28s 228 157
Qwen3.5 Plus 2026-02-15 10.0 10.0 100.0% 0 46.91s 270 14,916
Specific domeniului Scor Consistență Rată de trecere pe încercare Teste instabile Teste corecte Timp de răspuns (mediu) Tokenuri de ieșire Tokenuri de raționament
GPT-5.5 5.3 10.0 33.3% 0 27.57s 69 11,731
Qwen3.5 Plus 2026-02-15 5.3 10.0 33.3% 0 17.50s 35 16,680
Inteligență generală Scor Consistență Rată de trecere pe încercare Teste instabile Teste corecte Timp de răspuns (mediu) Tokenuri de ieșire Tokenuri de raționament
GPT-5.5 10.0 10.0 100.0% 0 3.45s 143 132
Qwen3.5 Plus 2026-02-15 4.7 1.6 66.7% 1 79.86s 73 8,675
Respectarea instrucțiunilor Scor Consistență Rată de trecere pe încercare Teste instabile Teste corecte Timp de răspuns (mediu) Tokenuri de ieșire Tokenuri de raționament
GPT-5.5 9.9 10.0 100.0% 0 2.98s 93 356
Qwen3.5 Plus 2026-02-15 10.0 10.0 100.0% 0 31.93s 101 7,704
Rezolvare de puzzle-uri Scor Consistență Rată de trecere pe încercare Teste instabile Teste corecte Timp de răspuns (mediu) Tokenuri de ieșire Tokenuri de raționament
GPT-5.5 9.0 7.9 88.9% 1 4.48s 272 948
Qwen3.5 Plus 2026-02-15 10.0 10.0 100.0% 0 34.57s 340 14,496
Apelare instrumente Scor Consistență Rată de trecere pe încercare Teste instabile Teste corecte Timp de răspuns (mediu) Tokenuri de ieșire Tokenuri de raționament
GPT-5.5 10.0 10.0 100.0% 0 4.96s 250 101
Qwen3.5 Plus 2026-02-15 10.0 10.0 100.0% 0 7.54s 309 909

Comparație rapidă

Schimbă perechea de comparație