Navigare
AI BENCHY
Advertise here

AI BENCHY Compare

Cobuddy vs OpenAI: GPT-5.4 Nano

Rezumat

Comparație benchmark Cobuddy vs GPT-5.4 Nano: Cobuddy conduce la scorul mediu cu 4.9 vs 4.8. Cobuddy are costul de benchmark mai mic, $0.000 vs $0.011. GPT-5.4 Nano este mai rapid cu 1.48s vs 39.90s, cu rate de reușită de 47.6% vs 30.2%.

Model recomandat: GPT-5.4 Nano - Scorul rămâne aproape de cel mai bun scor de aici (4.8 vs 4.9) și răspunde de aproximativ 27.0x mai rapid decât Cobuddy.

Benchmark-urile au fost generate din suitele de teste AI BENCHY la: 2026-06-12

Metrică Cobuddy Cobuddy medium Lansare: 2026-05-06 GPT-5.4 Nano GPT-5.4 Nano none Lansare: 2026-03-17
Scor 4.9 4.8
Rang #144 #149
Fiabilitate 10.0 10.0
Consistență 7.5 8.2
Teste corecte
Rată de trecere pe încercare 47.6% 30.2%
Teste instabile 6 5
Rulări totale 63 63
Cost per rezultat 0.000 0.259
Cost total $0.000 $0.011
Preț de intrare $0.000 / 1M $0.200 / 1M
Preț de ieșire $0.000 / 1M $1.250 / 1M
Total tokenuri de intrare 37,449 34,212
Tokenuri de ieșire 1,677 2,784
Tokenuri de raționament 116,703 0
Timp de răspuns (mediu) 39.90s 1.48s
Timp de răspuns (maxim) 309.02s 4.47s
Timp de răspuns (total) 797.98s 31.01s

Generation showcase

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#144 Cobuddy

medium
No showcase result has been generated for this model yet.
Cost
$0.000
Time
-
Tokens
0 tok

#149 GPT-5.4 Nano

none
Cost
$0.008
Time
46.1s
Tokens
5,735 tok

Top modele după scor

Scor vs cost total

Timp de răspuns (mediu)

Scor vs Timp de răspuns (mediu)

Total tokenuri de ieșire

Scor vs Total tokenuri de ieșire

Defalcare pe categorii

Trucuri anti-AI Scor Consistență Rată de trecere pe încercare Teste instabile Teste corecte Timp de răspuns (mediu) Tokenuri de intrare Tokenuri de ieșire Tokenuri de raționament
Cobuddy 8.7 7.9 91.7% 1 10.00s 453 98 4,666
GPT-5.4 Nano 3.5 8.0 16.7% 1 1.18s 606 800 0
Programare Scor Consistență Rată de trecere pe încercare Teste instabile Teste corecte Timp de răspuns (mediu) Tokenuri de intrare Tokenuri de ieșire Tokenuri de raționament
Cobuddy 3.7 6.7 22.2% 1 79.17s 4,726 358 30,138
GPT-5.4 Nano 4.6 7.9 22.2% 1 2.22s 7,305 613 0
Combinat Scor Consistență Rată de trecere pe încercare Teste instabile Teste corecte Timp de răspuns (mediu) Tokenuri de intrare Tokenuri de ieșire Tokenuri de raționament
Cobuddy 3.0 10.0 0.0% 0 47.38s 18,324 465 7,265
GPT-5.4 Nano 3.0 10.0 0.0% 0 3.84s 11,019 280 0
Parsare și extragere de date Scor Consistență Rată de trecere pe încercare Teste instabile Teste corecte Timp de răspuns (mediu) Tokenuri de intrare Tokenuri de ieșire Tokenuri de raționament
Cobuddy 6.3 5.8 66.7% 1 17.36s 8,181 275 5,591
GPT-5.4 Nano 6.5 10.0 50.0% 0 1.11s 7,140 219 0
Specific domeniului Scor Consistență Rată de trecere pe încercare Teste instabile Teste corecte Timp de răspuns (mediu) Tokenuri de intrare Tokenuri de ieșire Tokenuri de raționament
Cobuddy 2.9 4.4 22.2% 2 128.15s 540 10 49,454
GPT-5.4 Nano 2.9 4.4 22.2% 2 926ms 723 52 0
Inteligență generală Scor Consistență Rată de trecere pe încercare Teste instabile Teste corecte Timp de răspuns (mediu) Tokenuri de intrare Tokenuri de ieșire Tokenuri de raționament
Cobuddy 4.2 9.9 0.0% 0 23.23s 498 76 3,782
GPT-5.4 Nano 3.8 2.5 33.3% 1 1.31s 477 180 0
Respectarea instrucțiunilor Scor Consistență Rată de trecere pe încercare Teste instabile Teste corecte Timp de răspuns (mediu) Tokenuri de intrare Tokenuri de ieșire Tokenuri de raționament
Cobuddy 9.8 10.0 100.0% 0 11.60s 508 64 2,842
GPT-5.4 Nano 6.3 10.0 50.0% 0 784ms 660 89 0
Rezolvare de puzzle-uri Scor Consistență Rată de trecere pe încercare Teste instabile Teste corecte Timp de răspuns (mediu) Tokenuri de intrare Tokenuri de ieșire Tokenuri de raționament
Cobuddy 3.6 7.2 22.2% 1 12.83s 561 189 5,808
GPT-5.4 Nano 5.4 10.0 33.3% 0 1.25s 642 308 0
Apelare instrumente Scor Consistență Rată de trecere pe încercare Teste instabile Teste corecte Timp de răspuns (mediu) Tokenuri de intrare Tokenuri de ieșire Tokenuri de raționament
Cobuddy 10.0 10.0 100.0% 0 11.19s 3,505 133 294
GPT-5.4 Nano 10.0 10.0 100.0% 0 3.40s 5,445 222 0
Cultură generală Scor Consistență Rată de trecere pe încercare Teste instabile Teste corecte Timp de răspuns (mediu) Tokenuri de intrare Tokenuri de ieșire Tokenuri de raționament
Cobuddy 3.0 10.0 0.0% 0 36.98s 153 9 6,863
GPT-5.4 Nano 3.0 10.0 0.0% 0 773ms 195 21 0

Comparație rapidă

Schimbă perechea de comparație