Navigare
AI BENCHY
Advertise here

AI BENCHY Compare

Cobuddy vs DeepSeek: DeepSeek V3.2

Rezumat

Comparație benchmark Cobuddy vs DeepSeek V3.2: DeepSeek V3.2 conduce la scorul mediu cu 5.3 vs 4.9. Cobuddy are costul de benchmark mai mic, $0.000 vs $0.017. DeepSeek V3.2 este mai rapid cu 13.83s vs 39.90s, cu rate de reușită de 47.6% vs 39.7%.

Model recomandat: DeepSeek V3.2 - Are cel mai bun scor aici (5.3) și răspunde de aproximativ 2.9x mai rapid decât Cobuddy.

Benchmark-urile au fost generate din suitele de teste AI BENCHY la: 2026-06-18

Metrică Cobuddy Cobuddy medium Lansare: 2026-05-06 DeepSeek V3.2 DeepSeek V3.2 none Lansare: 2025-12-01
Scor 4.9 5.3
Rang #140 #126
Fiabilitate 10.0 10.0
Consistență 7.5 7.6
Teste corecte
Rată de trecere pe încercare 47.6% 39.7%
Teste instabile 6 6
Rulări totale 63 63
Cost per rezultat 0.000 0.306
Cost total $0.000 $0.017
Preț de intrare $0.000 / 1M $0.229 / 1M
Preț de ieșire $0.000 / 1M $0.344 / 1M
Total tokenuri de intrare 37,449 55,997
Tokenuri de ieșire 1,677 11,165
Tokenuri de raționament 116,703 0
Timp de răspuns (mediu) 39.90s 13.83s
Timp de răspuns (maxim) 309.02s 115.89s
Timp de răspuns (total) 797.98s 290.43s

Prezentare generare

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#140 Cobuddy

medium
No endpoints found for baidu/cobuddy:free.
Cost
$0.000
Timp
0.1s
Tokenuri
0 tok

#126 DeepSeek V3.2

none
Cost
$0.002
Timp
7.0s
Tokenuri
1,046 tok

Top modele după scor

Scor vs cost total

Timp de răspuns (mediu)

Scor vs Timp de răspuns (mediu)

Total tokenuri de ieșire

Scor vs Total tokenuri de ieșire

Defalcare pe categorii

Trucuri anti-AI Scor Consistență Rată de trecere pe încercare Teste instabile Teste corecte Timp de răspuns (mediu) Tokenuri de intrare Tokenuri de ieșire Tokenuri de raționament
Cobuddy 8.7 7.9 91.7% 1 10.00s 453 98 4,666
DeepSeek V3.2 3.2 8.0 8.3% 1 9.35s 494 1,073 0
Programare Scor Consistență Rată de trecere pe încercare Teste instabile Teste corecte Timp de răspuns (mediu) Tokenuri de intrare Tokenuri de ieșire Tokenuri de raționament
Cobuddy 3.7 6.7 22.2% 1 79.17s 4,726 358 30,138
DeepSeek V3.2 3.1 6.9 11.1% 1 14.54s 7,279 4,528 0
Combinat Scor Consistență Rată de trecere pe încercare Teste instabile Teste corecte Timp de răspuns (mediu) Tokenuri de intrare Tokenuri de ieșire Tokenuri de raționament
Cobuddy 3.0 10.0 0.0% 0 47.38s 18,324 465 7,265
DeepSeek V3.2 6.5 10.0 0.0% 0 115.89s 29,843 2,887 0
Parsare și extragere de date Scor Consistență Rată de trecere pe încercare Teste instabile Teste corecte Timp de răspuns (mediu) Tokenuri de intrare Tokenuri de ieșire Tokenuri de raționament
Cobuddy 6.3 5.8 66.7% 1 17.36s 8,181 275 5,591
DeepSeek V3.2 6.3 5.8 66.7% 1 9.42s 7,890 1,710 0
Specific domeniului Scor Consistență Rată de trecere pe încercare Teste instabile Teste corecte Timp de răspuns (mediu) Tokenuri de intrare Tokenuri de ieșire Tokenuri de raționament
Cobuddy 2.9 4.4 22.2% 2 128.15s 540 10 49,454
DeepSeek V3.2 2.9 7.2 11.1% 1 4.17s 624 21 0
Inteligență generală Scor Consistență Rată de trecere pe încercare Teste instabile Teste corecte Timp de răspuns (mediu) Tokenuri de intrare Tokenuri de ieșire Tokenuri de raționament
Cobuddy 4.2 9.9 0.0% 0 23.23s 498 76 3,782
DeepSeek V3.2 4.7 1.6 66.7% 1 9.32s 314 43 0
Respectarea instrucțiunilor Scor Consistență Rată de trecere pe încercare Teste instabile Teste corecte Timp de răspuns (mediu) Tokenuri de intrare Tokenuri de ieșire Tokenuri de raționament
Cobuddy 9.8 10.0 100.0% 0 11.60s 508 64 2,842
DeepSeek V3.2 10.0 10.0 100.0% 0 1.52s 627 66 0
Rezolvare de puzzle-uri Scor Consistență Rată de trecere pe încercare Teste instabile Teste corecte Timp de răspuns (mediu) Tokenuri de intrare Tokenuri de ieșire Tokenuri de raționament
Cobuddy 3.6 7.2 22.2% 1 12.83s 561 189 5,808
DeepSeek V3.2 7.6 7.2 77.8% 1 6.91s 424 298 0
Apelare instrumente Scor Consistență Rată de trecere pe încercare Teste instabile Teste corecte Timp de răspuns (mediu) Tokenuri de intrare Tokenuri de ieșire Tokenuri de raționament
Cobuddy 10.0 10.0 100.0% 0 11.19s 3,505 133 294
DeepSeek V3.2 10.0 10.0 100.0% 0 11.85s 8,319 522 0
Cultură generală Scor Consistență Rată de trecere pe încercare Teste instabile Teste corecte Timp de răspuns (mediu) Tokenuri de intrare Tokenuri de ieșire Tokenuri de raționament
Cobuddy 3.0 10.0 0.0% 0 36.98s 153 9 6,863
DeepSeek V3.2 3.0 10.0 0.0% 0 17.23s 183 17 0

Comparație rapidă

Schimbă perechea de comparație