Navigatie
AI BENCHY
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

AI BENCHY Compare

Cobuddy vs Mistral: Mistral Small 4

Benchmarks gegenereerd uit AI BENCHY-testsuites op: 2026-05-22

Metriek Cobuddy Cobuddy medium Releasedatum: 2026-05-06 Gratis beschikbaar Mistral Small 4 Mistral Small 4 medium Releasedatum: 2026-03-16
Score 5.7 5.4
Rang #105 #121
Betrouwbaarheid 9.9 10.0
Consistentie 7.0 7.1
Correcte tests
Slaagpercentage per poging 51.7% 45.0%
Instabiele tests 7 7
Totaal runs 60 60
Kosten per resultaat 0.000 1.109
Totale kosten $0.000 $0.056
Invoerprijs $0.000 / 1M $0.150 / 1M
Uitvoerprijs $0.000 / 1M $0.600 / 1M
Uitvoer-tokens 1,663 21,628
Redeneer-tokens 116,522 68,055
Responstijd (gem.) 39.91s 8.33s
Responstijd (max) 309.02s 59.15s
Responstijd (totaal) 798.21s 166.59s

Topmodellen op score

Score vs totale kosten

Responstijd (gem.)

Score vs Responstijd (gem.)

Totaal aantal uitvoer-tokens

Score vs Totaal aantal uitvoer-tokens

Categorie-uitsplitsing

Anti-AI-trucs Score Consistentie Slaagpercentage per poging Instabiele tests Correcte tests Responstijd (gem.) Uitvoer-tokens Redeneer-tokens
Cobuddy 8.7 7.9 91.7% 1 10.00s 98 4,666
Mistral Small 4 5.6 3.8 66.7% 3 2.67s 4,055 4,778
Programmeren Score Consistentie Slaagpercentage per poging Instabiele tests Correcte tests Responstijd (gem.) Uitvoer-tokens Redeneer-tokens
Cobuddy 4.1 5.1 33.3% 1 79.17s 358 30,138
Mistral Small 4 5.1 6.8 33.3% 1 44.82s 9,322 38,386
Gecombineerd Score Consistentie Slaagpercentage per poging Instabiele tests Correcte tests Responstijd (gem.) Uitvoer-tokens Redeneer-tokens
Cobuddy 3.0 10.0 0.0% 0 47.38s 465 7,265
Mistral Small 4 3.0 10.0 0.0% 0 25.25s 2,612 10,700
Gegevensparsering en extractie Score Consistentie Slaagpercentage per poging Instabiele tests Correcte tests Responstijd (gem.) Uitvoer-tokens Redeneer-tokens
Cobuddy 6.3 5.8 66.7% 1 17.36s 275 5,591
Mistral Small 4 7.3 5.9 83.3% 1 1.23s 335 723
Domeinspecifiek Score Consistentie Slaagpercentage per poging Instabiele tests Correcte tests Responstijd (gem.) Uitvoer-tokens Redeneer-tokens
Cobuddy 2.9 4.4 22.2% 2 128.15s 10 49,454
Mistral Small 4 5.3 7.2 44.4% 1 6.11s 2,621 6,904
Algemene intelligentie Score Consistentie Slaagpercentage per poging Instabiele tests Correcte tests Responstijd (gem.) Uitvoer-tokens Redeneer-tokens
Cobuddy 4.2 9.9 0.0% 0 23.23s 76 3,782
Mistral Small 4 4.8 10.0 0.0% 0 2.05s 821 828
Instructies opvolgen Score Consistentie Slaagpercentage per poging Instabiele tests Correcte tests Responstijd (gem.) Uitvoer-tokens Redeneer-tokens
Cobuddy 9.8 10.0 100.0% 0 11.60s 64 2,842
Mistral Small 4 7.3 5.8 83.3% 1 1.38s 540 1,031
Puzzeloplossing Score Consistentie Slaagpercentage per poging Instabiele tests Correcte tests Responstijd (gem.) Uitvoer-tokens Redeneer-tokens
Cobuddy 3.5 4.4 33.3% 2 12.91s 175 5,627
Mistral Small 4 3.4 9.7 0.0% 0 2.00s 983 2,338
Toolaanroepen Score Consistentie Slaagpercentage per poging Instabiele tests Correcte tests Responstijd (gem.) Uitvoer-tokens Redeneer-tokens
Cobuddy 10.0 10.0 100.0% 0 11.19s 133 294
Mistral Small 4 10.0 10.0 100.0% 0 3.50s 321 810
Algemene kennis Score Consistentie Slaagpercentage per poging Instabiele tests Correcte tests Responstijd (gem.) Uitvoer-tokens Redeneer-tokens
Cobuddy 3.0 10.0 0.0% 0 36.98s 9 6,863
Mistral Small 4 3.0 10.0 0.0% 0 5.92s 18 1,557

Snelle vergelijking

Vergelijkingspaar wisselen