AI BENCHY
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

#39

Claude Sonnet 4.6

Anthropic · Releasedatum: 2026-02-17 · anthropic/claude-sonnet-4.6::none

Score

7.3

Consistentie

9.6

Totale kosten

$0.252

Totaal aantal uitvoer-tokens

6,910

Invoerprijs

$3.000 / 1M

Uitvoerprijs

$15.000 / 1M

Correcte tests

Foute tests: 7

Slaagpercentage per poging: 62.8%

Instabiele tests

1

Instabiele tests hadden gemengde uitkomsten over runs (minstens één geslaagd en één gefaald).

Responstijd (gem.)

5.12s

Responstijd (max): 23.84s

Responstijd (totaal): 51.16s

Grafieken

Kies eerst het eerste model en klik daarna op een tweede model om een zij-aan-zijpagina te openen.

Totaal aantal uitvoer-tokens

Score vs Totaal aantal uitvoer-tokens

Snelle vergelijking

Categorie-uitsplitsing

Categorie Score Consistentie Correcte tests
Anti-AI-trucs 4.8 10.0
Gecombineerd 9.5 10.0
Gegevensparsering en extractie 10.0 10.0
Domeinspecifiek 7.7 10.0
Algemene intelligentie 6.1 3.1
Instructies opvolgen 6.5 10.0
Puzzeloplossing 7.7 10.0
Toolaanroepen 10.0 10.0

Vergeleken modellen