Samenvatting
D1 scoort 1.9 op AI BENCHY en staat op #382. Het model heeft 10.0 betrouwbaarheid, een slagingspercentage van 11.6%, $0.003 totale kosten en 508ms gemiddelde responstijd.
Modelgegevens
Onderzocht op 2026-10-02
- Parameters
- -
- Architectuur
- Overig
- Beschikbaarheid
- Gesloten broncode
- Licentie
- -
1.9
Consistentie
4.9
10.0
Totaal aantal uitvoer-tokens
0
Totaal aantal invoer-tokens
55,956
Invoerprijs
$0.040 / 1M
Uitvoerprijs
$0.000 / 1M
Prijs voor cachelezen
$0.040 / 1M
Prijs voor cacheschrijven
n.v.t.
Cacheprijzen gelden voor invoertokens. Lezen hergebruikt opgeslagen prompts; schrijven slaat ze op en kan extra kosten. Voor uitvoertokens geldt de uitvoerprijs.
Foute tests: 10
Slaagpercentage per poging: 11.6%
Benchmarkdekking: 36/69 pogingen. Adapters leveren de keuzes. Ondersteunt 12/23 tests. Andere tests worden niet ondersteund en tellen niet als mislukt. De score gebruikt de volledige testreeks.
Instabiele tests
1
Instabiele tests hadden gemengde uitkomsten over runs (minstens één geslaagd en één gefaald).
Grafieken
Kies eerst het eerste model en klik daarna op een tweede model om een zij-aan-zijpagina te openen.
Score vs Totale kosten
Responstijd (gem.)
Score vs Responstijd (gem.)
Totaal aantal uitvoer-tokens
Score vs Totaal aantal uitvoer-tokens
Snelle vergelijking
Categorie-uitsplitsing
| Categorie | Score | Consistentie | Correcte tests |
|---|---|---|---|
| Agenttaken | 0.0 | 0.0 | |
| Anti-AI-trucs | 4.0 | 7.5 | |
| Programmeren | 2.2 | 6.7 | |
| Gecombineerd | 0.0 | 0.0 | |
| Gegevensparsering en extractie | 6.5 | 10.0 | |
| Domeinspecifiek | 3.6 | 7.2 | |
| Algemene intelligentie | 0.0 | 0.0 | |
| Instructies opvolgen | 1.5 | 5.0 | |
| Puzzeloplossing | 1.7 | 3.3 | |
| Toolaanroepen | 0.0 | 0.0 | |
| Algemene kennis | 0.0 | 0.0 |