- Rang
- #21
- Totaal aantal uitvoer-tokens
- 36,457
- Responstijd (gem.)
- 25.88s
- Totale kosten
- $1.266
Claude Opus 5.5 (high) vs Grok 4.6 (high)
Grok 4.6 (high) leidt in gemiddelde score met 9.3 vs 9.3. Claude Opus 5.5 (high) heeft lagere benchmarkkosten met $1.266 vs $1.908. Claude Opus 5.5 (high) is sneller met 25.88s vs 84.15s, met slagingspercentages van 86.4% vs 86.4%.
Vergeleken modellen
- Rang
- #19
- Totaal aantal uitvoer-tokens
- 282,217
- Responstijd (gem.)
- 84.15s
- Totale kosten
- $1.908
Aanbevolen model
Claude Opus 5.5 (high)
De score blijft dicht bij de beste score hier (9.3 vs 9.3) en het kost ongeveer 1.5x minder dan Grok 4.6 (high).
Gedetailleerde vergelijking
| Metriek | Claude Opus 5.5 Claude Opus 5.5 high | Grok 4.6 Grok 4.6 high |
|---|---|---|
| Score | 9.3 | 9.3 |
| Rang | #21 | #19 |
| Betrouwbaarheid | 10.0 | 10.0 |
| Consistentie | 9.3 | 10.0 |
| Pogingen | 66/66 | 66/66 |
| Correcte tests | ||
| Slaagpercentage per poging | 86.4% | 86.4% |
| Instabiele tests | 2 | 0 |
| Totaal runs | 66 | 66 |
| Kosten per resultaat | 7.029 | 10.042 |
| Totale kosten | $1.266 | $1.908 |
| Invoerprijs | $4.000 / 1M | $2.000 / 1M |
| Uitvoerprijs | $20.000 / 1M | $6.000 / 1M |
| Totaal aantal invoer-tokens | 134,020 | 107,275 |
| Uitvoer-tokens | 7,237 | 5,094 |
| Redeneer-tokens | 29,220 | 277,123 |
| Responstijd (gem.) | 25.88s | 84.15s |
| Responstijd (max) | 95.95s | 618.49s |
| Responstijd (totaal) | 569.33s | 1851.26s |
| Parameters | ~5T totaal (~500B actief) | ~1.7T totaal (~170B actief) |
| Beschikbaarheid | Gesloten broncode | Gesloten broncode |
Model generatie-showcase
Hamster playing table tennis
Prompt: Create a detailed SVG illustration of a hamster playing table tennis.
#21 Claude Opus 5.5
high- Kosten
- $0.136
- Tijd
- 75.6s
- Tokens
- 6,934 tok
#19 SpaceXAI: Grok 4.6
high- Kosten
- $0.107
- Tijd
- 265.1s
- Tokens
- 18,001 tok
Topmodellen op score
Score vs totale kosten
Responstijd (gem.)
Score vs Responstijd (gem.)
Totaal aantal uitvoer-tokens
Score vs Totaal aantal uitvoer-tokens
Categorie-uitsplitsing
| Anti-AI-trucs | Score | Consistentie | Slaagpercentage per poging | Instabiele tests | Correcte tests | Responstijd (gem.) | Invoer-tokens | Uitvoer-tokens | Redeneer-tokens |
|---|---|---|---|---|---|---|---|---|---|
| Claude Opus 5.5 | 10.0 | 10.0 | 100.0% | 0 | 12.58s | 858 | 313 | 683 | |
| Grok 4.6 | 10.0 | 10.0 | 100.0% | 0 | 14.44s | 2,991 | 79 | 6,805 |
| Programmeren | Score | Consistentie | Slaagpercentage per poging | Instabiele tests | Correcte tests | Responstijd (gem.) | Invoer-tokens | Uitvoer-tokens | Redeneer-tokens |
|---|---|---|---|---|---|---|---|---|---|
| Claude Opus 5.5 | 10.0 | 10.0 | 100.0% | 0 | 13.44s | 10,608 | 584 | 5,042 | |
| Grok 4.6 | 10.0 | 10.0 | 100.0% | 0 | 102.20s | 9,579 | 379 | 51,829 |
| Gecombineerd | Score | Consistentie | Slaagpercentage per poging | Instabiele tests | Correcte tests | Responstijd (gem.) | Invoer-tokens | Uitvoer-tokens | Redeneer-tokens |
|---|---|---|---|---|---|---|---|---|---|
| Claude Opus 5.5 | 10.0 | 10.0 | 100.0% | 0 | 60.05s | 96,745 | 4,683 | 6,301 | |
| Grok 4.6 | 10.0 | 10.0 | 100.0% | 0 | 91.77s | 68,548 | 3,931 | 34,529 |
| Gegevensparsering en extractie | Score | Consistentie | Slaagpercentage per poging | Instabiele tests | Correcte tests | Responstijd (gem.) | Invoer-tokens | Uitvoer-tokens | Redeneer-tokens |
|---|---|---|---|---|---|---|---|---|---|
| Claude Opus 5.5 | 10.0 | 10.0 | 100.0% | 0 | 12.31s | 10,515 | 312 | 355 | |
| Grok 4.6 | 10.0 | 10.0 | 100.0% | 0 | 16.08s | 8,937 | 225 | 6,590 |
| Domeinspecifiek | Score | Consistentie | Slaagpercentage per poging | Instabiele tests | Correcte tests | Responstijd (gem.) | Invoer-tokens | Uitvoer-tokens | Redeneer-tokens |
|---|---|---|---|---|---|---|---|---|---|
| Claude Opus 5.5 | 5.3 | 7.2 | 44.4% | 1 | 30.08s | 990 | 58 | 14,458 | |
| Grok 4.6 | 5.3 | 10.0 | 33.3% | 0 | 369.95s | 2,523 | 14 | 154,471 |
| Algemene intelligentie | Score | Consistentie | Slaagpercentage per poging | Instabiele tests | Correcte tests | Responstijd (gem.) | Invoer-tokens | Uitvoer-tokens | Redeneer-tokens |
|---|---|---|---|---|---|---|---|---|---|
| Claude Opus 5.5 | 10.0 | 10.0 | 100.0% | 0 | 5.66s | 714 | 283 | 352 | |
| Grok 4.6 | 10.0 | 10.0 | 100.0% | 0 | 19.51s | 1,077 | 56 | 2,448 |
| Instructies opvolgen | Score | Consistentie | Slaagpercentage per poging | Instabiele tests | Correcte tests | Responstijd (gem.) | Invoer-tokens | Uitvoer-tokens | Redeneer-tokens |
|---|---|---|---|---|---|---|---|---|---|
| Claude Opus 5.5 | 10.0 | 10.0 | 100.0% | 0 | 21.35s | 921 | 96 | 435 | |
| Grok 4.6 | 9.8 | 10.0 | 100.0% | 0 | 13.82s | 1,857 | 57 | 4,318 |
| Puzzeloplossing | Score | Consistentie | Slaagpercentage per poging | Instabiele tests | Correcte tests | Responstijd (gem.) | Invoer-tokens | Uitvoer-tokens | Redeneer-tokens |
|---|---|---|---|---|---|---|---|---|---|
| Claude Opus 5.5 | 8.7 | 7.7 | 88.9% | 1 | 30.85s | 912 | 496 | 605 | |
| Grok 4.6 | 10.0 | 10.0 | 100.0% | 0 | 15.56s | 2,430 | 122 | 5,706 |
| Toolaanroepen | Score | Consistentie | Slaagpercentage per poging | Instabiele tests | Correcte tests | Responstijd (gem.) | Invoer-tokens | Uitvoer-tokens | Redeneer-tokens |
|---|---|---|---|---|---|---|---|---|---|
| Claude Opus 5.5 | 10.0 | 10.0 | 100.0% | 0 | 75.42s | 11,757 | 412 | 989 | |
| Grok 4.6 | 10.0 | 10.0 | 100.0% | 0 | 13.30s | 8,544 | 216 | 1,505 |
| Algemene kennis | Score | Consistentie | Slaagpercentage per poging | Instabiele tests | Correcte tests | Responstijd (gem.) | Invoer-tokens | Uitvoer-tokens | Redeneer-tokens |
|---|---|---|---|---|---|---|---|---|---|
| Claude Opus 5.5 | 3.0 | 10.0 | 0.0% | 0 | 27.41s | 0 | 0 | 0 | |
| Grok 4.6 | 3.0 | 10.0 | 0.0% | 0 | 54.22s | 789 | 15 | 8,922 |
Snelle vergelijking
Vergelijkingspaar wisselen
GPT-5.5lowvsGrok 4.6highClaude Opus 5.5highvsGemini 3.1 Pro PreviewmediumClaude Opus 5.5lowvsGrok 4.6highGPT-6 AstramediumvsGrok 4.6highGPT-5.6 SolmediumvsGrok 4.6highGPT-6 SolmediumvsGrok 4.6highClaude Opus 5.5highvsGemini 3.7 FlashlowClaude Opus 5.5highvsGPT-5.5lowGemini 3.7 FlashmediumvsGrok 4.6highGemini 3.1 Pro PreviewmediumvsGrok 4.6highClaude Opus 5.5highvsGPT-6 AstramediumClaude Opus 5.5highvsGPT-5.6 Solmedium