- Rank
- #70
- Total Output Tokens
- 919,699
- Response Time (avg)
- 61.71s
- Total Cost
- $0.509
Claude Haiku 5.5 (max) vs Claude Sonnet 5 (medium)
The average score is effectively tied at 8.5 vs 8.5. Claude Haiku 5.5 (max) has the lower benchmark cost at $0.509 vs $1.438. Claude Sonnet 5 (medium) is faster at 15.01s vs 61.71s, with pass rates of 85.5% vs 76.8%.
Compared models
- Rank
- #68
- Total Output Tokens
- 73,018
- Response Time (avg)
- 15.01s
- Total Cost
- $1.438
Recommended model
Claude Haiku 5.5 (max)
It has the best score here (8.5), while costing about 2.8x less than Claude Sonnet 5 (medium).
Detailed comparison
| Metric | Claude Haiku 5.5 Claude Haiku 5.5 max | Claude Sonnet 5 Claude Sonnet 5 medium |
|---|---|---|
| Score | 8.5 | 8.5 |
| Rank | #70 | #68 |
| Reliability | 10.0 | 10.0 |
| Consistency | 9.6 | 9.1 |
| Attempts | 69/69 | 69/69 |
| Tests Correct | ||
| Attempt pass rate | 85.5% | 76.8% |
| Flaky tests | 1 | 3 |
| Total Runs | 69 | 69 |
| Cost per result | 2.677 | 8.985 |
| Total Cost | $0.509 | $1.438 |
| Input Price | $0.100 / 1M | $2.000 / 1M |
| Output Price | $0.500 / 1M | $10.000 / 1M |
| Cache Read Price | $0.010 / 1M | $0.200 / 1M |
| Cache Write Price | $0.125 / 1M | $2.500 / 1M |
| Total Input Tokens | 487,516 | 353,658 |
| Output Tokens | 10,212 | 54,891 |
| Reasoning Tokens | 909,487 | 18,370 |
| Response Time (avg) | 61.71s | 15.01s |
| Response Time (max) | 288.94s | 69.26s |
| Response Time (total) | 1419.40s | 345.16s |
| Parameters | ~50B | ~1T total (~100B active) |
| Availability | Closed | Closed |
Cache prices apply to input tokens. Reads reuse cached prompts; writes store them and can cost extra. Output tokens use the output price.
Model generation showcase
Hamster playing table tennis
Prompt: Create a detailed SVG illustration of a hamster playing table tennis.
#70 Claude Haiku 5.5
max
OpenRouter returned no showcase content (finish_reason: error).
- Cost
- $0.000
- Time
- 164.5s
- Tokens
- 0 tok
#68 Claude Sonnet 5
medium- Cost
- $0.007
- Time
- 6.4s
- Tokens
- 832 tok
Category Breakdown
| Agentic | Score | Consistency | Attempt pass rate | Flaky tests | Tests Correct | Response Time (avg) | Input Tokens | Output Tokens | Reasoning Tokens |
|---|---|---|---|---|---|---|---|---|---|
| Claude Haiku 5.5 | 4.7 | 1.6 | 66.7% | 1 | 93.30s | 349,997 | 2,345 | 42,315 | |
| Claude Sonnet 5 | 10.0 | 10.0 | 100.0% | 0 | 69.26s | 207,705 | 2,561 | 7,496 |
| Anti-AI Tricks | Score | Consistency | Attempt pass rate | Flaky tests | Tests Correct | Response Time (avg) | Input Tokens | Output Tokens | Reasoning Tokens |
|---|---|---|---|---|---|---|---|---|---|
| Claude Haiku 5.5 | 10.0 | 10.0 | 100.0% | 0 | 5.52s | 858 | 401 | 10,159 | |
| Claude Sonnet 5 | 10.0 | 10.0 | 100.0% | 0 | 3.80s | 834 | 1,220 | 446 |
| Coding | Score | Consistency | Attempt pass rate | Flaky tests | Tests Correct | Response Time (avg) | Input Tokens | Output Tokens | Reasoning Tokens |
|---|---|---|---|---|---|---|---|---|---|
| Claude Haiku 5.5 | 10.0 | 10.0 | 100.0% | 0 | 55.87s | 10,608 | 532 | 125,988 | |
| Claude Sonnet 5 | 9.0 | 7.9 | 88.9% | 1 | 17.28s | 10,590 | 13,153 | 2,379 |
| Combined | Score | Consistency | Attempt pass rate | Flaky tests | Tests Correct | Response Time (avg) | Input Tokens | Output Tokens | Reasoning Tokens |
|---|---|---|---|---|---|---|---|---|---|
| Claude Haiku 5.5 | 10.0 | 10.0 | 100.0% | 0 | 148.38s | 99,980 | 4,909 | 215,518 | |
| Claude Sonnet 5 | 7.3 | 6.0 | 83.3% | 1 | 51.86s | 107,934 | 23,169 | 5,371 |
| Data parsing and extraction | Score | Consistency | Attempt pass rate | Flaky tests | Tests Correct | Response Time (avg) | Input Tokens | Output Tokens | Reasoning Tokens |
|---|---|---|---|---|---|---|---|---|---|
| Claude Haiku 5.5 | 10.0 | 10.0 | 100.0% | 0 | 11.11s | 10,515 | 311 | 13,476 | |
| Claude Sonnet 5 | 10.0 | 10.0 | 100.0% | 0 | 3.16s | 10,503 | 312 | 0 |
| Domain specific | Score | Consistency | Attempt pass rate | Flaky tests | Tests Correct | Response Time (avg) | Input Tokens | Output Tokens | Reasoning Tokens |
|---|---|---|---|---|---|---|---|---|---|
| Claude Haiku 5.5 | 5.3 | 10.0 | 33.3% | 0 | 228.16s | 990 | 18 | 426,269 | |
| Claude Sonnet 5 | 5.3 | 10.0 | 33.3% | 0 | 20.54s | 972 | 12,137 | 1,994 |
| General Intelligence | Score | Consistency | Attempt pass rate | Flaky tests | Tests Correct | Response Time (avg) | Input Tokens | Output Tokens | Reasoning Tokens |
|---|---|---|---|---|---|---|---|---|---|
| Claude Haiku 5.5 | 10.0 | 10.0 | 100.0% | 0 | 42.22s | 714 | 250 | 26,083 | |
| Claude Sonnet 5 | 4.8 | 3.2 | 33.3% | 1 | 4.32s | 708 | 264 | 0 |
| Instructions following | Score | Consistency | Attempt pass rate | Flaky tests | Tests Correct | Response Time (avg) | Input Tokens | Output Tokens | Reasoning Tokens |
|---|---|---|---|---|---|---|---|---|---|
| Claude Haiku 5.5 | 10.0 | 10.0 | 100.0% | 0 | 6.22s | 921 | 99 | 5,965 | |
| Claude Sonnet 5 | 9.9 | 10.0 | 100.0% | 0 | 3.10s | 909 | 318 | 269 |
| Puzzle Solving | Score | Consistency | Attempt pass rate | Flaky tests | Tests Correct | Response Time (avg) | Input Tokens | Output Tokens | Reasoning Tokens |
|---|---|---|---|---|---|---|---|---|---|
| Claude Haiku 5.5 | 10.0 | 10.0 | 100.0% | 0 | 16.54s | 912 | 716 | 29,419 | |
| Claude Sonnet 5 | 7.7 | 10.0 | 66.7% | 0 | 2.98s | 894 | 407 | 121 |
| Tool Calling | Score | Consistency | Attempt pass rate | Flaky tests | Tests Correct | Response Time (avg) | Input Tokens | Output Tokens | Reasoning Tokens |
|---|---|---|---|---|---|---|---|---|---|
| Claude Haiku 5.5 | 10.0 | 10.0 | 100.0% | 0 | 9.86s | 11,757 | 355 | 3,989 | |
| Claude Sonnet 5 | 10.0 | 10.0 | 100.0% | 0 | 10.70s | 12,351 | 433 | 90 |
| Trivia | Score | Consistency | Attempt pass rate | Flaky tests | Tests Correct | Response Time (avg) | Input Tokens | Output Tokens | Reasoning Tokens |
|---|---|---|---|---|---|---|---|---|---|
| Claude Haiku 5.5 | 3.0 | 10.0 | 0.0% | 0 | 18.80s | 264 | 276 | 10,306 | |
| Claude Sonnet 5 | 3.0 | 10.0 | 0.0% | 0 | 7.06s | 258 | 917 | 204 |
Quick Compare
Switch Comparison Pair
Claude Sonnet 5mediumvsMuse Spark 1.3lowClaude Haiku 5.5maxvsQwen3.7 MaxmediumClaude Sonnet 5mediumvsGrok 4.6highClaude Haiku 5.5maxvsMuse Spark 1.3lowClaude Haiku 5.5maxvsGrok 4.6highClaude Haiku 5.5maxvsQwen3.8 2.4T A95BlowClaude Sonnet 5mediumvsQwen3.8 Max (0902)lowClaude Haiku 5.5maxvsGPT-5 MinimediumClaude Haiku 5.5maxvsMuse Glimmer 30BxhighClaude Haiku 5.5maxvsGemini 3.1 Pro PreviewmediumClaude Sonnet 5mediumvsQwen3.8 2.4T A95BlowClaude Haiku 5.5maxvsQwen3.8 Max (0902)low