- Rank
- #206
- Total Output Tokens
- 241,096
- Response Time (avg)
- 125.76s
- Total Cost
- $0.603
Kimi K2.5 (medium) vs Laguna XS 2.1 (medium)
Laguna XS 2.1 (medium) leads on average score with 6.4 vs 6.4. Laguna XS 2.1 (medium) has the lower benchmark cost at $0.083 vs $0.603. Laguna XS 2.1 (medium) is faster at 48.97s vs 125.76s, with pass rates of 60.9% vs 46.4%.
Compared models
- Rank
- #200
- Total Output Tokens
- 538,292
- Response Time (avg)
- 48.97s
- Total Cost
- $0.083
Recommended model
Laguna XS 2.1 (medium)
It has the best score here (6.4), while costing about 7.3x less than Kimi K2.5 (medium).
Detailed comparison
| Metric | Kimi K2.5 Kimi K2.5 medium | Laguna XS 2.1 Laguna XS 2.1 medium Free Available |
|---|---|---|
| Score | 6.4 | 6.4 |
| Rank | #206 | #200 |
| Reliability | 9.6 | 10.0 |
| Consistency | 7.1 | 9.0 |
| Attempts | 69/69 | 69/69 |
| Tests Correct | ||
| Attempt pass rate | 60.9% | 46.4% |
| Flaky tests | 8 | 3 |
| Total Runs | 69 | 69 |
| Cost per result | 6.085 | 0.922 |
| Total Cost | $0.603 | $0.083 |
| Input Price | $0.450 / 1M | $0.060 / 1M |
| Output Price | $2.250 / 1M | $0.120 / 1M |
| Total Input Tokens | 292,271 | 352,516 |
| Output Tokens | 55,025 | 33,786 |
| Reasoning Tokens | 186,071 | 504,506 |
| Response Time (avg) | 125.76s | 48.97s |
| Response Time (max) | 566.79s | 422.72s |
| Response Time (total) | 2137.84s | 1126.35s |
| Parameters | 1T total (32B active) | 33B total (3B active) |
| Availability | Weights available | Weights available |
Model generation showcase
Hamster playing table tennis
Prompt: Create a detailed SVG illustration of a hamster playing table tennis.
#206 MoonshotAI: Kimi K2.5
medium- Cost
- $0.030
- Time
- 58.6s
- Tokens
- 8,683 tok
#200 Laguna XS 2.1
medium- Cost
- $0.001
- Time
- 30.6s
- Tokens
- 4,678 tok
Top Models by Score
Score vs Total Cost
Response Time (avg)
Score vs Response Time (avg)
Total Output Tokens
Score vs Total Output Tokens
Category Breakdown
| Agentic | Score | Consistency | Attempt pass rate | Flaky tests | Tests Correct | Response Time (avg) | Input Tokens | Output Tokens | Reasoning Tokens |
|---|---|---|---|---|---|---|---|---|---|
| Kimi K2.5 | 3.9 | 9.6 | 0.0% | 0 | 566.79s | 173,775 | 1,503 | 18,651 | |
| Laguna XS 2.1 | 6.1 | 3.1 | 66.7% | 1 | 66.42s | 233,518 | 3,036 | 12,776 |
| Anti-AI Tricks | Score | Consistency | Attempt pass rate | Flaky tests | Tests Correct | Response Time (avg) | Input Tokens | Output Tokens | Reasoning Tokens |
|---|---|---|---|---|---|---|---|---|---|
| Kimi K2.5 | 7.3 | 5.8 | 83.3% | 2 | 51.38s | 634 | 2,789 | 8,880 | |
| Laguna XS 2.1 | 4.8 | 10.0 | 25.0% | 0 | 41.96s | 774 | 353 | 73,090 |
| Coding | Score | Consistency | Attempt pass rate | Flaky tests | Tests Correct | Response Time (avg) | Input Tokens | Output Tokens | Reasoning Tokens |
|---|---|---|---|---|---|---|---|---|---|
| Kimi K2.5 | 6.1 | 4.6 | 66.7% | 2 | 217.49s | 6,935 | 5,705 | 74,693 | |
| Laguna XS 2.1 | 5.5 | 10.0 | 33.3% | 0 | 70.35s | 7,995 | 23,767 | 83,258 |
| Combined | Score | Consistency | Attempt pass rate | Flaky tests | Tests Correct | Response Time (avg) | Input Tokens | Output Tokens | Reasoning Tokens |
|---|---|---|---|---|---|---|---|---|---|
| Kimi K2.5 | 6.7 | 9.1 | 50.0% | 0 | 89.19s | 95,416 | 14,448 | 11,209 | |
| Laguna XS 2.1 | 6.3 | 10.0 | 50.0% | 0 | 218.07s | 91,698 | 5,496 | 229,064 |
| Data parsing and extraction | Score | Consistency | Attempt pass rate | Flaky tests | Tests Correct | Response Time (avg) | Input Tokens | Output Tokens | Reasoning Tokens |
|---|---|---|---|---|---|---|---|---|---|
| Kimi K2.5 | 10.0 | 10.0 | 100.0% | 0 | 49.78s | 7,020 | 563 | 7,940 | |
| Laguna XS 2.1 | 10.0 | 10.0 | 100.0% | 0 | 4.50s | 7,734 | 234 | 3,129 |
| Domain specific | Score | Consistency | Attempt pass rate | Flaky tests | Tests Correct | Response Time (avg) | Input Tokens | Output Tokens | Reasoning Tokens |
|---|---|---|---|---|---|---|---|---|---|
| Kimi K2.5 | 2.9 | 4.4 | 22.2% | 2 | 111.65s | 533 | 12,151 | 32,741 | |
| Laguna XS 2.1 | 3.5 | 4.4 | 33.3% | 2 | 67.48s | 843 | 17 | 91,430 |
| General Intelligence | Score | Consistency | Attempt pass rate | Flaky tests | Tests Correct | Response Time (avg) | Input Tokens | Output Tokens | Reasoning Tokens |
|---|---|---|---|---|---|---|---|---|---|
| Kimi K2.5 | 6.5 | 3.4 | 66.7% | 1 | 69.73s | 480 | 3,815 | 4,262 | |
| Laguna XS 2.1 | 5.0 | 10.0 | 0.0% | 0 | 4.15s | 537 | 119 | 1,375 |
| Instructions following | Score | Consistency | Attempt pass rate | Flaky tests | Tests Correct | Response Time (avg) | Input Tokens | Output Tokens | Reasoning Tokens |
|---|---|---|---|---|---|---|---|---|---|
| Kimi K2.5 | 10.0 | 10.0 | 100.0% | 0 | 92.47s | 675 | 5,371 | 6,547 | |
| Laguna XS 2.1 | 9.8 | 10.0 | 100.0% | 0 | 2.57s | 753 | 82 | 1,844 |
| Puzzle Solving | Score | Consistency | Attempt pass rate | Flaky tests | Tests Correct | Response Time (avg) | Input Tokens | Output Tokens | Reasoning Tokens |
|---|---|---|---|---|---|---|---|---|---|
| Kimi K2.5 | 5.3 | 7.3 | 44.4% | 1 | 43.23s | 659 | 8,426 | 12,692 | |
| Laguna XS 2.1 | 5.3 | 10.0 | 33.3% | 0 | 3.43s | 771 | 357 | 3,355 |
| Tool Calling | Score | Consistency | Attempt pass rate | Flaky tests | Tests Correct | Response Time (avg) | Input Tokens | Output Tokens | Reasoning Tokens |
|---|---|---|---|---|---|---|---|---|---|
| Kimi K2.5 | 10.0 | 10.0 | 100.0% | 0 | 31.74s | 5,933 | 242 | 812 | |
| Laguna XS 2.1 | 10.0 | 10.0 | 100.0% | 0 | 3.01s | 7,638 | 309 | 748 |
| Trivia | Score | Consistency | Attempt pass rate | Flaky tests | Tests Correct | Response Time (avg) | Input Tokens | Output Tokens | Reasoning Tokens |
|---|---|---|---|---|---|---|---|---|---|
| Kimi K2.5 | 3.0 | 10.0 | 0.0% | 0 | 83.95s | 211 | 12 | 7,644 | |
| Laguna XS 2.1 | 3.0 | 10.0 | 0.0% | 0 | 10.88s | 255 | 16 | 4,437 |
Quick Compare
Switch Comparison Pair
Laguna XS 2.1mediumFree AvailablevsQwen3.5-122B-A10BnoneKAT-Coder-Pro V2.5highvsLaguna XS 2.1mediumFree AvailableLaguna XS 2.1mediumFree AvailablevsGLM 5.2noneGemini 3.5 FlashminimalvsKimi K2.5mediumGemini 3 Flash PreviewnonevsLaguna XS 2.1mediumFree AvailableLaguna XS 2.1mediumFree AvailablevsGLM 5.1noneLaguna XS 2.1mediumFree AvailablevsQwen3.5 Plus 2026-02-15noneDots 3 Note PreviewhighFree AvailablevsKimi K2.5mediumDots 3 Note PreviewlowFree AvailablevsKimi K2.5mediumLaguna XS 2.1mediumFree AvailablevsGLM 5.3lowKimi K2.5mediumvsQwen3.5 Plus 2026-02-15noneMercury 2.5highvsLaguna XS 2.1mediumFree Available