- Rank
- #273
- Total Output Tokens
- 1,818,271
- Response Time (avg)
- 140.39s
- Total Cost
- $0.000
North Mini Code (medium) vs Kimi K2.5
North Mini Code (medium) leads on average score with 5.4 vs 5.3. North Mini Code (medium) has the lower benchmark cost at $0.000 vs $0.236. Kimi K2.5 is faster at 35.86s vs 140.39s, with pass rates of 42.0% vs 29.0%.
Compared models
- Rank
- #281
- Total Output Tokens
- 49,389
- Response Time (avg)
- 35.86s
- Total Cost
- $0.236
Recommended model
Kimi K2.5
Its score stays close to the best score here (5.3 vs 5.4), while responding about 3.9x faster than North Mini Code (medium).
Detailed comparison
| Metric | North Mini Code North Mini Code medium Free Available | Kimi K2.5 Kimi K2.5 none |
|---|---|---|
| Score | 5.4 | 5.3 |
| Rank | #273 | #281 |
| Reliability | 8.9 | 10.0 |
| Consistency | 8.6 | 8.6 |
| Attempts | 61/69 | 69/69 |
| Tests Correct | ||
| Attempt pass rate | 42.0% | 29.0% |
| Flaky tests | 4 | 4 |
| Total Runs | 61 | 69 |
| Cost per result | 0.000 | 4.976 |
| Total Cost | $0.000 | $0.236 |
| Input Price | $0.000 / 1M | $0.450 / 1M |
| Output Price | $0.000 / 1M | $2.250 / 1M |
| Total Input Tokens | 166,347 | 275,349 |
| Output Tokens | 423,884 | 49,389 |
| Reasoning Tokens | 1,394,387 | 0 |
| Response Time (avg) | 140.39s | 35.86s |
| Response Time (max) | 786.72s | 321.19s |
| Response Time (total) | 3229.07s | 609.61s |
| Parameters | 30B total (3B active) | 1T total (32B active) |
| Availability | Open source | Weights available |
Model generation showcase
Hamster playing table tennis
Prompt: Create a detailed SVG illustration of a hamster playing table tennis.
#273 North Mini Code
medium- Cost
- $0.000
- Time
- 51.8s
- Tokens
- 12,460 tok
#281 MoonshotAI: Kimi K2.5
none- Cost
- $0.015
- Time
- 89.1s
- Tokens
- 5,421 tok
Top Models by Score
Score vs Total Cost
Response Time (avg)
Score vs Response Time (avg)
Total Output Tokens
Score vs Total Output Tokens
Category Breakdown
| Agentic | Score | Consistency | Attempt pass rate | Flaky tests | Tests Correct | Response Time (avg) | Input Tokens | Output Tokens | Reasoning Tokens |
|---|---|---|---|---|---|---|---|---|---|
| North Mini Code | 3.9 | 9.6 | 0.0% | 0 | 105.20s | 84,605 | 0 | 53,480 | |
| Kimi K2.5 | 5.0 | 10.0 | 0.0% | 0 | 321.19s | 186,029 | 22,746 | 0 |
| Anti-AI Tricks | Score | Consistency | Attempt pass rate | Flaky tests | Tests Correct | Response Time (avg) | Input Tokens | Output Tokens | Reasoning Tokens |
|---|---|---|---|---|---|---|---|---|---|
| North Mini Code | 8.4 | 10.0 | 75.0% | 0 | 64.79s | 324 | 64,441 | 68,535 | |
| Kimi K2.5 | 3.6 | 8.4 | 8.3% | 1 | 6.24s | 652 | 373 | 0 |
| Coding | Score | Consistency | Attempt pass rate | Flaky tests | Tests Correct | Response Time (avg) | Input Tokens | Output Tokens | Reasoning Tokens |
|---|---|---|---|---|---|---|---|---|---|
| North Mini Code | 4.5 | 4.9 | 33.3% | 2 | 320.43s | 7,119 | 219,891 | 561,569 | |
| Kimi K2.5 | 5.5 | 10.0 | 33.3% | 0 | 24.56s | 7,311 | 4,708 | 0 |
| Combined | Score | Consistency | Attempt pass rate | Flaky tests | Tests Correct | Response Time (avg) | Input Tokens | Output Tokens | Reasoning Tokens |
|---|---|---|---|---|---|---|---|---|---|
| North Mini Code | 2.9 | 5.8 | 16.7% | 1 | 554.89s | 63,682 | 0 | 472,040 | |
| Kimi K2.5 | 2.8 | 1.8 | 33.3% | 2 | 61.00s | 65,552 | 20,729 | 0 |
| Data parsing and extraction | Score | Consistency | Attempt pass rate | Flaky tests | Tests Correct | Response Time (avg) | Input Tokens | Output Tokens | Reasoning Tokens |
|---|---|---|---|---|---|---|---|---|---|
| North Mini Code | 10.0 | 10.0 | 100.0% | 0 | 24.06s | 6,819 | 240 | 2,659 | |
| Kimi K2.5 | 7.3 | 5.8 | 83.3% | 1 | 42.13s | 7,180 | 187 | 0 |
| Domain specific | Score | Consistency | Attempt pass rate | Flaky tests | Tests Correct | Response Time (avg) | Input Tokens | Output Tokens | Reasoning Tokens |
|---|---|---|---|---|---|---|---|---|---|
| North Mini Code | 2.9 | 7.2 | 11.1% | 1 | 107.19s | 550 | 7,595 | 102,957 | |
| Kimi K2.5 | 3.0 | 10.0 | 0.0% | 0 | 2.75s | 751 | 34 | 0 |
| General Intelligence | Score | Consistency | Attempt pass rate | Flaky tests | Tests Correct | Response Time (avg) | Input Tokens | Output Tokens | Reasoning Tokens |
|---|---|---|---|---|---|---|---|---|---|
| North Mini Code | 5.1 | 10.0 | 0.0% | 0 | 25.08s | 444 | 1,546 | 1,635 | |
| Kimi K2.5 | 10.0 | 10.0 | 100.0% | 0 | 4.00s | 483 | 76 | 0 |
| Instructions following | Score | Consistency | Attempt pass rate | Flaky tests | Tests Correct | Response Time (avg) | Input Tokens | Output Tokens | Reasoning Tokens |
|---|---|---|---|---|---|---|---|---|---|
| North Mini Code | 9.8 | 10.0 | 100.0% | 0 | 15.43s | 379 | 909 | 1,339 | |
| Kimi K2.5 | 6.5 | 10.0 | 50.0% | 0 | 2.67s | 677 | 60 | 0 |
| Puzzle Solving | Score | Consistency | Attempt pass rate | Flaky tests | Tests Correct | Response Time (avg) | Input Tokens | Output Tokens | Reasoning Tokens |
|---|---|---|---|---|---|---|---|---|---|
| North Mini Code | 3.3 | 10.0 | 0.0% | 0 | 19.70s | 543 | 2,215 | 2,485 | |
| Kimi K2.5 | 3.0 | 10.0 | 0.0% | 0 | 4.04s | 667 | 236 | 0 |
| Tool Calling | Score | Consistency | Attempt pass rate | Flaky tests | Tests Correct | Response Time (avg) | Input Tokens | Output Tokens | Reasoning Tokens |
|---|---|---|---|---|---|---|---|---|---|
| North Mini Code | 10.0 | 10.0 | 100.0% | 0 | 3.93s | 1,776 | 41 | 563 | |
| Kimi K2.5 | 10.0 | 10.0 | 100.0% | 0 | 13.99s | 5,835 | 220 | 0 |
| Trivia | Score | Consistency | Attempt pass rate | Flaky tests | Tests Correct | Response Time (avg) | Input Tokens | Output Tokens | Reasoning Tokens |
|---|---|---|---|---|---|---|---|---|---|
| North Mini Code | 3.0 | 10.0 | 0.0% | 0 | 305.02s | 106 | 127,006 | 127,125 | |
| Kimi K2.5 | 3.0 | 10.0 | 0.0% | 0 | 3.90s | 212 | 20 | 0 |
Quick Compare
Switch Comparison Pair
North Mini CodemediumFree AvailablevsHy4 previewlowGranite 4.2 8BlowvsKimi K2.5noneNorth Mini CodemediumFree AvailablevsQwen3.8 27BnoneFree AvailableNorth Mini CodemediumFree AvailablevsMiMo-V2.6-FlashnoneNorth Mini CodemediumFree AvailablevsEmber-1noneSeed-2.0-CodenonevsNorth Mini CodemediumFree AvailableKimi K2.5nonevsStep 3.5 FlashmediumNorth Mini CodemediumFree AvailablevsGPT-5.6 LunanoneNorth Mini CodemediumFree AvailablevsGemma 4 26B A4BnoneFree AvailableNorth Mini CodemediumFree AvailablevsGranite 4.2 8BlowNorth Mini CodemediumFree AvailablevsGPT-6 LunanoneNorth Mini CodemediumFree AvailablevsGemini 2.5 Flashnone