- Rank
- #273
- Total Output Tokens
- 1,818,271
- Response Time (avg)
- 140.39s
- Total Cost
- $0.000
North Mini Code (medium) vs GPT-5.6 Luna
North Mini Code (medium) leads on average score with 5.4 vs 5.3. North Mini Code (medium) has the lower benchmark cost at $0.000 vs $0.056. GPT-5.6 Luna is faster at 3.78s vs 140.39s, with pass rates of 42.0% vs 34.8%.
Compared models
- Rank
- #279
- Total Output Tokens
- 8,000
- Response Time (avg)
- 3.78s
- Total Cost
- $0.056
Recommended model
GPT-5.6 Luna
Its score stays close to the best score here (5.3 vs 5.4), while responding about 37.2x faster than North Mini Code (medium).
Detailed comparison
| Metric | North Mini Code North Mini Code medium Free Available | GPT-5.6 Luna GPT-5.6 Luna none |
|---|---|---|
| Score | 5.4 | 5.3 |
| Rank | #273 | #279 |
| Reliability | 8.9 | 10.0 |
| Consistency | 8.6 | 8.8 |
| Attempts | 61/69 | 69/69 |
| Tests Correct | ||
| Attempt pass rate | 42.0% | 34.8% |
| Flaky tests | 4 | 3 |
| Total Runs | 61 | 69 |
| Cost per result | 0.000 | 2.814 |
| Total Cost | $0.000 | $0.056 |
| Input Price | $0.000 / 1M | $0.200 / 1M |
| Output Price | $0.000 / 1M | $1.200 / 1M |
| Total Input Tokens | 166,347 | 230,744 |
| Output Tokens | 423,884 | 8,000 |
| Reasoning Tokens | 1,394,387 | 0 |
| Response Time (avg) | 140.39s | 3.78s |
| Response Time (max) | 786.72s | 53.77s |
| Response Time (total) | 3229.07s | 86.83s |
| Parameters | 30B total (3B active) | ~400B total (~17B active) |
| Availability | Open source | Closed |
Model generation showcase
Hamster playing table tennis
Prompt: Create a detailed SVG illustration of a hamster playing table tennis.
#273 North Mini Code
medium- Cost
- $0.000
- Time
- 51.8s
- Tokens
- 12,460 tok
#279 GPT-5.6 Luna
none- Cost
- $0.016
- Time
- 15.8s
- Tokens
- 2,685 tok
Top Models by Score
Score vs Total Cost
Response Time (avg)
Score vs Response Time (avg)
Total Output Tokens
Score vs Total Output Tokens
Category Breakdown
| Agentic | Score | Consistency | Attempt pass rate | Flaky tests | Tests Correct | Response Time (avg) | Input Tokens | Output Tokens | Reasoning Tokens |
|---|---|---|---|---|---|---|---|---|---|
| North Mini Code | 3.9 | 9.6 | 0.0% | 0 | 105.20s | 84,605 | 0 | 53,480 | |
| GPT-5.6 Luna | 5.0 | 10.0 | 0.0% | 0 | 53.77s | 129,412 | 1,291 | 0 |
| Anti-AI Tricks | Score | Consistency | Attempt pass rate | Flaky tests | Tests Correct | Response Time (avg) | Input Tokens | Output Tokens | Reasoning Tokens |
|---|---|---|---|---|---|---|---|---|---|
| North Mini Code | 8.4 | 10.0 | 75.0% | 0 | 64.79s | 324 | 64,441 | 68,535 | |
| GPT-5.6 Luna | 4.8 | 10.0 | 25.0% | 0 | 901ms | 606 | 266 | 0 |
| Coding | Score | Consistency | Attempt pass rate | Flaky tests | Tests Correct | Response Time (avg) | Input Tokens | Output Tokens | Reasoning Tokens |
|---|---|---|---|---|---|---|---|---|---|
| North Mini Code | 4.5 | 4.9 | 33.3% | 2 | 320.43s | 7,119 | 219,891 | 561,569 | |
| GPT-5.6 Luna | 3.8 | 7.2 | 22.2% | 1 | 980ms | 7,302 | 459 | 0 |
| Combined | Score | Consistency | Attempt pass rate | Flaky tests | Tests Correct | Response Time (avg) | Input Tokens | Output Tokens | Reasoning Tokens |
|---|---|---|---|---|---|---|---|---|---|
| North Mini Code | 2.9 | 5.8 | 16.7% | 1 | 554.89s | 63,682 | 0 | 472,040 | |
| GPT-5.6 Luna | 3.2 | 9.1 | 0.0% | 0 | 6.68s | 78,124 | 5,022 | 0 |
| Data parsing and extraction | Score | Consistency | Attempt pass rate | Flaky tests | Tests Correct | Response Time (avg) | Input Tokens | Output Tokens | Reasoning Tokens |
|---|---|---|---|---|---|---|---|---|---|
| North Mini Code | 10.0 | 10.0 | 100.0% | 0 | 24.06s | 6,819 | 240 | 2,659 | |
| GPT-5.6 Luna | 10.0 | 10.0 | 100.0% | 0 | 758ms | 7,140 | 222 | 0 |
| Domain specific | Score | Consistency | Attempt pass rate | Flaky tests | Tests Correct | Response Time (avg) | Input Tokens | Output Tokens | Reasoning Tokens |
|---|---|---|---|---|---|---|---|---|---|
| North Mini Code | 2.9 | 7.2 | 11.1% | 1 | 107.19s | 550 | 7,595 | 102,957 | |
| GPT-5.6 Luna | 3.6 | 7.2 | 22.2% | 1 | 784ms | 732 | 54 | 0 |
| General Intelligence | Score | Consistency | Attempt pass rate | Flaky tests | Tests Correct | Response Time (avg) | Input Tokens | Output Tokens | Reasoning Tokens |
|---|---|---|---|---|---|---|---|---|---|
| North Mini Code | 5.1 | 10.0 | 0.0% | 0 | 25.08s | 444 | 1,546 | 1,635 | |
| GPT-5.6 Luna | 5.0 | 10.0 | 0.0% | 0 | 1.00s | 477 | 150 | 0 |
| Instructions following | Score | Consistency | Attempt pass rate | Flaky tests | Tests Correct | Response Time (avg) | Input Tokens | Output Tokens | Reasoning Tokens |
|---|---|---|---|---|---|---|---|---|---|
| North Mini Code | 9.8 | 10.0 | 100.0% | 0 | 15.43s | 379 | 909 | 1,339 | |
| GPT-5.6 Luna | 7.1 | 5.8 | 83.3% | 1 | 1.23s | 660 | 86 | 0 |
| Puzzle Solving | Score | Consistency | Attempt pass rate | Flaky tests | Tests Correct | Response Time (avg) | Input Tokens | Output Tokens | Reasoning Tokens |
|---|---|---|---|---|---|---|---|---|---|
| North Mini Code | 3.3 | 10.0 | 0.0% | 0 | 19.70s | 543 | 2,215 | 2,485 | |
| GPT-5.6 Luna | 5.3 | 10.0 | 33.3% | 0 | 790ms | 642 | 202 | 0 |
| Tool Calling | Score | Consistency | Attempt pass rate | Flaky tests | Tests Correct | Response Time (avg) | Input Tokens | Output Tokens | Reasoning Tokens |
|---|---|---|---|---|---|---|---|---|---|
| North Mini Code | 10.0 | 10.0 | 100.0% | 0 | 3.93s | 1,776 | 41 | 563 | |
| GPT-5.6 Luna | 10.0 | 10.0 | 100.0% | 0 | 2.80s | 5,454 | 222 | 0 |
| Trivia | Score | Consistency | Attempt pass rate | Flaky tests | Tests Correct | Response Time (avg) | Input Tokens | Output Tokens | Reasoning Tokens |
|---|---|---|---|---|---|---|---|---|---|
| North Mini Code | 3.0 | 10.0 | 0.0% | 0 | 305.02s | 106 | 127,006 | 127,125 | |
| GPT-5.6 Luna | 3.0 | 10.0 | 0.0% | 0 | 651ms | 195 | 26 | 0 |
Quick Compare
Switch Comparison Pair
Granite 4.2 8BlowvsGPT-5.6 LunanoneNorth Mini CodemediumFree AvailablevsHy4 previewlowNorth Mini CodemediumFree AvailablevsQwen3.8 27BnoneFree AvailableNorth Mini CodemediumFree AvailablevsMiMo-V2.6-FlashnoneNorth Mini CodemediumFree AvailablevsEmber-1noneGPT-5.6 LunanonevsStep 3.5 FlashmediumSeed-2.0-CodenonevsNorth Mini CodemediumFree AvailableGPT-5.6 LunanonevsHy4 previewlowNorth Mini CodemediumFree AvailablevsGemma 4 26B A4BnoneFree AvailableNorth Mini CodemediumFree AvailablevsGranite 4.2 8BlowNorth Mini CodemediumFree AvailablevsGPT-6 LunanoneNorth Mini CodemediumFree AvailablevsGemini 2.5 Flashnone