- Rank
- #301
- Total Output Tokens
- 60,414
- Response Time (avg)
- 10.21s
- Total Cost
- $0.046
KAT Coder AIR V2.5 (low) vs Qwen3 Coder Next
KAT Coder AIR V2.5 (low) leads on average score with 5.0 vs 4.9. KAT Coder AIR V2.5 (low) has the lower benchmark cost at $0.046 vs $0.065. KAT Coder AIR V2.5 (low) is faster at 10.21s vs 19.73s, with pass rates of 42.0% vs 24.6%.
Compared models
- Rank
- #304
- Total Output Tokens
- 45,168
- Response Time (avg)
- 19.73s
- Total Cost
- $0.065
Recommended model
KAT Coder AIR V2.5 (low)
It has the best score here (5.0), while responding about 1.9x faster than Qwen3 Coder Next.
Detailed comparison
| Metric | KAT Coder AIR V2.5 KAT Coder AIR V2.5 low | Qwen3 Coder Next Qwen3 Coder Next none |
|---|---|---|
| Score | 5.0 | 4.9 |
| Rank | #301 | #304 |
| Reliability | 9.9 | 10.0 |
| Consistency | 7.8 | 9.7 |
| Attempts | 69/69 | 69/69 |
| Tests Correct | ||
| Attempt pass rate | 42.0% | 24.6% |
| Flaky tests | 6 | 1 |
| Total Runs | 69 | 69 |
| Cost per result | 0.649 | 1.300 |
| Total Cost | $0.046 | $0.065 |
| Input Price | $0.000 / 1M | $0.120 / 1M |
| Output Price | $0.000 / 1M | $0.800 / 1M |
| Total Input Tokens | 61,094 | 250,329 |
| Output Tokens | 6,532 | 45,168 |
| Reasoning Tokens | 53,882 | 0 |
| Response Time (avg) | 10.21s | 19.73s |
| Response Time (max) | 86.23s | 208.38s |
| Response Time (total) | 234.86s | 355.09s |
| Parameters | ~35B total (~3B active) | 80B total (3B active) |
| Availability | Closed | Open source |
Model generation showcase
Hamster playing table tennis
Prompt: Create a detailed SVG illustration of a hamster playing table tennis.
#301 KAT Coder AIR V2.5
low- Cost
- $0.004
- Time
- 29.9s
- Tokens
- 6,008 tok
#304 Qwen3 Coder Next
none
Invalid SVG
- Cost
- $0.058
- Time
- 246.3s
- Tokens
- 64,126 tok
Top Models by Score
Score vs Total Cost
Response Time (avg)
Score vs Response Time (avg)
Total Output Tokens
Score vs Total Output Tokens
Category Breakdown
| Agentic | Score | Consistency | Attempt pass rate | Flaky tests | Tests Correct | Response Time (avg) | Input Tokens | Output Tokens | Reasoning Tokens |
|---|---|---|---|---|---|---|---|---|---|
| KAT Coder AIR V2.5 | 3.0 | 10.0 | 0.0% | 0 | 1.08s | 0 | 0 | 0 | |
| Qwen3 Coder Next | 3.9 | 9.6 | 0.0% | 0 | 208.38s | 116,102 | 33,360 | 0 |
| Anti-AI Tricks | Score | Consistency | Attempt pass rate | Flaky tests | Tests Correct | Response Time (avg) | Input Tokens | Output Tokens | Reasoning Tokens |
|---|---|---|---|---|---|---|---|---|---|
| KAT Coder AIR V2.5 | 7.3 | 5.8 | 83.3% | 2 | 3.50s | 672 | 422 | 1,548 | |
| Qwen3 Coder Next | 3.6 | 10.0 | 0.0% | 0 | 3.31s | 645 | 1,321 | 0 |
| Coding | Score | Consistency | Attempt pass rate | Flaky tests | Tests Correct | Response Time (avg) | Input Tokens | Output Tokens | Reasoning Tokens |
|---|---|---|---|---|---|---|---|---|---|
| KAT Coder AIR V2.5 | 3.5 | 7.3 | 11.1% | 1 | 11.06s | 7,893 | 2,001 | 13,623 | |
| Qwen3 Coder Next | 4.6 | 7.9 | 22.2% | 1 | 2.22s | 7,442 | 621 | 0 |
| Combined | Score | Consistency | Attempt pass rate | Flaky tests | Tests Correct | Response Time (avg) | Input Tokens | Output Tokens | Reasoning Tokens |
|---|---|---|---|---|---|---|---|---|---|
| KAT Coder AIR V2.5 | 6.4 | 5.8 | 66.7% | 1 | 55.86s | 33,753 | 2,046 | 17,833 | |
| Qwen3 Coder Next | 3.0 | 10.0 | 0.0% | 0 | 30.86s | 107,180 | 8,541 | 0 |
| Data parsing and extraction | Score | Consistency | Attempt pass rate | Flaky tests | Tests Correct | Response Time (avg) | Input Tokens | Output Tokens | Reasoning Tokens |
|---|---|---|---|---|---|---|---|---|---|
| KAT Coder AIR V2.5 | 6.5 | 10.0 | 50.0% | 0 | 2.82s | 7,776 | 261 | 1,069 | |
| Qwen3 Coder Next | 6.5 | 10.0 | 50.0% | 0 | 1.32s | 7,758 | 246 | 0 |
| Domain specific | Score | Consistency | Attempt pass rate | Flaky tests | Tests Correct | Response Time (avg) | Input Tokens | Output Tokens | Reasoning Tokens |
|---|---|---|---|---|---|---|---|---|---|
| KAT Coder AIR V2.5 | 3.0 | 10.0 | 0.0% | 0 | 8.91s | 562 | 937 | 10,224 | |
| Qwen3 Coder Next | 5.3 | 10.0 | 33.3% | 0 | 871ms | 762 | 26 | 0 |
| General Intelligence | Score | Consistency | Attempt pass rate | Flaky tests | Tests Correct | Response Time (avg) | Input Tokens | Output Tokens | Reasoning Tokens |
|---|---|---|---|---|---|---|---|---|---|
| KAT Coder AIR V2.5 | 5.0 | 10.0 | 0.0% | 0 | 10.11s | 516 | 142 | 596 | |
| Qwen3 Coder Next | 10.0 | 10.0 | 100.0% | 0 | 1.34s | 498 | 152 | 0 |
| Instructions following | Score | Consistency | Attempt pass rate | Flaky tests | Tests Correct | Response Time (avg) | Input Tokens | Output Tokens | Reasoning Tokens |
|---|---|---|---|---|---|---|---|---|---|
| KAT Coder AIR V2.5 | 9.8 | 10.0 | 100.0% | 0 | 1.64s | 699 | 89 | 640 | |
| Qwen3 Coder Next | 6.3 | 10.0 | 50.0% | 0 | 7.78s | 684 | 63 | 0 |
| Puzzle Solving | Score | Consistency | Attempt pass rate | Flaky tests | Tests Correct | Response Time (avg) | Input Tokens | Output Tokens | Reasoning Tokens |
|---|---|---|---|---|---|---|---|---|---|
| KAT Coder AIR V2.5 | 3.1 | 4.6 | 22.2% | 2 | 1.57s | 696 | 294 | 796 | |
| Qwen3 Coder Next | 3.0 | 10.0 | 0.0% | 0 | 24.34s | 678 | 571 | 0 |
| Tool Calling | Score | Consistency | Attempt pass rate | Flaky tests | Tests Correct | Response Time (avg) | Input Tokens | Output Tokens | Reasoning Tokens |
|---|---|---|---|---|---|---|---|---|---|
| KAT Coder AIR V2.5 | 10.0 | 10.0 | 100.0% | 0 | 4.47s | 8,391 | 330 | 1,065 | |
| Qwen3 Coder Next | 10.0 | 10.0 | 100.0% | 0 | 2.47s | 8,364 | 255 | 0 |
| Trivia | Score | Consistency | Attempt pass rate | Flaky tests | Tests Correct | Response Time (avg) | Input Tokens | Output Tokens | Reasoning Tokens |
|---|---|---|---|---|---|---|---|---|---|
| KAT Coder AIR V2.5 | 3.0 | 10.0 | 0.0% | 0 | 19.98s | 136 | 10 | 6,488 | |
| Qwen3 Coder Next | 3.0 | 10.0 | 0.0% | 0 | 601ms | 216 | 12 | 0 |
Quick Compare
Switch Comparison Pair
KAT Coder AIR V2.5lowvsGPT-4o-mininoneDots 3 Note PreviewnoneFree AvailablevsKAT Coder AIR V2.5lowLaguna S 2.1highFree AvailablevsQwen3 Coder NextnoneKAT Coder AIR V2.5lowvsMiniMax M2.7mediumKAT Coder AIR V2.5lowvsInkling SmallnoneFree AvailableKAT Coder AIR V2.5lowvsLaguna S 2.1highFree AvailableMiniMax M2.7mediumvsQwen3 Coder NextnoneKAT Coder AIR V2.5lowvsLaguna S 2.1mediumFree AvailableLing 2.6 1tnonevsKAT Coder AIR V2.5lowKAT Coder AIR V2.5lowvsMiMo-V2.5noneKAT Coder AIR V2.5lowvsQwen3.5-9BnoneKAT Coder AIR V2.5lowvsHy4 previewnone