- Rank
- #288
- Total Output Tokens
- 114,654
- Response Time (avg)
- 15.23s
- Total Cost
- $0.077
KAT Coder AIR V2.5 (high) vs Qwen3.6 35B A3B
Qwen3.6 35B A3B leads on average score with 5.3 vs 5.2. KAT Coder AIR V2.5 (high) has the lower benchmark cost at $0.077 vs $0.105. Qwen3.6 35B A3B is faster at 8.43s vs 15.23s, with pass rates of 40.6% vs 29.0%.
Compared models
- Rank
- #284
- Total Output Tokens
- 63,781
- Response Time (avg)
- 8.43s
- Total Cost
- $0.105
Recommended model
Qwen3.6 35B A3B
It has the best score here (5.3), while responding about 1.8x faster than KAT Coder AIR V2.5 (high).
Detailed comparison
| Metric | KAT Coder AIR V2.5 KAT Coder AIR V2.5 high | Qwen3.6 35B A3B Qwen3.6 35B A3B none |
|---|---|---|
| Score | 5.2 | 5.3 |
| Rank | #288 | #284 |
| Reliability | 9.8 | 10.0 |
| Consistency | 8.2 | 7.9 |
| Attempts | 69/69 | 69/69 |
| Tests Correct | ||
| Attempt pass rate | 40.6% | 29.0% |
| Flaky tests | 5 | 6 |
| Total Runs | 69 | 69 |
| Cost per result | 1.091 | 2.586 |
| Total Cost | $0.077 | $0.105 |
| Input Price | $0.000 / 1M | $0.150 / 1M |
| Output Price | $0.000 / 1M | $1.000 / 1M |
| Total Input Tokens | 50,423 | 272,479 |
| Output Tokens | 4,144 | 63,781 |
| Reasoning Tokens | 110,510 | 0 |
| Response Time (avg) | 15.23s | 8.43s |
| Response Time (max) | 118.35s | 65.61s |
| Response Time (total) | 350.26s | 176.93s |
| Parameters | ~35B total (~3B active) | 35B total (3B active) |
| Availability | Closed | Open source |
Model generation showcase
Hamster playing table tennis
Prompt: Create a detailed SVG illustration of a hamster playing table tennis.
#288 KAT Coder AIR V2.5
high
Reached the allocated time limit (300 seconds) without receiving showcase output.
- Cost
- $0.000
- Time
- 300.0s
- Tokens
- 0 tok
#284 Qwen3.6 35B A3B
none- Cost
- $0.008
- Time
- 30.1s
- Tokens
- 6,317 tok
Top Models by Score
Score vs Total Cost
Response Time (avg)
Score vs Response Time (avg)
Total Output Tokens
Score vs Total Output Tokens
Category Breakdown
| Agentic | Score | Consistency | Attempt pass rate | Flaky tests | Tests Correct | Response Time (avg) | Input Tokens | Output Tokens | Reasoning Tokens |
|---|---|---|---|---|---|---|---|---|---|
| KAT Coder AIR V2.5 | 3.0 | 10.0 | 0.0% | 0 | 1.10s | 0 | 0 | 0 | |
| Qwen3.6 35B A3B | 5.2 | 3.2 | 33.3% | 1 | 65.61s | 178,489 | 17,876 | 0 |
| Anti-AI Tricks | Score | Consistency | Attempt pass rate | Flaky tests | Tests Correct | Response Time (avg) | Input Tokens | Output Tokens | Reasoning Tokens |
|---|---|---|---|---|---|---|---|---|---|
| KAT Coder AIR V2.5 | 6.9 | 5.8 | 75.0% | 2 | 2.49s | 615 | 204 | 1,290 | |
| Qwen3.6 35B A3B | 3.6 | 7.6 | 16.7% | 1 | 2.10s | 696 | 1,571 | 0 |
| Coding | Score | Consistency | Attempt pass rate | Flaky tests | Tests Correct | Response Time (avg) | Input Tokens | Output Tokens | Reasoning Tokens |
|---|---|---|---|---|---|---|---|---|---|
| KAT Coder AIR V2.5 | 4.3 | 7.3 | 11.1% | 1 | 39.07s | 6,948 | 1,166 | 55,883 | |
| Qwen3.6 35B A3B | 5.5 | 10.0 | 33.3% | 0 | 8.77s | 7,911 | 11,161 | 0 |
| Combined | Score | Consistency | Attempt pass rate | Flaky tests | Tests Correct | Response Time (avg) | Input Tokens | Output Tokens | Reasoning Tokens |
|---|---|---|---|---|---|---|---|---|---|
| KAT Coder AIR V2.5 | 6.5 | 10.0 | 50.0% | 0 | 74.48s | 23,854 | 485 | 28,559 | |
| Qwen3.6 35B A3B | 3.8 | 5.8 | 33.3% | 1 | 39.54s | 74,650 | 19,202 | 0 |
| Data parsing and extraction | Score | Consistency | Attempt pass rate | Flaky tests | Tests Correct | Response Time (avg) | Input Tokens | Output Tokens | Reasoning Tokens |
|---|---|---|---|---|---|---|---|---|---|
| KAT Coder AIR V2.5 | 6.5 | 10.0 | 50.0% | 0 | 3.59s | 7,776 | 284 | 2,140 | |
| Qwen3.6 35B A3B | 10.0 | 10.0 | 100.0% | 0 | 1.46s | 7,788 | 248 | 0 |
| Domain specific | Score | Consistency | Attempt pass rate | Flaky tests | Tests Correct | Response Time (avg) | Input Tokens | Output Tokens | Reasoning Tokens |
|---|---|---|---|---|---|---|---|---|---|
| KAT Coder AIR V2.5 | 3.0 | 10.0 | 0.0% | 0 | 7.28s | 724 | 1,101 | 7,738 | |
| Qwen3.6 35B A3B | 2.9 | 7.2 | 11.1% | 1 | 7.76s | 792 | 10,329 | 0 |
| General Intelligence | Score | Consistency | Attempt pass rate | Flaky tests | Tests Correct | Response Time (avg) | Input Tokens | Output Tokens | Reasoning Tokens |
|---|---|---|---|---|---|---|---|---|---|
| KAT Coder AIR V2.5 | 5.1 | 10.0 | 0.0% | 0 | 7.10s | 516 | 179 | 539 | |
| Qwen3.6 35B A3B | 4.4 | 3.0 | 33.3% | 1 | 3.51s | 520 | 1,545 | 0 |
| Instructions following | Score | Consistency | Attempt pass rate | Flaky tests | Tests Correct | Response Time (avg) | Input Tokens | Output Tokens | Reasoning Tokens |
|---|---|---|---|---|---|---|---|---|---|
| KAT Coder AIR V2.5 | 9.8 | 10.0 | 100.0% | 0 | 1.51s | 699 | 90 | 675 | |
| Qwen3.6 35B A3B | 6.2 | 5.8 | 66.7% | 1 | 1.86s | 709 | 1,264 | 0 |
| Puzzle Solving | Score | Consistency | Attempt pass rate | Flaky tests | Tests Correct | Response Time (avg) | Input Tokens | Output Tokens | Reasoning Tokens |
|---|---|---|---|---|---|---|---|---|---|
| KAT Coder AIR V2.5 | 3.5 | 4.4 | 33.3% | 2 | 2.47s | 696 | 285 | 1,576 | |
| Qwen3.6 35B A3B | 3.2 | 9.9 | 0.0% | 0 | 1.07s | 714 | 573 | 0 |
| Tool Calling | Score | Consistency | Attempt pass rate | Flaky tests | Tests Correct | Response Time (avg) | Input Tokens | Output Tokens | Reasoning Tokens |
|---|---|---|---|---|---|---|---|---|---|
| KAT Coder AIR V2.5 | 10.0 | 10.0 | 100.0% | 0 | 4.77s | 8,391 | 330 | 1,082 | |
| Qwen3.6 35B A3B | 3.0 | 10.0 | 0.0% | 0 | 0ms | 0 | 0 | 0 |
| Trivia | Score | Consistency | Attempt pass rate | Flaky tests | Tests Correct | Response Time (avg) | Input Tokens | Output Tokens | Reasoning Tokens |
|---|---|---|---|---|---|---|---|---|---|
| KAT Coder AIR V2.5 | 3.0 | 10.0 | 0.0% | 0 | 21.72s | 204 | 20 | 11,028 | |
| Qwen3.6 35B A3B | 3.0 | 10.0 | 0.0% | 0 | 414ms | 210 | 12 | 0 |
Quick Compare
Switch Comparison Pair
Ling 3.0 FlashnonevsKAT Coder AIR V2.5highKAT Coder AIR V2.5highvsInkling SmalllowFree AvailableKAT Coder AIR V2.5highvsMistral Small 4mediumKAT Coder AIR V2.5highvsMistral Small 4noneQwen3.6 35B A3BnonevsInkling SmalllowFree AvailableGranite 4.2 8BlowvsQwen3.6 35B A3BnoneMercury 2.5lowvsKAT Coder AIR V2.5highKAT Coder AIR V2.5highvsMiMo-V2.5-PrononeNemotron 3.5 LightninghighFree AvailablevsQwen3.6 35B A3BnoneKAT Coder AIR V2.5highvsLaguna XS 2.1noneFree AvailableQwen3.6 35B A3BnonevsStep 3.5 FlashmediumKAT Coder AIR V2.5highvsLaguna S 2.1mediumFree Available