- Rank
- #315
- Total Output Tokens
- 766,130
- Response Time (avg)
- 81.93s
- Total Cost
- $0.129
Nemotron 3.5 Lightning (medium) vs GPT-5.4 Nano
Nemotron 3.5 Lightning (medium) leads on average score with 4.7 vs 4.6. GPT-5.4 Nano has the lower benchmark cost at $0.068 vs $0.129. GPT-5.4 Nano is faster at 4.42s vs 81.93s, with pass rates of 47.8% vs 26.1%.
Compared models
- Rank
- #321
- Total Output Tokens
- 14,894
- Response Time (avg)
- 4.42s
- Total Cost
- $0.068
Recommended model
GPT-5.4 Nano
Its score stays close to the best score here (4.6 vs 4.7), while costing about 1.9x less than Nemotron 3.5 Lightning (medium).
Detailed comparison
| Metric | Nemotron 3.5 Lightning Nemotron 3.5 Lightning medium Free Available | GPT-5.4 Nano GPT-5.4 Nano none |
|---|---|---|
| Score | 4.7 | 4.6 |
| Rank | #315 | #321 |
| Reliability | 9.8 | 10.0 |
| Consistency | 5.8 | 8.7 |
| Attempts | 69/69 | 69/69 |
| Tests Correct | ||
| Attempt pass rate | 47.8% | 26.1% |
| Flaky tests | 12 | 4 |
| Total Runs | 69 | 69 |
| Cost per result | 0.000 | 1.699 |
| Total Cost | $0.129 | $0.068 |
| Input Price | $0.060 / 1M | $0.200 / 1M |
| Output Price | $0.160 / 1M | $1.250 / 1M |
| Total Input Tokens | 195,780 | 246,687 |
| Output Tokens | 167,746 | 14,894 |
| Reasoning Tokens | 598,384 | 0 |
| Response Time (avg) | 81.93s | 4.42s |
| Response Time (max) | 437.11s | 45.38s |
| Response Time (total) | 1884.31s | 101.75s |
| Parameters | 30B total (3B active) | ~120B total (~5B active) |
| Availability | Weights available | Closed |
Model generation showcase
Hamster playing table tennis
Prompt: Create a detailed SVG illustration of a hamster playing table tennis.
#315 Nemotron 3.5 Lightning
medium- Cost
- $0.000
- Time
- 130.5s
- Tokens
- 6,750 tok
#321 GPT-5.4 Nano
none- Cost
- $0.008
- Time
- 46.1s
- Tokens
- 5,735 tok
Top Models by Score
Score vs Total Cost
Response Time (avg)
Score vs Response Time (avg)
Total Output Tokens
Score vs Total Output Tokens
Category Breakdown
| Agentic | Score | Consistency | Attempt pass rate | Flaky tests | Tests Correct | Response Time (avg) | Input Tokens | Output Tokens | Reasoning Tokens |
|---|---|---|---|---|---|---|---|---|---|
| Nemotron 3.5 Lightning | 2.8 | 1.6 | 33.3% | 1 | 341.79s | 69,450 | 2,044 | 3,645 | |
| GPT-5.4 Nano | 3.9 | 9.6 | 0.0% | 0 | 45.38s | 130,754 | 1,100 | 0 |
| Anti-AI Tricks | Score | Consistency | Attempt pass rate | Flaky tests | Tests Correct | Response Time (avg) | Input Tokens | Output Tokens | Reasoning Tokens |
|---|---|---|---|---|---|---|---|---|---|
| Nemotron 3.5 Lightning | 6.9 | 7.9 | 66.7% | 1 | 12.34s | 696 | 6,904 | 20,862 | |
| GPT-5.4 Nano | 3.5 | 8.0 | 16.7% | 1 | 1.18s | 606 | 800 | 0 |
| Coding | Score | Consistency | Attempt pass rate | Flaky tests | Tests Correct | Response Time (avg) | Input Tokens | Output Tokens | Reasoning Tokens |
|---|---|---|---|---|---|---|---|---|---|
| Nemotron 3.5 Lightning | 4.4 | 5.1 | 33.3% | 2 | 285.47s | 7,623 | 78,065 | 297,359 | |
| GPT-5.4 Nano | 4.6 | 7.9 | 22.2% | 1 | 2.22s | 7,305 | 613 | 0 |
| Combined | Score | Consistency | Attempt pass rate | Flaky tests | Tests Correct | Response Time (avg) | Input Tokens | Output Tokens | Reasoning Tokens |
|---|---|---|---|---|---|---|---|---|---|
| Nemotron 3.5 Lightning | 6.2 | 5.8 | 66.7% | 1 | 136.91s | 98,571 | 15,769 | 112,376 | |
| GPT-5.4 Nano | 3.0 | 10.0 | 0.0% | 0 | 14.67s | 92,731 | 11,290 | 0 |
| Data parsing and extraction | Score | Consistency | Attempt pass rate | Flaky tests | Tests Correct | Response Time (avg) | Input Tokens | Output Tokens | Reasoning Tokens |
|---|---|---|---|---|---|---|---|---|---|
| Nemotron 3.5 Lightning | 3.7 | 1.7 | 50.0% | 2 | 23.24s | 7,944 | 4,195 | 30,097 | |
| GPT-5.4 Nano | 6.5 | 10.0 | 50.0% | 0 | 1.11s | 7,140 | 219 | 0 |
| Domain specific | Score | Consistency | Attempt pass rate | Flaky tests | Tests Correct | Response Time (avg) | Input Tokens | Output Tokens | Reasoning Tokens |
|---|---|---|---|---|---|---|---|---|---|
| Nemotron 3.5 Lightning | 2.9 | 4.4 | 22.2% | 2 | 74.73s | 798 | 54,657 | 91,174 | |
| GPT-5.4 Nano | 2.9 | 7.2 | 11.1% | 1 | 880ms | 732 | 52 | 0 |
| General Intelligence | Score | Consistency | Attempt pass rate | Flaky tests | Tests Correct | Response Time (avg) | Input Tokens | Output Tokens | Reasoning Tokens |
|---|---|---|---|---|---|---|---|---|---|
| Nemotron 3.5 Lightning | 5.5 | 10.0 | 0.0% | 0 | 4.36s | 516 | 3,127 | 3,157 | |
| GPT-5.4 Nano | 3.8 | 2.5 | 33.3% | 1 | 1.31s | 477 | 180 | 0 |
| Instructions following | Score | Consistency | Attempt pass rate | Flaky tests | Tests Correct | Response Time (avg) | Input Tokens | Output Tokens | Reasoning Tokens |
|---|---|---|---|---|---|---|---|---|---|
| Nemotron 3.5 Lightning | 8.5 | 6.8 | 83.3% | 1 | 3.75s | 723 | 531 | 4,404 | |
| GPT-5.4 Nano | 6.3 | 10.0 | 50.0% | 0 | 784ms | 660 | 89 | 0 |
| Puzzle Solving | Score | Consistency | Attempt pass rate | Flaky tests | Tests Correct | Response Time (avg) | Input Tokens | Output Tokens | Reasoning Tokens |
|---|---|---|---|---|---|---|---|---|---|
| Nemotron 3.5 Lightning | 4.2 | 4.4 | 44.5% | 2 | 10.49s | 726 | 1,170 | 18,195 | |
| GPT-5.4 Nano | 5.4 | 10.0 | 33.3% | 0 | 1.25s | 642 | 308 | 0 |
| Tool Calling | Score | Consistency | Attempt pass rate | Flaky tests | Tests Correct | Response Time (avg) | Input Tokens | Output Tokens | Reasoning Tokens |
|---|---|---|---|---|---|---|---|---|---|
| Nemotron 3.5 Lightning | 10.0 | 10.0 | 100.0% | 0 | 4.92s | 8,526 | 154 | 2,518 | |
| GPT-5.4 Nano | 10.0 | 10.0 | 100.0% | 0 | 3.40s | 5,445 | 222 | 0 |
| Trivia | Score | Consistency | Attempt pass rate | Flaky tests | Tests Correct | Response Time (avg) | Input Tokens | Output Tokens | Reasoning Tokens |
|---|---|---|---|---|---|---|---|---|---|
| Nemotron 3.5 Lightning | 3.0 | 10.0 | 0.0% | 0 | 44.02s | 207 | 1,130 | 14,597 | |
| GPT-5.4 Nano | 3.0 | 10.0 | 0.0% | 0 | 773ms | 195 | 21 | 0 |
Quick Compare
Switch Comparison Pair
Mercury 2.5 PreviewnonevsNemotron 3.5 LightningmediumFree AvailableNorth Mini CodenoneFree AvailablevsNemotron 3.5 LightningmediumFree AvailableGPT-5.4 NanononevsLaguna S 2.1lowFree AvailableGPT-5.4 NanononevsQwen3 Coder NextmediumNemotron 3.5 LightningmediumFree AvailablevsLaguna S 2.1noneFree AvailableGranite 4.2 8BhighvsNemotron 3.5 LightningmediumFree AvailableNemotron 3.5 LightninglowFree AvailablevsGPT-5.4 NanononeGranite 4.2 8BhighvsGPT-5.4 NanononeNemotron 3.5 LightningmediumFree AvailablevsGLM 4.7 FlashnoneDeepSeek V3.2nonevsNemotron 3.5 LightningmediumFree AvailableNemotron 3.5 LightningmediumFree AvailablevsLaguna S 2.1lowFree AvailableNemotron 3.5 LightningmediumFree AvailablevsHy4 previewnone