#102 Gemini 3.1 Flash Lite Preview
none- Cost
- $0.003
- Time
- 4.7s
- Tokens
- 1,827 tok
AI BENCHY Compare
Summary
GPT-5.3-Codex (medium) leads on average score with 8.9 vs 6.4. Gemini 3.1 Flash Lite Preview has the lower benchmark cost at $0.018 vs $0.740. Gemini 3.1 Flash Lite Preview is faster at 1.21s vs 16.22s, with pass rates of 60.3% vs 82.5%.
Last updated at: 2026-07-14
| Metric | Gemini 3.1 Flash Lite Preview Gemini 3.1 Flash Lite Preview none | GPT-5.3-Codex GPT-5.3-Codex medium |
|---|---|---|
| Score | 6.4 | 8.9 |
| Rank | #102 | #13 |
| Reliability | 10.0 | 10.0 |
| Consistency | 9.7 | 8.5 |
| Tests Correct | ||
| Attempt pass rate | 60.3% | 82.5% |
| Flaky tests | 1 | 4 |
| Total Runs | 63 | 63 |
| Cost per result | 0.148 | 4.932 |
| Total Cost | $0.018 | $0.740 |
| Input Price | $0.250 / 1M | $1.750 / 1M |
| Output Price | $1.500 / 1M | $14.000 / 1M |
| Total Input Tokens | 37,582 | 34,299 |
| Output Tokens | 5,547 | 2,357 |
| Reasoning Tokens | 0 | 46,189 |
| Response Time (avg) | 1.21s | 16.22s |
| Response Time (max) | 3.39s | 100.93s |
| Response Time (total) | 25.45s | 340.67s |
Generation showcase
Prompt: Create a detailed SVG illustration of a hamster playing table tennis.
| Coding | Score | Consistency | Attempt pass rate | Flaky tests | Tests Correct | Response Time (avg) | Input Tokens | Output Tokens | Reasoning Tokens |
|---|---|---|---|---|---|---|---|---|---|
| Gemini 3.1 Flash Lite Preview | 5.5 | 10.0 | 33.3% | 0 | 967ms | 8,128 | 670 | 0 | |
| GPT-5.3-Codex | 10.0 | 10.0 | 100.0% | 0 | 19.50s | 7,302 | 535 | 10,890 |
Switch Comparison Pair