- Rank
- #231
- Total Output Tokens
- 26,073
- Response Time (avg)
- 11.40s
- Total Cost
- $3.395
Claude Fable 5.1 (low) vs Gemini 3.1 Flash Lite Preview
The average score is effectively tied at 6.2 vs 6.2. Gemini 3.1 Flash Lite Preview has the lower benchmark cost at $0.090 vs $3.395. Gemini 3.1 Flash Lite Preview is faster at 3.60s vs 11.40s, with pass rates of 55.1% vs 55.1%.
Compared models
- Rank
- #230
- Total Output Tokens
- 15,760
- Response Time (avg)
- 3.60s
- Total Cost
- $0.090
Recommended model
Gemini 3.1 Flash Lite Preview
It has the best score here (6.2), while costing about 38.1x less than Claude Fable 5.1 (low).
Detailed comparison
| Metric | Claude Fable 5.1 Claude Fable 5.1 low | Gemini 3.1 Flash Lite Preview Gemini 3.1 Flash Lite Preview none |
|---|---|---|
| Score | 6.2 | 6.2 |
| Rank | #231 | #230 |
| Reliability | 10.0 | 10.0 |
| Consistency | 8.9 | 9.7 |
| Attempts | 69/69 | 69/69 |
| Tests Correct | ||
| Attempt pass rate | 55.1% | 55.1% |
| Flaky tests | 3 | 1 |
| Total Runs | 69 | 69 |
| Cost per result | 30.862 | 0.743 |
| Total Cost | $3.395 | $0.090 |
| Input Price | $10.000 / 1M | $0.250 / 1M |
| Output Price | $50.000 / 1M | $1.500 / 1M |
| Total Input Tokens | 209,116 | 261,962 |
| Output Tokens | 10,031 | 15,760 |
| Reasoning Tokens | 16,042 | 0 |
| Response Time (avg) | 11.40s | 3.60s |
| Response Time (max) | 34.77s | 48.59s |
| Response Time (total) | 262.14s | 82.91s |
| Parameters | ~9.5T total (~878B active) | ~150B total (~10B active) |
| Availability | Closed | Closed |
Model generation showcase
Hamster playing table tennis
Prompt: Create a detailed SVG illustration of a hamster playing table tennis.
#231 Claude Fable 5.1
low- Cost
- $0.126
- Time
- 28.5s
- Tokens
- 2,652 tok
#230 Gemini 3.1 Flash Lite Preview
none- Cost
- $0.003
- Time
- 4.7s
- Tokens
- 1,827 tok
Top Models by Score
Score vs Total Cost
Response Time (avg)
Score vs Response Time (avg)
Total Output Tokens
Score vs Total Output Tokens
Category Breakdown
| Agentic | Score | Consistency | Attempt pass rate | Flaky tests | Tests Correct | Response Time (avg) | Input Tokens | Output Tokens | Reasoning Tokens |
|---|---|---|---|---|---|---|---|---|---|
| Claude Fable 5.1 | 2.8 | 1.6 | 33.3% | 1 | 34.77s | 74,534 | 1,076 | 622 | |
| Gemini 3.1 Flash Lite Preview | 5.0 | 10.0 | 0.0% | 0 | 48.59s | 141,007 | 1,599 | 0 |
| Anti-AI Tricks | Score | Consistency | Attempt pass rate | Flaky tests | Tests Correct | Response Time (avg) | Input Tokens | Output Tokens | Reasoning Tokens |
|---|---|---|---|---|---|---|---|---|---|
| Claude Fable 5.1 | 6.5 | 10.0 | 50.0% | 0 | 4.54s | 858 | 666 | 0 | |
| Gemini 3.1 Flash Lite Preview | 7.5 | 8.4 | 66.7% | 1 | 1.04s | 504 | 1,092 | 0 |
| Coding | Score | Consistency | Attempt pass rate | Flaky tests | Tests Correct | Response Time (avg) | Input Tokens | Output Tokens | Reasoning Tokens |
|---|---|---|---|---|---|---|---|---|---|
| Claude Fable 5.1 | 3.4 | 10.0 | 0.0% | 0 | 6.75s | 10,608 | 1,753 | 0 | |
| Gemini 3.1 Flash Lite Preview | 5.5 | 10.0 | 33.3% | 0 | 967ms | 8,128 | 670 | 0 |
| Combined | Score | Consistency | Attempt pass rate | Flaky tests | Tests Correct | Response Time (avg) | Input Tokens | Output Tokens | Reasoning Tokens |
|---|---|---|---|---|---|---|---|---|---|
| Claude Fable 5.1 | 10.0 | 10.0 | 100.0% | 0 | 29.40s | 97,043 | 4,733 | 3,850 | |
| Gemini 3.1 Flash Lite Preview | 3.0 | 10.0 | 0.0% | 0 | 6.23s | 96,386 | 9,084 | 0 |
| Data parsing and extraction | Score | Consistency | Attempt pass rate | Flaky tests | Tests Correct | Response Time (avg) | Input Tokens | Output Tokens | Reasoning Tokens |
|---|---|---|---|---|---|---|---|---|---|
| Claude Fable 5.1 | 10.0 | 10.0 | 100.0% | 0 | 4.71s | 10,515 | 312 | 0 | |
| Gemini 3.1 Flash Lite Preview | 10.0 | 10.0 | 100.0% | 0 | 1.22s | 7,550 | 399 | 0 |
| Domain specific | Score | Consistency | Attempt pass rate | Flaky tests | Tests Correct | Response Time (avg) | Input Tokens | Output Tokens | Reasoning Tokens |
|---|---|---|---|---|---|---|---|---|---|
| Claude Fable 5.1 | 4.1 | 4.4 | 44.5% | 2 | 19.30s | 990 | 61 | 8,940 | |
| Gemini 3.1 Flash Lite Preview | 5.3 | 10.0 | 33.3% | 0 | 811ms | 654 | 437 | 0 |
| General Intelligence | Score | Consistency | Attempt pass rate | Flaky tests | Tests Correct | Response Time (avg) | Input Tokens | Output Tokens | Reasoning Tokens |
|---|---|---|---|---|---|---|---|---|---|
| Claude Fable 5.1 | 10.0 | 10.0 | 100.0% | 0 | 5.62s | 714 | 325 | 0 | |
| Gemini 3.1 Flash Lite Preview | 4.0 | 10.0 | 0.0% | 0 | 741ms | 488 | 69 | 0 |
| Instructions following | Score | Consistency | Attempt pass rate | Flaky tests | Tests Correct | Response Time (avg) | Input Tokens | Output Tokens | Reasoning Tokens |
|---|---|---|---|---|---|---|---|---|---|
| Claude Fable 5.1 | 6.5 | 10.0 | 50.0% | 0 | 5.24s | 921 | 278 | 0 | |
| Gemini 3.1 Flash Lite Preview | 10.0 | 10.0 | 100.0% | 0 | 1.13s | 623 | 574 | 0 |
| Puzzle Solving | Score | Consistency | Attempt pass rate | Flaky tests | Tests Correct | Response Time (avg) | Input Tokens | Output Tokens | Reasoning Tokens |
|---|---|---|---|---|---|---|---|---|---|
| Claude Fable 5.1 | 7.7 | 10.0 | 66.7% | 0 | 4.78s | 912 | 452 | 0 | |
| Gemini 3.1 Flash Lite Preview | 10.0 | 10.0 | 100.0% | 0 | 900ms | 570 | 1,045 | 0 |
| Tool Calling | Score | Consistency | Attempt pass rate | Flaky tests | Tests Correct | Response Time (avg) | Input Tokens | Output Tokens | Reasoning Tokens |
|---|---|---|---|---|---|---|---|---|---|
| Claude Fable 5.1 | 10.0 | 10.0 | 100.0% | 0 | 13.22s | 11,757 | 354 | 0 | |
| Gemini 3.1 Flash Lite Preview | 10.0 | 10.0 | 100.0% | 0 | 3.39s | 5,894 | 782 | 0 |
| Trivia | Score | Consistency | Attempt pass rate | Flaky tests | Tests Correct | Response Time (avg) | Input Tokens | Output Tokens | Reasoning Tokens |
|---|---|---|---|---|---|---|---|---|---|
| Claude Fable 5.1 | 3.0 | 10.0 | 0.0% | 0 | 19.18s | 264 | 21 | 2,630 | |
| Gemini 3.1 Flash Lite Preview | 3.0 | 10.0 | 0.0% | 0 | 814ms | 158 | 9 | 0 |
Quick Compare
Switch Comparison Pair
Claude Fable 5.1lowvsDeepSeek V4 Flash 0731noneGemini 3.1 Flash Lite PreviewnonevsKAT-Coder-Pro V2.5mediumGemini 3.1 Flash Lite PreviewnonevsSpace Bunny AlphaxhighClaude Fable 5.1lowvsKAT-Coder-Pro V2.5mediumClaude Fable 5.1lowvsSpace Bunny AlphaxhighClaude Fable 5.1lowvsTrinity Large ThinkingmediumGemini 3.1 Flash Lite PreviewnonevsGrok 4.20mediumClaude Fable 5.1lowvsGemini 3.5 FlashnoneTrinity Large ThinkinglowvsGemini 3.1 Flash Lite PreviewnoneClaude Fable 5.1lowvsInklingnoneFree AvailableTrinity Large ThinkingmediumvsGemini 3.1 Flash Lite PreviewnoneClaude Fable 5.1lowvsGrok 4.20medium