Navigate
AI BENCHY
Advertise here

Anthropic: Claude Sonnet 4.6 vs Google: Gemini 3.5 Flash-Lite

Gemini 3.5 Flash-Lite (high) leads on average score with 8.1 vs 7.8. Gemini 3.5 Flash-Lite (high) has the lower benchmark cost at $0.584 vs $2.057. Gemini 3.5 Flash-Lite (high) is faster at 9.48s vs 25.91s, with pass rates of 66.7% vs 81.8%.

Recommended modelGemini 3.5 Flash-Lite (high)It has the best score here (8.1), while costing about 3.5x less than Claude Sonnet 4.6 (medium).

Last updated at: 2026-07-21

Metric Claude Sonnet 4.6 Claude Sonnet 4.6 medium Release: 2026-02-17 Gemini 3.5 Flash-Lite Gemini 3.5 Flash-Lite high Release: 2026-07-21
Score 7.8 8.1
Rank #44 #31
Reliability 10.0 10.0
Consistency 9.2 7.5
Tests Correct
Attempt pass rate 66.7% 81.8%
Flaky tests 2 7
Total Runs 66 66
Cost per result 14.692 4.169
Total Cost $2.057 $0.584
Input Price $3.000 / 1M $0.300 / 1M
Output Price $15.000 / 1M $2.500 / 1M
Total Input Tokens 106,292 105,138
Output Tokens 80,748 8,315
Reasoning Tokens 35,117 212,507
Response Time (avg) 25.91s 9.48s
Response Time (max) 140.96s 43.93s
Response Time (total) 362.78s 208.52s

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#44 Claude Sonnet 4.6

medium
Invalid SVG
Cost
$0.000
Time
300.0s
Tokens
0 tok

#31 Gemini 3.5 Flash-Lite

high
Cost
$0.023
Time
23.6s
Tokens
9,128 tok

Top Models by Score

Score vs Total Cost

Response Time (avg)

Score vs Response Time (avg)

Total Output Tokens

Score vs Total Output Tokens

Category Breakdown

Coding Score Consistency Attempt pass rate Flaky tests Tests Correct Response Time (avg) Input Tokens Output Tokens Reasoning Tokens
Claude Sonnet 4.6 5.7 6.6 44.4% 1 33.29s 6,995 16,089 3,686
Gemini 3.5 Flash-Lite 8.6 7.6 88.9% 1 15.09s 8,136 452 55,603

Quick Compare

Switch Comparison Pair