Navigate
AI BENCHY
Advertise here

Gemini 2.5 Flash vs GPT-5.6 Terra

Gemini 2.5 Flash leads on average score with 6.0 vs 6.0. Gemini 2.5 Flash has the lower benchmark cost at $0.017 vs $0.280. GPT-5.6 Terra is faster at 1.66s vs 6.19s, with pass rates of 39.4% vs 42.4%.

Last updated at: 2026-08-20

Rank
#182
Total Output Tokens
1,890
Response Time (avg)
6.19s
Total Cost
$0.017
Rank
#184
Total Output Tokens
6,221
Response Time (avg)
1.66s
Total Cost
$0.280
Recommended model Gemini 2.5 Flash

It has the best score here (6.0), while costing about 16.7x less than GPT-5.6 Terra.

Detailed comparison

Metric Gemini 2.5 Flash Gemini 2.5 Flash none Release: 2025-06-17 GPT-5.6 Terra GPT-5.6 Terra none Release: 2026-07-09
Score 6.0 6.0
Rank #182 #184
Reliability 10.0 10.0
Consistency 9.6 8.9
Attempts 66/66 66/66
Tests Correct
Attempt pass rate 39.4% 42.4%
Flaky tests 1 3
Total Runs 66 66
Cost per result 0.209 4.356
Total Cost $0.017 $0.280
Input Price $0.300 / 1M $2.000 / 1M
Output Price $2.500 / 1M $12.000 / 1M
Total Input Tokens 39,886 102,268
Output Tokens 1,890 6,221
Reasoning Tokens 0 0
Response Time (avg) 6.19s 1.66s
Response Time (max) 118.00s 10.07s
Response Time (total) 136.23s 36.54s
Parameters ~350B total (~20B active) ~1T total (~60B active)
Availability Closed Closed

Model generation showcase

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#182 Gemini 2.5 Flash

none
Invalid SVG
Cost
$0.164
Time
215.5s
Tokens
65,659 tok

#184 GPT-5.6 Terra

none
Cost
$0.030
Time
14.7s
Tokens
2,082 tok

Top Models by Score

Score vs Total Cost

Response Time (avg)

Score vs Response Time (avg)

Total Output Tokens

Score vs Total Output Tokens

Category Breakdown

Coding Score Consistency Attempt pass rate Flaky tests Tests Correct Response Time (avg) Input Tokens Output Tokens Reasoning Tokens
Gemini 2.5 Flash 5.5 10.0 33.3% 0 736ms 8,122 483 0
GPT-5.6 Terra 5.5 10.0 33.3% 0 1.00s 7,302 336 0

Quick Compare

Switch Comparison Pair