AI BENCHY Compare

Google: Gemini 3.1 Pro Preview vs OpenAI: GPT-5 Nano

Last updated at: 2026-04-29

Metric	Gemini 3.1 Pro Preview Gemini 3.1 Pro Preview medium Release: 2026-02-19	GPT-5 Nano GPT-5 Nano medium Release: 2025-08-07

Metric	Gemini 3.1 Pro Preview Gemini 3.1 Pro Preview medium Release: 2026-02-19	GPT-5 Nano GPT-5 Nano medium Release: 2025-08-07
Score	9.6	6.3
Rank	#2	#74
Reliability	N/A	N/A
Consistency	10.0	6.5
Tests Correct
Attempt pass rate	94.4%	59.3%
Flaky tests	0	8
Total Runs	54	54
Cost per result	3.400	0.942
Total Cost	$0.578	$0.066
Input Price	$2.000 / 1M	$0.050 / 1M
Output Price	$12.000 / 1M	$0.400 / 1M
Output Tokens	1,932	4,980
Reasoning Tokens	40,542	156,288
Response Time (avg)	15.96s	44.13s
Response Time (max)	40.61s	204.02s
Response Time (total)	175.52s	485.47s

Top Models by Score

Score vs Total Cost

Response Time (avg)

Score vs Response Time (avg)

Total Output Tokens

Score vs Total Output Tokens

Category Breakdown

Anti-AI Tricks	Score	Consistency	Attempt pass rate	Flaky tests	Tests Correct	Response Time (avg)	Output Tokens	Reasoning Tokens
Gemini 3.1 Pro Preview	10.0	10.0	100.0%	0		7.90s	112	3,218
GPT-5 Nano	6.5	7.9	58.3%	1		25.50s	1,221	21,184

Coding	Score	Consistency	Attempt pass rate	Flaky tests	Tests Correct	Response Time (avg)	Output Tokens	Reasoning Tokens
Gemini 3.1 Pro Preview	10.0	10.0	100.0%	0		19.88s	405	4,201
GPT-5 Nano	6.7	3.5	66.7%	1		40.73s	480	12,992

Combined	Score	Consistency	Attempt pass rate	Flaky tests	Tests Correct	Response Time (avg)	Output Tokens	Reasoning Tokens
Gemini 3.1 Pro Preview	9.5	10.0	100.0%	0		40.61s	432	9,281
GPT-5 Nano	10.0	10.0	100.0%	0		65.96s	578	17,984

Data parsing and extraction	Score	Consistency	Attempt pass rate	Flaky tests	Tests Correct	Response Time (avg)	Output Tokens	Reasoning Tokens
Gemini 3.1 Pro Preview	10.0	10.0	100.0%	0		7.72s	279	3,904
GPT-5 Nano	3.7	1.7	50.0%	2		21.42s	453	10,560

Domain specific	Score	Consistency	Attempt pass rate	Flaky tests	Tests Correct	Response Time (avg)	Output Tokens	Reasoning Tokens
Gemini 3.1 Pro Preview	7.7	10.0	66.7%	0		32.73s	18	12,424
GPT-5 Nano	5.2	4.4	55.6%	2		204.02s	237	64,448

General Intelligence	Score	Consistency	Attempt pass rate	Flaky tests	Tests Correct	Response Time (avg)	Output Tokens	Reasoning Tokens
Gemini 3.1 Pro Preview	10.0	10.0	100.0%	0		11.77s	108	1,179
GPT-5 Nano	4.1	10.0	0.0%	0		17.51s	202	4,608

Instructions following	Score	Consistency	Attempt pass rate	Flaky tests	Tests Correct	Response Time (avg)	Output Tokens	Reasoning Tokens
Gemini 3.1 Pro Preview	10.0	10.0	100.0%	0		9.56s	72	2,236
GPT-5 Nano	8.5	6.8	83.3%	1		11.90s	382	4,096

Puzzle Solving	Score	Consistency	Attempt pass rate	Flaky tests	Tests Correct	Response Time (avg)	Output Tokens	Reasoning Tokens
Gemini 3.1 Pro Preview	10.0	10.0	100.0%	0		7.15s	232	3,117
GPT-5 Nano	5.3	7.2	44.4%	1		19.81s	869	13,440

Tool Calling	Score	Consistency	Attempt pass rate	Flaky tests	Tests Correct	Response Time (avg)	Output Tokens	Reasoning Tokens
Gemini 3.1 Pro Preview	10.0	10.0	100.0%	0		23.15s	274	982
GPT-5 Nano	10.0	10.0	100.0%	0		33.30s	558	6,976

Quick Compare

Switch Comparison Pair

GPT-5 NanomediumvsGLM 5V Turbonone GPT-5 NanomediumvsQwen3.5-Flashnone Gemma 4 26B A4BnoneFree AvailablevsGPT-5 Nanomedium Seed-2.0-LitenonevsGPT-5 Nanomedium Gemini 2.5 FlashnonevsGPT-5 Nanomedium GPT-5 NanomediumvsQwen3.5-35B-A3Bnone DeepSeek V4 PrononevsGPT-5 Nanomedium GPT-5 NanomediumvsMiMo-V2-Omninone GPT-5 NanomediumvsQwen3.6 27Bnone DeepSeek V3.2nonevsGPT-5 Nanomedium GPT-5 NanomediumvsMiMo-V2-Pronone GPT-5 NanomediumvsQwen3.5-27Bnone