导航
AI BENCHY
Advertise here

Gemini 2.5 Flash vs GPT-5 Nano (medium)

Gemini 2.5 Flash 平均分领先,为 6.0 vs 6.0Gemini 2.5 Flash benchmark 成本更低,为 $0.017 vs $0.118Gemini 2.5 Flash 更快,为 6.19s vs 54.20s,通过率为 39.4% vs 54.5%

基准结果生成自 AI BENCHY 测试套件,时间:: 2026-08-29

排名
#184
总输出令牌
1,890
响应时间(平均)
6.19s
总成本
$0.017
排名
#188
总输出令牌
282,437
响应时间(平均)
54.20s
总成本
$0.118
推荐模型 Gemini 2.5 Flash

它在这里得分最高(6.0),同时成本比GPT-5 Nano (medium)低约 7.1 倍。

详细对比

指标 Gemini 2.5 Flash Gemini 2.5 Flash none 发布日期: 2025-06-17 GPT-5 Nano GPT-5 Nano medium 发布日期: 2025-08-07
分数 6.0 6.0
排名 #184 #188
可靠性 10.0 10.0
一致性 9.6 6.6
尝试次数 66/66 66/66
测试正确
尝试通过率 39.4% 54.5%
不稳定测试 1 9
总运行次数 66 66
每个结果成本 0.209 1.472
总成本 $0.017 $0.118
输入价格 $0.300 / 1M $0.050 / 1M
输出价格 $2.500 / 1M $0.400 / 1M
总输入令牌 39,886 94,944
输出令牌 1,890 12,037
推理令牌 0 270,400
响应时间(平均) 6.19s 54.20s
响应时间(最大) 118.00s 227.89s
响应时间(总计) 136.23s 867.23s
参数量 ~350B 总计 (~20B 激活) ~120B 总计 (~5B 激活)
开放状态 闭源 闭源

模型生成展示

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#184 Gemini 2.5 Flash

none
无效SVG
成本
$0.164
时间
215.5s
令牌
65,659 tok

#188 GPT-5 Nano

medium
成本
$0.006
时间
108.5s
令牌
13,209 tok

按分数排名的模型

分数 vs 总成本

响应时间(平均)

分数 vs 响应时间(平均)

总输出令牌

分数 vs 总输出令牌

类别细分

编程 分数 一致性 尝试通过率 不稳定测试 测试正确 响应时间(平均) 输入令牌 输出令牌 推理令牌
Gemini 2.5 Flash 5.5 10.0 33.3% 0 736ms 8,122 483 0
GPT-5 Nano 7.0 7.7 55.6% 1 41.62s 7,305 740 41,152

快速对比

切换对比组合