导航
AI BENCHY
Advertise here

AI BENCHY 对比

MiniMax: MiniMax M3 vs OpenAI: GPT-5.4 Nano

摘要

MiniMax M3 vs GPT-5.4 Nano benchmark 对比:MiniMax M3 平均分领先,为 7.6 vs 7.5GPT-5.4 Nano benchmark 成本更低,为 $0.107 vs $0.131GPT-5.4 Nano 更快,为 11.95s vs 68.17s,通过率为 65.1% vs 63.5%

推荐模型: GPT-5.4 Nano - 它的得分接近这里的最高分(7.5 vs 7.6),同时响应速度比MiniMax M3快约 5.7 倍。

基准结果生成自 AI BENCHY 测试套件,时间:: 2026-06-12

指标 MiniMax M3 MiniMax M3 medium 发布日期: 2026-06-01 GPT-5.4 Nano GPT-5.4 Nano medium 发布日期: 2026-03-17
分数 7.6 7.5
排名 #43 #48
可靠性 9.6 10.0
一致性 7.9 8.4
测试正确
尝试通过率 65.1% 63.5%
不稳定测试 5 4
总运行次数 63 63
每个结果成本 1.187 0.969
总成本 $0.131 $0.107
输入价格 $0.300 / 1M $0.200 / 1M
输出价格 $1.200 / 1M $1.250 / 1M
总输入令牌 46,546 35,434
输出令牌 49,036 3,014
推理令牌 92,543 76,520
响应时间(平均) 68.17s 11.95s
响应时间(最大) 431.03s 94.06s
响应时间(总计) 1363.38s 250.98s

Generation showcase

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#43 MiniMax M3

medium
Cost
$0.012
Time
154.4s
Tokens
10,018 tok

#48 GPT-5.4 Nano

medium
Cost
$0.007
Time
24.6s
Tokens
4,943 tok

按分数排名的模型

分数 vs 总成本

响应时间(平均)

分数 vs 响应时间(平均)

总输出令牌

分数 vs 总输出令牌

类别细分

反AI技巧 分数 一致性 尝试通过率 不稳定测试 测试正确 响应时间(平均) 输入令牌 输出令牌 推理令牌
MiniMax M3 5.5 3.7 66.7% 3 14.95s 2,526 874 3,414
GPT-5.4 Nano 8.3 10.0 75.0% 0 4.52s 606 683 2,254
编程 分数 一致性 尝试通过率 不稳定测试 测试正确 响应时间(平均) 输入令牌 输出令牌 推理令牌
MiniMax M3 6.1 6.5 55.6% 1 144.74s 5,804 6,223 32,667
GPT-5.4 Nano 6.1 4.7 66.7% 2 19.12s 7,305 516 20,778
综合 分数 一致性 尝试通过率 不稳定测试 测试正确 响应时间(平均) 输入令牌 输出令牌 推理令牌
MiniMax M3 10.0 10.0 100.0% 0 65.30s 14,760 1,306 6,253
GPT-5.4 Nano 9.8 10.0 100.0% 0 24.13s 12,345 349 5,719
数据解析与提取 分数 一致性 尝试通过率 不稳定测试 测试正确 响应时间(平均) 输入令牌 输出令牌 推理令牌
MiniMax M3 10.0 10.0 100.0% 0 14.92s 8,088 514 3,164
GPT-5.4 Nano 10.0 10.0 100.0% 0 2.54s 7,140 234 516
领域专项 分数 一致性 尝试通过率 不稳定测试 测试正确 响应时间(平均) 输入令牌 输出令牌 推理令牌
MiniMax M3 5.5 9.3 33.3% 0 233.13s 869 16,254 19,070
GPT-5.4 Nano 5.9 7.2 55.6% 1 38.18s 619 60 43,325
通用智能 分数 一致性 尝试通过率 不稳定测试 测试正确 响应时间(平均) 输入令牌 输出令牌 推理令牌
MiniMax M3 5.1 3.4 33.3% 1 33.25s 954 2,487 2,523
GPT-5.4 Nano 4.5 10.0 0.0% 0 4.15s 477 179 443
指令遵循 分数 一致性 尝试通过率 不稳定测试 测试正确 响应时间(平均) 输入令牌 输出令牌 推理令牌
MiniMax M3 9.8 10.0 100.0% 0 6.14s 1,623 103 920
GPT-5.4 Nano 9.8 10.0 100.0% 0 1.88s 660 95 521
谜题求解 分数 一致性 尝试通过率 不稳定测试 测试正确 响应时间(平均) 输入令牌 输出令牌 推理令牌
MiniMax M3 7.9 9.9 66.7% 0 49.91s 2,079 11,946 13,761
GPT-5.4 Nano 4.1 7.2 22.2% 1 3.79s 642 594 1,408
工具调用 分数 一致性 尝试通过率 不稳定测试 测试正确 响应时间(平均) 输入令牌 输出令牌 推理令牌
MiniMax M3 10.0 10.0 100.0% 0 11.91s 9,168 281 555
GPT-5.4 Nano 10.0 10.0 100.0% 0 7.71s 5,445 234 382
常识问答 分数 一致性 尝试通过率 不稳定测试 测试正确 响应时间(平均) 输入令牌 输出令牌 推理令牌
MiniMax M3 3.0 10.0 0.0% 0 100.80s 675 9,048 10,216
GPT-5.4 Nano 3.0 10.0 0.0% 0 4.81s 195 70 1,174

快速对比

切换对比组合