导航
Advertise here

已对比模型

Qwen3.8 27B (high) vs Qwen3.8 27B (medium) vs Qwen3.8 27B (low) vs Qwen3.8 27B 基准对比: Qwen3.8 27B (high) 在分数上以 8.7 领先。 Qwen3.8 27B (low) 在可靠性上以 10.0 领先。 Qwen3.8 27B 的总成本最低,为 ~$0.010。 Qwen3.8 27B 最快,为 5.05s。

基准结果生成自 AI BENCHY 测试套件,时间:: 2026-10-01

已对比模型

排名
#55
总输出令牌
677,080
响应时间(平均)
166.34s
总成本
~$0.298
排名
#141
总输出令牌
170,696
响应时间(平均)
40.09s
总成本
~$0.073
排名
#117
总输出令牌
209,143
响应时间(平均)
46.60s
总成本
~$0.089
排名
#272
总输出令牌
13,791
响应时间(平均)
5.05s
总成本
~$0.010
推荐模型 Qwen3.8 27B (high)

它在本次比较中得分最高(8.7),并且在全部 4 个模型中兼顾成本和响应时间最好。

详细对比

指标 Qwen3.8 27B Qwen3.8 27B high 发布日期: 2026-08-14 免费可用 Qwen3.8 27B Qwen3.8 27B medium 发布日期: 2026-08-14 免费可用 Qwen3.8 27B Qwen3.8 27B low 发布日期: 2026-08-14 免费可用 Qwen3.8 27B Qwen3.8 27B none 发布日期: 2026-08-14 免费可用
分数 8.7 7.2 7.6 5.4
排名 #55 #141 #117 #272
可靠性 9.7 9.7 10.0 10.0
一致性 9.2 9.4 9.7 10.0
尝试次数 69/69 69/69 69/69 69/69
测试正确
尝试通过率 78.3% 66.7% 68.1% 39.1%
不稳定测试 2 2 1 0
总运行次数 69 69 69 69
每个结果成本 ~1.751 ~0.520 ~0.589 ~0.107
总成本 ~$0.298 ~$0.073 ~$0.089 ~$0.010
输入价格 不适用 不适用 不适用 不适用
输出价格 不适用 不适用 不适用 不适用
总输入令牌 348,967 277,164 315,290 281,460
输出令牌 1,005 1,913 1,607 13,791
推理令牌 676,075 168,783 207,536 0
响应时间(平均) 166.34s 40.09s 46.60s 5.05s
响应时间(最大) 640.85s 214.63s 376.04s 47.42s
响应时间(总计) 3825.81s 881.89s 1071.83s 116.11s
参数量 27.3B 27.3B 27.3B 27.3B
开放状态 权重可用 权重可用 权重可用 权重可用

模型生成展示

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#55 Qwen3.8 27B

high
成本
~$0.008
时间
270.1s
令牌
18,963 tok

#141 Qwen3.8 27B

medium
成本
~$0.002
时间
43.4s
令牌
2,956 tok

#117 Qwen3.8 27B

low
成本
~$0.003
时间
92.8s
令牌
6,902 tok

#272 Qwen3.8 27B

none
成本
~$0.001
时间
23.9s
令牌
1,922 tok

按分数排名的模型

分数 vs 总成本

响应时间(平均)

分数 vs 响应时间(平均)

总输出令牌

分数 vs 总输出令牌

类别细分

编程 分数 一致性 尝试通过率 不稳定测试 测试正确 响应时间(平均) 输入令牌 输出令牌 推理令牌
Qwen3.8 27B 8.1 7.0 88.9% 1 248.62s 8,235 346 143,335
Qwen3.8 27B 10.0 10.0 100.0% 0 40.50s 7,893 585 26,808
Qwen3.8 27B 7.7 10.0 66.7% 0 140.92s 8,127 585 86,694
Qwen3.8 27B 5.5 10.0 33.3% 0 1.19s 7,911 408 0

快速对比

切换对比组合

Gemini 3.8 FlashlowvsQwen3.8 27Bmedium免费可用GPT-5.2mediumvsQwen3.8 27Bhigh免费可用Qwen3.8 27Bhigh免费可用vsMiMo-V2.6-PromediumSeed 2.1 TurbomediumvsQwen3.8 27Bhigh免费可用Claude Opus 4.8lowvsQwen3.8 27Bmedium免费可用GPT-6 SollowvsQwen3.8 27Bhigh免费可用Qwen3.8 27Blow免费可用vsSpace Bunny AlphahighQwen3.8 27Blow免费可用vsGLM 5.1mediumNorth Mini Codemedium免费可用vsQwen3.8 27Bnone免费可用Qwen3.8 27Bnone免费可用vsHy4 previewlowQwen3.8 27Bmedium免费可用vsStep 3.7 FlashlowDeepSeek V4.1 FlashmaxvsQwen3.8 27Bhigh免费可用