ナビゲーション
AI BENCHY
Advertise here

比較対象モデル

GLM 5 (medium) vs GLM 5.1 (medium) vs GLM 5 vs GLM 5.1 ベンチマーク比較: GLM 5 (medium) は スコア で 7.7 と首位です。 GLM 5 (medium) は 信頼性 で 10.0 と首位です。 GLM 5 は 合計コスト が最も低く、$0.041 です。 GLM 54.03s で最速です。

ベンチマークは AI BENCHY テストスイートから次の日時に生成: 2026-07-25

順位
#49
合計出力トークン
124,566
応答時間(平均)
33.54s
合計コスト
$0.307
順位
#82
合計出力トークン
152,552
応答時間(平均)
46.77s
合計コスト
$0.535
順位
#152
合計出力トークン
1,989
応答時間(平均)
4.03s
合計コスト
$0.041
順位
#163
合計出力トークン
14,393
応答時間(平均)
6.70s
合計コスト
$0.164
おすすめモデル GLM 5 (medium)

この比較で最も高いスコア(7.7)を出し、全 4 モデルの中でコストと応答時間のバランスも最良です。

詳細比較

指標 GLM 5 GLM 5 medium リリース: 2026-02-12 GLM 5.1 GLM 5.1 medium リリース: 2026-04-07 GLM 5 GLM 5 none リリース: 2026-02-12 GLM 5.1 GLM 5.1 none リリース: 2026-04-07
スコア 7.7 7.1 5.7 5.5
順位 #49 #82 #152 #163
信頼性 10.0 8.3 10.0 10.0
一貫性 8.1 8.4 9.3 8.2
正解テスト
試行ごとの合格率 78.8% 69.7% 42.4% 40.9%
不安定なテスト 4 4 1 5
総実行回数 63 66 63 66
結果あたりのコスト 1.668 4.202 0.263 2.368
合計コスト $0.307 $0.535 $0.041 $0.164
入力価格 $0.950 / 1M $0.966 / 1M $0.950 / 1M $0.966 / 1M
出力価格 $2.551 / 1M $3.036 / 1M $2.551 / 1M $3.036 / 1M
合計入力トークン 35,224 82,623 37,135 124,209
出力トークン 21,570 16,089 1,989 14,393
推論トークン 102,996 136,463 0 0
応答時間(平均) 33.54s 46.77s 4.03s 6.70s
応答時間(最大) 99.85s 308.75s 11.07s 61.20s
応答時間(合計) 435.99s 982.16s 56.37s 147.38s

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#49 GLM 5

medium
コスト
$0.005
時間
20.7s
トークン
2,068 tok

#82 GLM 5.1

medium
無効なSVG
コスト
$0.000
時間
300.0s
トークン
0 tok

#152 GLM 5

none
コスト
$0.007
時間
32.1s
トークン
2,023 tok

#163 GLM 5.1

none
無効なSVG
コスト
$0.000
時間
300.0s
トークン
0 tok

スコア上位モデル

スコア vs 総コスト

応答時間(平均)

スコア vs 応答時間(平均)

合計出力トークン

スコア vs 合計出力トークン

カテゴリ内訳

コーディング スコア 一貫性 試行ごとの合格率 不安定なテスト 正解テスト 応答時間(平均) 入力トークン 出力トークン 推論トークン
GLM 5 10.0 10.0 100.0% 0 74.30s 7,254 2,997 52,930
GLM 5.1 4.6 3.7 44.5% 2 109.63s 5,702 4,871 37,826
GLM 5 4.0 7.8 11.1% 1 5.12s 7,256 428 0
GLM 5.1 3.9 9.7 0.0% 0 4.96s 7,256 525 0

クイック比較

比較ペアを切り替え