ナビゲーション
AI BENCHY
Advertise here

比較対象モデル

Gemma 4 31B (medium) vs Gemini 3 PRO Preview (medium) vs GLM 5 Turbo (medium) ベンチマーク比較: GLM 5 Turbo (medium) は スコア で 7.6 と首位です。 Gemma 4 31B (medium) は 信頼性 で 10.0 と首位です。 Gemma 4 31B (medium) は 合計コスト が最も低く、$0.100 です。 Gemini 3 PRO Preview (medium)9.05s で最速です。

ベンチマークは AI BENCHY テストスイートから次の日時に生成: 2026-08-20

順位
#166
合計出力トークン
267,421
応答時間(平均)
78.59s
合計コスト
$0.100
順位
#185
合計出力トークン
11,592
応答時間(平均)
9.05s
合計コスト
$0.385
順位
#77
合計出力トークン
74,522
応答時間(平均)
23.00s
合計コスト
$0.323
おすすめモデル GLM 5 Turbo (medium)

ここでは最高スコア(7.6)で、この比較の他のモデル より約 1.9 倍速く応答します。

詳細比較

指標 Gemma 4 31B Gemma 4 31B medium リリース: 2026-04-02 無料で利用可能 Gemini 3 PRO Preview Gemini 3 PRO Preview medium リリース: 2025-11-18 GLM 5 Turbo GLM 5 Turbo medium リリース: 2026-03-15
スコア 6.2 6.0 7.6
順位 #166 #185 #77
信頼性 10.0 該当なし 10.0
一貫性 8.7 9.5 8.1
試行回数 66/66 63/66 63/66
正解テスト
試行ごとの合格率 65.2% 63.6% 71.2%
不安定なテスト 3 0 4
総実行回数 66 63 63
結果あたりのコスト 1.152 1.406 2.011
合計コスト $0.100 $0.385 $0.323
入力価格 $0.090 / 1M $9.506 / 1M $1.200 / 1M
出力価格 $0.340 / 1M $9.506 / 1M $4.000 / 1M
合計入力トークン 94,969 28,848 35,593
出力トークン 34,399 1,490 12,245
推論トークン 233,022 10,102 62,277
応答時間(平均) 78.59s 9.05s 23.00s
応答時間(最大) 437.40s 26.24s 194.23s
応答時間(合計) 1571.84s 90.53s 482.97s
パラメータ 30.7B ~1.2T 総数 (~20B アクティブ) 744B 総数 (40B アクティブ)
公開状況 オープンソース クローズド クローズド

モデル生成ショーケース

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#166 Gemma 4 31B

medium
コスト
$0.002
時間
45.7s
トークン
2,696 tok

#185 Gemini 3 PRO Preview

medium
No endpoints found for google/gemini-3-pro-preview.
コスト
$0.000
時間
0.1s
トークン
0 tok

#77 GLM 5 Turbo

medium
コスト
$0.074
時間
206.0s
トークン
18,549 tok

スコア上位モデル

スコア vs 総コスト

応答時間(平均)

スコア vs 応答時間(平均)

合計出力トークン

スコア vs 合計出力トークン

カテゴリ内訳

コーディング スコア 一貫性 試行ごとの合格率 不安定なテスト 正解テスト 応答時間(平均) 入力トークン 出力トークン 推論トークン
Gemma 4 31B 4.3 5.8 22.2% 1 219.76s 5,568 11,098 33,212
Gemini 3 PRO Preview 3.0 10.0 0.0% 0 0ms 0 0 0
GLM 5 Turbo 8.2 9.3 66.7% 0 45.90s 5,941 363 25,381

クイック比較

比較ペアを切り替え