- 順位
- #82
- 合計出力トークン
- 333,632
- 応答時間(平均)
- 72.50s
- 合計コスト
- $2.571
Grok 4.5 (high) vs GLM 5.2 (medium)
平均スコアは 8.2 vs 8.2 でほぼ同等です。 GLM 5.2 (medium) の benchmark コストが低く、$0.398 vs $2.571 です。 GLM 5.2 (medium) の方が高速で、26.88s vs 72.50s です、成功率は 82.6% vs 81.2% です。
比較対象モデル
- 順位
- #83
- 合計出力トークン
- 81,020
- 応答時間(平均)
- 26.88s
- 合計コスト
- $0.398
おすすめモデル
GLM 5.2 (medium)
ここでは最高スコア(8.2)で、Grok 4.5 (high) より約 6.5 倍低コストです。
詳細比較
| 指標 | Grok 4.5 Grok 4.5 high | GLM 5.2 GLM 5.2 medium |
|---|---|---|
| スコア | 8.2 | 8.2 |
| 順位 | #82 | #83 |
| 信頼性 | 10.0 | 9.6 |
| 一貫性 | 8.9 | 8.1 |
| 試行回数 | 69/69 | 66/69 |
| 正解テスト | ||
| 試行ごとの合格率 | 82.6% | 81.2% |
| 不安定なテスト | 3 | 4 |
| 総実行回数 | 69 | 66 |
| 結果あたりのコスト | 15.123 | 2.890 |
| 合計コスト | $2.571 | $0.398 |
| 入力価格 | $2.000 / 1M | $0.325 / 1M |
| 出力価格 | $6.000 / 1M | $3.990 / 1M |
| 合計入力トークン | 342,124 | 227,164 |
| 出力トークン | 7,135 | 20,029 |
| 推論トークン | 326,497 | 60,991 |
| 応答時間(平均) | 72.50s | 26.88s |
| 応答時間(最大) | 676.83s | 102.40s |
| 応答時間(合計) | 1667.51s | 591.34s |
| パラメータ | ~1.7T 総数 (~170B アクティブ) | 744B 総数 (40B アクティブ) |
| 公開状況 | クローズド | オープンソース |
モデル生成ショーケース
Hamster playing table tennis
Prompt: Create a detailed SVG illustration of a hamster playing table tennis.
#82 SpaceXAI: Grok 4.5
high- コスト
- $0.015
- 時間
- 29.7s
- トークン
- 2,737 tok
#83 GLM 5.2
medium- コスト
- $0.041
- 時間
- 195.8s
- トークン
- 9,287 tok
スコア上位モデル
スコア vs 総コスト
応答時間(平均)
スコア vs 応答時間(平均)
合計出力トークン
スコア vs 合計出力トークン
カテゴリ内訳
クイック比較
比較ペアを切り替え
Qwen3.7 PlusmediumvsGrok 4.5highGPT-5.6 TerramediumvsGrok 4.5highClaude Opus 4.8mediumvsGrok 4.5highGPT-6 LunamediumvsGrok 4.5highKimi K3maxvsGrok 4.5highKimi K3maxvsGLM 5.2mediumSeed-2.0-LitemediumvsGrok 4.5highGemini 3.5 FlashhighvsGLM 5.2mediumGPT-5.6 TerrahighvsGLM 5.2mediumSeed-2.0-CodelowvsGLM 5.2mediumSeed-2.0-CodelowvsGrok 4.5highDeepSeek V4 Flash 0731highvsGLM 5.2medium