- 順位
- #96
- 合計出力トークン
- 38,048
- 応答時間(平均)
- 14.55s
- 合計コスト
- $0.449
Grok 4.6 (low) vs GLM 5.3 (high)
平均スコアは 7.4 vs 7.3 でほぼ同等です。 GLM 5.3 (high) の benchmark コストが低く、$0.403 vs $0.449 です。 Grok 4.6 (low) の方が高速で、14.55s vs 27.82s です、成功率は 69.7% vs 74.2% です。
- 順位
- #99
- 合計出力トークン
- 63,667
- 応答時間(平均)
- 27.82s
- 合計コスト
- $0.403
おすすめモデル
Grok 4.6 (low)
ここでは最高スコア(7.4)で、GLM 5.3 (high) より約 1.9 倍速く応答します。
詳細比較
| 指標 | Grok 4.6 Grok 4.6 low | GLM 5.3 GLM 5.3 high |
|---|---|---|
| スコア | 7.4 | 7.3 |
| 順位 | #96 | #99 |
| 信頼性 | 10.0 | 10.0 |
| 一貫性 | 9.6 | 7.5 |
| 試行回数 | 66/66 | 66/66 |
| 正解テスト | ||
| 試行ごとの合格率 | 69.7% | 74.2% |
| 不安定なテスト | 1 | 7 |
| 総実行回数 | 66 | 66 |
| 結果あたりのコスト | 2.989 | 3.099 |
| 合計コスト | $0.449 | $0.403 |
| 入力価格 | $2.000 / 1M | $1.400 / 1M |
| 出力価格 | $6.000 / 1M | $4.400 / 1M |
| 合計入力トークン | 109,960 | 87,601 |
| 出力トークン | 5,124 | 6,006 |
| 推論トークン | 32,924 | 57,661 |
| 応答時間(平均) | 14.55s | 27.82s |
| 応答時間(最大) | 26.46s | 159.91s |
| 応答時間(合計) | 320.17s | 612.06s |
| パラメータ | ~1.7T 総数 (~170B アクティブ) | 744B 総数 (40B アクティブ) |
| 公開状況 | クローズド | クローズド |
モデル生成ショーケース
Hamster playing table tennis
Prompt: Create a detailed SVG illustration of a hamster playing table tennis.
#96 SpaceXAI: Grok 4.6
low- コスト
- $0.011
- 時間
- 26.0s
- トークン
- 1,941 tok
#99 GLM 5.3
high- コスト
- $0.085
- 時間
- 362.5s
- トークン
- 19,310 tok
スコア上位モデル
スコア vs 総コスト
応答時間(平均)
スコア vs 応答時間(平均)
合計出力トークン
スコア vs 合計出力トークン
カテゴリ内訳
クイック比較
比較ペアを切り替え
Claude Sonnet 4.6nonevsGLM 5.3highKAT-Coder-Pro V2.5lowvsGLM 5.3highQwen3.8 2.4T A95BhighvsGrok 4.6lowClaude Sonnet 4.6nonevsGrok 4.6lowGemini 3 Flash PreviewlowvsGLM 5.3highGemini 3.1 Flash LitemediumvsGLM 5.3highLongCat 2.0mediumvsGrok 4.6lowQwen3.7 PlusnonevsGLM 5.3highGPT-5.6 LunamediumvsGrok 4.6lowKimi K2.7 CodemediumvsGrok 4.6lowQwen3.7 MaxnonevsGrok 4.6lowDeepSeek V4 Flash 0731mediumvsGLM 5.3high