- 順位
- #391
- 合計出力トークン
- 28,061
- 応答時間(平均)
- 5.63s
- 合計コスト
- $0.002
Kev 4B (default) vs Grok 4.20
Grok 4.20 が平均スコアでリードし、3.4 vs 2.4 です。 Kev 4B (default) の benchmark コストが低く、$0.002 vs $0.057 です。 Grok 4.20 の方が高速で、1.11s vs 5.63s です、成功率は 15.9% vs 26.1% です。
比較対象モデル
- 順位
- #376
- 合計出力トークン
- 1,923
- 応答時間(平均)
- 1.11s
- 合計コスト
- $0.057
おすすめモデル
Grok 4.20
ここでは最高スコア(3.4)で、Kev 4B (default) より約 5.1 倍速く応答します。
詳細比較
| 指標 | Kev 4B Kev 4B default | Grok 4.20 Grok 4.20 none |
|---|---|---|
| スコア | 2.4 | 3.4 |
| 順位 | #391 | #376 |
| 信頼性 | 10.0 | 該当なし |
| 一貫性 | 4.9 | 7.8 |
| 試行回数 | 36/69 | 54/69 |
| 正解テスト | ||
| 試行ごとの合格率 | 15.9% | 26.1% |
| 不安定なテスト | 1 | 0 |
| 総実行回数 | 36 | 54 |
| 結果あたりのコスト | 0.060 | 1.570 |
| 合計コスト | $0.002 | $0.057 |
| 入力価格 | $0.042 / 1M | $1.250 / 1M |
| 出力価格 | $0.000 / 1M | $2.500 / 1M |
| キャッシュ読み取り料金 | 該当なし | $0.200 / 1M |
| キャッシュ書き込み料金 | 該当なし | 該当なし |
| 合計入力トークン | 42,804 | 41,313 |
| 出力トークン | 28,061 | 1,923 |
| 推論トークン | 0 | 0 |
| 応答時間(平均) | 5.63s | 1.11s |
| 応答時間(最大) | 17.79s | 6.04s |
| 応答時間(合計) | 67.61s | 19.96s |
| パラメータ | 4B | ~1T 総数 (~100B アクティブ) |
| 公開状況 | オープンソース | クローズド |
キャッシュ料金は入力トークンに適用されます。読み取りは保存済みのプロンプトを再利用し、書き込みは保存するため追加料金がかかる場合があります。出力トークンには出力料金が適用されます。
モデル生成ショーケース
Hamster playing table tennis
Prompt: Create a detailed SVG illustration of a hamster playing table tennis.
#391 Jared Palmer: Kev 4B
default
このモデルのショーケース結果はまだ生成されていません。
- コスト
- 該当なし
- 時間
- -
- トークン
- 0 tok
#376 xAI: Grok 4.20
none- コスト
- $0.004
- 時間
- 6.5s
- トークン
- 1,367 tok
スコア上位モデル
スコア vs 総コスト
応答時間(平均)
スコア vs 応答時間(平均)
合計出力トークン
スコア vs 合計出力トークン
カテゴリ内訳
クイック比較
比較ペアを切り替え
Command A+mediumvsGrok 4.20noneCommand A+highvsGrok 4.20noneLing 3.0 TinymediumvsGrok 4.20noneLing 3.0 TinylowvsGrok 4.20noneLing 3.0 TinyhighvsGrok 4.20noneCommand A+lowvsGrok 4.20noneGranite 4.1 8bdefaultvsGrok 4.20noneLing 3.0 TinydefaultvsGrok 4.20noneCommand A+lowvsKev 4BdefaultCommand A+nonevsKev 4BdefaultGemini 3 Flash PreviewhighvsKev 4BdefaultQwen3.5-9BmediumvsGrok 4.20none