- 順位
- #328
- 合計出力トークン
- 18,927
- 応答時間(平均)
- 698ms
- 合計コスト
- $0.003
Jev 1.13 vs Grok 4.20
Grok 4.20 が平均スコアでリードし、4.1 vs 3.2 です。 Jev 1.13 の benchmark コストが低く、$0.003 vs $0.057 です。 Jev 1.13 の方が高速で、698ms vs 1.11s です、成功率は 27.3% vs 27.3% です。
比較対象モデル
- 順位
- #310
- 合計出力トークン
- 1,923
- 応答時間(平均)
- 1.11s
- 合計コスト
- $0.057
おすすめモデル
Grok 4.20
この比較で最も高いスコア(4.1)を出し、全 2 モデルの中でコストと応答時間のバランスも最良です。
詳細比較
| 指標 | Jev 1.13 Jev 1.13 none | Grok 4.20 Grok 4.20 none |
|---|---|---|
| スコア | 3.2 | 4.1 |
| 順位 | #328 | #310 |
| 信頼性 | 10.0 | 該当なし |
| 一貫性 | 5.5 | 8.1 |
| 試行回数 | 36/66 | 54/66 |
| 正解テスト | ||
| 試行ごとの合格率 | 27.3% | 27.3% |
| 不安定なテスト | 0 | 0 |
| 総実行回数 | 36 | 54 |
| 結果あたりのコスト | 0.047 | 1.570 |
| 合計コスト | $0.003 | $0.057 |
| 入力価格 | $0.042 / 1M | $1.250 / 1M |
| 出力価格 | $0.000 / 1M | $2.500 / 1M |
| 合計入力トークン | 67,092 | 41,313 |
| 出力トークン | 18,927 | 1,923 |
| 推論トークン | 0 | 0 |
| 応答時間(平均) | 698ms | 1.11s |
| 応答時間(最大) | 1.08s | 6.04s |
| 応答時間(合計) | 8.38s | 19.96s |
| パラメータ | - | ~1T 総数 (~100B アクティブ) |
| 公開状況 | クローズド | クローズド |
モデル生成ショーケース
Hamster playing table tennis
Prompt: Create a detailed SVG illustration of a hamster playing table tennis.
#328 Jev 1.13
none
このモデルのショーケース結果はまだ生成されていません。
- コスト
- 該当なし
- 時間
- -
- トークン
- 0 tok
#310 xAI: Grok 4.20
none- コスト
- $0.004
- 時間
- 6.5s
- トークン
- 1,367 tok
スコア上位モデル
スコア vs 総コスト
応答時間(平均)
スコア vs 応答時間(平均)
合計出力トークン
スコア vs 合計出力トークン
カテゴリ内訳
クイック比較
比較ペアを切り替え
Grok 4.20nonevsGLM 4.7 FlashmediumLing 3.0 TinyhighvsGrok 4.20noneLing 3.0 TinylowvsGrok 4.20noneQwen3.5-9BmediumvsGrok 4.20noneLing 3.0 TinymediumvsGrok 4.20noneMiniMax M2.5mediumvsGrok 4.20noneQwen3 Coder NextmediumvsGrok 4.20noneGranite 4.2 8BhighvsGrok 4.20noneCobuddymediumvsGrok 4.20noneLing 3.0 TinymediumvsJev 1.13noneQwen3.5-9BmediumvsJev 1.13noneLing 3.0 TinylowvsJev 1.13none