ナビゲーション
Advertise here

Gemini 3 Flash Preview (high) vs Grok 4.20

Grok 4.20 が平均スコアでリードし、3.4 vs 1.8 です。 Grok 4.20 の benchmark コストが低く、$0.057 vs $0.105 です。 Grok 4.20 の方が高速で、1.11s vs 52.45s です、成功率は 4.4% vs 26.1% です。

ベンチマークは AI BENCHY テストスイートから次の日時に生成: 2026-10-01

比較対象モデル

順位
#378
合計出力トークン
12,557
応答時間(平均)
52.45s
合計コスト
$0.105
順位
#362
合計出力トークン
1,923
応答時間(平均)
1.11s
合計コスト
$0.057
おすすめモデル Grok 4.20

ここでは最高スコア(3.4)で、Gemini 3 Flash Preview (high) より約 1.9 倍低コストです。

詳細比較

指標 Gemini 3 Flash Preview Gemini 3 Flash Preview high リリース: 2025-12-17 Grok 4.20 Grok 4.20 none リリース: 2026-03-31
スコア 1.8 3.4
順位 #378 #362
信頼性 10.0 該当なし
一貫性 4.0 7.8
試行回数 3/69 54/69
正解テスト
試行ごとの合格率 4.4% 26.1%
不安定なテスト 0 0
総実行回数 3 54
結果あたりのコスト 10.470 1.570
合計コスト $0.105 $0.057
入力価格 $0.500 / 1M $1.250 / 1M
出力価格 $3.000 / 1M $2.500 / 1M
合計入力トークン 134,050 41,313
出力トークン 1,029 1,923
推論トークン 11,528 0
応答時間(平均) 52.45s 1.11s
応答時間(最大) 52.45s 6.04s
応答時間(合計) 52.45s 19.96s
パラメータ ~500B 総数 (~20B アクティブ) ~1T 総数 (~100B アクティブ)
公開状況 クローズド クローズド

モデル生成ショーケース

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#378 Gemini 3 Flash Preview

high
このモデルのショーケース結果はまだ生成されていません。
コスト
該当なし
時間
-
トークン
0 tok

#362 xAI: Grok 4.20

none
コスト
$0.004
時間
6.5s
トークン
1,367 tok

スコア上位モデル

スコア vs 総コスト

応答時間(平均)

スコア vs 応答時間(平均)

合計出力トークン

スコア vs 合計出力トークン

カテゴリ内訳

コーディング スコア 一貫性 試行ごとの合格率 不安定なテスト 正解テスト 応答時間(平均) 入力トークン 出力トークン 推論トークン
Gemini 3 Flash Preview 0.0 0.0 0.0% 0 0ms 0 0 0
Grok 4.20 1.1 3.1 0.0% 0 1.22s 1,074 312 0

クイック比較

比較ペアを切り替え

Command A+mediumvsGrok 4.20noneCommand A+highvsGrok 4.20noneLing 3.0 TinymediumvsGrok 4.20noneLing 3.0 TinylowvsGrok 4.20noneLing 3.0 TinyhighvsGrok 4.20noneCommand A+lowvsGrok 4.20noneGemini 3 Flash PreviewhighvsKev 4BnoneQwen3.5-9BmediumvsGrok 4.20noneGemini 3 Flash PreviewhighvsJev 1.13noneGrok 4.20nonevsGLM 4.7 FlashmediumMiniMax M2.5mediumvsGrok 4.20noneCobuddymedium無料で利用可能vsGrok 4.20none