ナビゲーション
AI BENCHY
Advertise here

AI BENCHY Compare

Google: Gemini 3.5 Flash vs xAI: Grok Build 0.1

ベンチマークは AI BENCHY テストスイートから次の日時に生成: 2026-05-21

指標 Gemini 3.5 Flash Gemini 3.5 Flash low リリース: 2026-05-19 Grok Build 0.1 Grok Build 0.1 medium リリース: 2026-05-21
スコア 9.6 7.8
順位 #2 #41
信頼性 10.0 10.0
一貫性 10.0 8.9
正解テスト
試行ごとの合格率 94.7% 71.9%
不安定なテスト 0 3
総実行回数 57 57
結果あたりのコスト 1.359 4.064
合計コスト $0.245 $0.488
???? $1.500 / 1M $1.000 / 1M
???? $9.000 / 1M $2.000 / 1M
出力トークン 2,003 1,947
推論トークン 20,245 223,372
応答時間(平均) 2.84s 22.28s
応答時間(最大) 6.44s 88.28s
応答時間(合計) 54.00s 423.30s

スコア上位モデル

スコア vs 総コスト

応答時間(平均)

スコア vs 応答時間(平均)

合計出力トークン

スコア vs 合計出力トークン

カテゴリ内訳

反AIトリック スコア 一貫性 試行ごとの合格率 不安定なテスト 正解テスト 応答時間(平均) 出力トークン 推論トークン
Gemini 3.5 Flash 10.0 10.0 100.0% 0 2.52s 209 2,536
Grok Build 0.1 10.0 10.0 100.0% 0 5.46s 195 9,825
コーディング スコア 一貫性 試行ごとの合格率 不安定なテスト 正解テスト 応答時間(平均) 出力トークン 推論トークン
Gemini 3.5 Flash 10.0 10.0 100.0% 0 5.49s 428 3,146
Grok Build 0.1 7.3 3.7 66.7% 1 30.98s 354 17,734
複合 スコア 一貫性 試行ごとの合格率 不安定なテスト 正解テスト 応答時間(平均) 出力トークン 推論トークン
Gemini 3.5 Flash 10.0 10.0 100.0% 0 6.44s 351 3,050
Grok Build 0.1 10.0 10.0 100.0% 0 30.81s 231 18,779
データ解析と抽出 スコア 一貫性 試行ごとの合格率 不安定なテスト 正解テスト 応答時間(平均) 出力トークン 推論トークン
Gemini 3.5 Flash 10.0 10.0 100.0% 0 1.81s 279 1,164
Grok Build 0.1 10.0 10.0 100.0% 0 7.76s 180 10,343
ドメイン特化 スコア 一貫性 試行ごとの合格率 不安定なテスト 正解テスト 応答時間(平均) 出力トークン 推論トークン
Gemini 3.5 Flash 7.7 10.0 66.7% 0 3.39s 12 4,538
Grok Build 0.1 5.3 10.0 33.3% 0 77.75s 501 111,807
汎用知能 スコア 一貫性 試行ごとの合格率 不安定なテスト 正解テスト 応答時間(平均) 出力トークン 推論トークン
Gemini 3.5 Flash 10.0 10.0 100.0% 0 2.27s 119 916
Grok Build 0.1 3.8 2.5 33.3% 1 10.14s 78 5,386
指示追従 スコア 一貫性 試行ごとの合格率 不安定なテスト 正解テスト 応答時間(平均) 出力トークン 推論トークン
Gemini 3.5 Flash 9.9 10.0 100.0% 0 1.86s 71 1,652
Grok Build 0.1 9.8 10.0 100.0% 0 9.62s 57 12,436
パズル解決 スコア 一貫性 試行ごとの合格率 不安定なテスト 正解テスト 応答時間(平均) 出力トークン 推論トークン
Gemini 3.5 Flash 10.0 10.0 100.0% 0 2.35s 288 2,150
Grok Build 0.1 6.2 7.5 55.6% 1 8.67s 161 15,476
ツール呼び出し スコア 一貫性 試行ごとの合格率 不安定なテスト 正解テスト 応答時間(平均) 出力トークン 推論トークン
Gemini 3.5 Flash 10.0 10.0 100.0% 0 3.27s 234 403
Grok Build 0.1 10.0 10.0 100.0% 0 9.40s 180 5,319
雑学 スコア 一貫性 試行ごとの合格率 不安定なテスト 正解テスト 応答時間(平均) 出力トークン 推論トークン
Gemini 3.5 Flash 10.0 10.0 100.0% 0 1.88s 12 690
Grok Build 0.1 3.0 10.0 0.0% 0 26.07s 10 16,267

クイック比較

比較ペアを切り替え