ナビゲーション
AI BENCHY
Advertise here

AI BENCHY Compare

Google: Gemini 3.1 Flash Lite Preview vs Qwen: Qwen3.6 Flash

概要

Gemini 3.1 Flash Lite Preview vs Qwen3.6 Flash の benchmark 比較: Qwen3.6 Flash が平均スコアでリードし、7.5 vs 7.2 です。 Gemini 3.1 Flash Lite Preview の benchmark コストが低く、$0.018 vs $0.288 です。 Gemini 3.1 Flash Lite Preview の方が高速で、1.21s vs 19.25s です、成功率は 60.3% vs 71.4% です。

おすすめモデル: Gemini 3.1 Flash Lite Preview - スコアはここでの最高値に近く(7.2 vs 7.5)、Qwen3.6 Flash より約 16.2 倍低コストです。

ベンチマークは AI BENCHY テストスイートから次の日時に生成: 2026-06-10

指標 Gemini 3.1 Flash Lite Preview Gemini 3.1 Flash Lite Preview none リリース: 2026-03-03 Qwen3.6 Flash Qwen3.6 Flash medium リリース: 2026-04-20
スコア 7.2 7.5
順位 #59 #40
信頼性 10.0 10.0
一貫性 9.7 8.1
正解テスト
試行ごとの合格率 60.3% 71.4%
不安定なテスト 1 5
総実行回数 63 63
結果あたりのコスト 0.148 3.030
合計コスト $0.018 $0.288
入力価格 $0.250 / 1M $0.188 / 1M
出力価格 $1.500 / 1M $1.125 / 1M
合計入力トークン 37,582 42,362
出力トークン 5,547 2,995
推論トークン 0 245,358
応答時間(平均) 1.21s 19.25s
応答時間(最大) 3.39s 122.87s
応答時間(合計) 25.45s 404.20s

Generation showcase

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#59 Gemini 3.1 Flash Lite Preview

none
Cost
$0.003
Time
4.7s
Tokens
1,827 tok

#40 Qwen3.6 Flash

medium
Invalid SVG
Cost
$0.008
Time
29.9s
Tokens
6,784 tok

スコア上位モデル

スコア vs 総コスト

応答時間(平均)

スコア vs 応答時間(平均)

合計出力トークン

スコア vs 合計出力トークン

カテゴリ内訳

反AIトリック スコア 一貫性 試行ごとの合格率 不安定なテスト 正解テスト 応答時間(平均) 入力トークン 出力トークン 推論トークン
Gemini 3.1 Flash Lite Preview 7.5 8.4 66.7% 1 1.04s 504 1,092 0
Qwen3.6 Flash 10.0 10.0 100.0% 0 6.10s 672 624 14,024
コーディング スコア 一貫性 試行ごとの合格率 不安定なテスト 正解テスト 応答時間(平均) 入力トークン 出力トークン 推論トークン
Gemini 3.1 Flash Lite Preview 5.5 10.0 33.3% 0 967ms 8,128 670 0
Qwen3.6 Flash 5.0 5.1 44.5% 2 42.85s 7,895 495 67,967
複合 スコア 一貫性 試行ごとの合格率 不安定なテスト 正解テスト 応答時間(平均) 入力トークン 出力トークン 推論トークン
Gemini 3.1 Flash Lite Preview 3.0 10.0 0.0% 0 3.20s 13,026 339 0
Qwen3.6 Flash 10.0 10.0 100.0% 0 20.28s 14,934 483 13,839
データ解析と抽出 スコア 一貫性 試行ごとの合格率 不安定なテスト 正解テスト 応答時間(平均) 入力トークン 出力トークン 推論トークン
Gemini 3.1 Flash Lite Preview 10.0 10.0 100.0% 0 1.22s 7,550 399 0
Qwen3.6 Flash 10.0 10.0 100.0% 0 9.65s 7,782 270 13,155
ドメイン特化 スコア 一貫性 試行ごとの合格率 不安定なテスト 正解テスト 応答時間(平均) 入力トークン 出力トークン 推論トークン
Gemini 3.1 Flash Lite Preview 5.3 10.0 33.3% 0 942ms 641 568 0
Qwen3.6 Flash 3.5 4.4 33.3% 2 14.65s 771 60 24,409
汎用知能 スコア 一貫性 試行ごとの合格率 不安定なテスト 正解テスト 応答時間(平均) 入力トークン 出力トークン 推論トークン
Gemini 3.1 Flash Lite Preview 4.0 10.0 0.0% 0 741ms 488 69 0
Qwen3.6 Flash 4.8 9.9 0.0% 0 9.88s 516 140 5,445
指示追従 スコア 一貫性 試行ごとの合格率 不安定なテスト 正解テスト 応答時間(平均) 入力トークン 出力トークン 推論トークン
Gemini 3.1 Flash Lite Preview 10.0 10.0 100.0% 0 1.13s 623 574 0
Qwen3.6 Flash 10.0 10.0 100.0% 0 6.05s 699 102 7,423
パズル解決 スコア 一貫性 試行ごとの合格率 不安定なテスト 正解テスト 応答時間(平均) 入力トークン 出力トークン 推論トークン
Gemini 3.1 Flash Lite Preview 10.0 10.0 100.0% 0 900ms 570 1,045 0
Qwen3.6 Flash 8.2 7.2 88.9% 1 6.29s 696 460 10,860
ツール呼び出し スコア 一貫性 試行ごとの合格率 不安定なテスト 正解テスト 応答時間(平均) 入力トークン 出力トークン 推論トークン
Gemini 3.1 Flash Lite Preview 10.0 10.0 100.0% 0 3.39s 5,894 782 0
Qwen3.6 Flash 10.0 10.0 100.0% 0 4.00s 8,193 335 1,188
雑学 スコア 一貫性 試行ごとの合格率 不安定なテスト 正解テスト 応答時間(平均) 入力トークン 出力トークン 推論トークン
Gemini 3.1 Flash Lite Preview 3.0 10.0 0.0% 0 814ms 158 9 0
Qwen3.6 Flash 3.0 10.0 0.0% 0 122.87s 204 26 87,048

クイック比較

比較ペアを切り替え