- 順位
- #10
- 合計出力トークン
- 97,958
- 応答時間(平均)
- 21.47s
- 合計コスト
- $1.361
Gemini 3.1 Pro Preview (medium) vs Qwen3.7 Max
Gemini 3.1 Pro Preview (medium) が平均スコアでリードし、9.2 vs 7.4 です。 Qwen3.7 Max の benchmark コストが低く、$0.197 vs $1.361 です。 Qwen3.7 Max の方が高速で、4.52s vs 21.47s です、成功率は 90.9% vs 68.2% です。
おすすめモデル
Qwen3.7 Max
総合的に最も良い選択です。競争力のあるスコア(7.4)、Gemini 3.1 Pro Preview (medium) より低いコスト、バランスの取れた応答時間があります。
- スコア
- 9.2 7.4
- 合計コスト
- $1.361 $0.197
- 応答時間(平均)
- 21.47s 4.52s
- 試行ごとの合格率
- 90.9% 68.2%
比較の概要
- 順位
- #67
- 合計出力トークン
- 12,446
- 応答時間(平均)
- 4.52s
- 合計コスト
- $0.197
詳細比較
| 指標 | Gemini 3.1 Pro Preview Gemini 3.1 Pro Preview medium | Qwen3.7 Max Qwen3.7 Max none |
|---|---|---|
| スコア | 9.2 | 7.4 |
| 順位 | #10 | #67 |
| 信頼性 | 10.0 | 9.9 |
| 一貫性 | 10.0 | 10.0 |
| 正解テスト | ||
| 試行ごとの合格率 | 90.9% | 68.2% |
| 不安定なテスト | 0 | 0 |
| 総実行回数 | 66 | 66 |
| 結果あたりのコスト | 6.801 | 1.582 |
| 合計コスト | $1.361 | $0.197 |
| 入力価格 | $2.000 / 1M | $1.475 / 1M |
| 出力価格 | $12.000 / 1M | $4.425 / 1M |
| 合計入力トークン | 92,287 | 95,983 |
| 出力トークン | 5,232 | 12,446 |
| 推論トークン | 92,726 | 0 |
| 応答時間(平均) | 21.47s | 4.52s |
| 応答時間(最大) | 88.68s | 72.30s |
| 応答時間(合計) | 322.08s | 99.52s |
Hamster playing table tennis
Prompt: Create a detailed SVG illustration of a hamster playing table tennis.
#10 Gemini 3.1 Pro Preview
medium- コスト
- $0.115
- 時間
- 87.2s
- トークン
- 9,629 tok
#67 Qwen3.7 Max
none- コスト
- $0.046
- 時間
- 195.0s
- トークン
- 12,171 tok
スコア上位モデル
スコア vs 総コスト
応答時間(平均)
スコア vs 応答時間(平均)
合計出力トークン
スコア vs 合計出力トークン
カテゴリ内訳
| 反AIトリック | スコア | 一貫性 | 試行ごとの合格率 | 不安定なテスト | 正解テスト | 応答時間(平均) | 入力トークン | 出力トークン | 推論トークン |
|---|---|---|---|---|---|---|---|---|---|
| Gemini 3.1 Pro Preview | 10.0 | 10.0 | 100.0% | 0 | 7.90s | 498 | 112 | 3,218 | |
| Qwen3.7 Max | 6.5 | 10.0 | 50.0% | 0 | 1.08s | 696 | 242 | 0 |
| コーディング | スコア | 一貫性 | 試行ごとの合格率 | 不安定なテスト | 正解テスト | 応答時間(平均) | 入力トークン | 出力トークン | 推論トークン |
|---|---|---|---|---|---|---|---|---|---|
| Gemini 3.1 Pro Preview | 7.9 | 9.9 | 66.7% | 0 | 40.17s | 8,124 | 435 | 41,247 | |
| Qwen3.7 Max | 5.5 | 10.0 | 33.3% | 0 | 1.35s | 7,911 | 582 | 0 |
| 複合 | スコア | 一貫性 | 試行ごとの合格率 | 不安定なテスト | 正解テスト | 応答時間(平均) | 入力トークン | 出力トークン | 推論トークン |
|---|---|---|---|---|---|---|---|---|---|
| Gemini 3.1 Pro Preview | 9.8 | 10.0 | 100.0% | 0 | 40.39s | 67,910 | 3,687 | 23,111 | |
| Qwen3.7 Max | 6.5 | 10.0 | 50.0% | 0 | 37.23s | 68,425 | 10,623 | 0 |
| データ解析と抽出 | スコア | 一貫性 | 試行ごとの合格率 | 不安定なテスト | 正解テスト | 応答時間(平均) | 入力トークン | 出力トークン | 推論トークン |
|---|---|---|---|---|---|---|---|---|---|
| Gemini 3.1 Pro Preview | 10.0 | 10.0 | 100.0% | 0 | 7.72s | 7,265 | 279 | 3,904 | |
| Qwen3.7 Max | 10.0 | 10.0 | 100.0% | 0 | 1.35s | 7,794 | 243 | 0 |
| ドメイン特化 | スコア | 一貫性 | 試行ごとの合格率 | 不安定なテスト | 正解テスト | 応答時間(平均) | 入力トークン | 出力トークン | 推論トークン |
|---|---|---|---|---|---|---|---|---|---|
| Gemini 3.1 Pro Preview | 7.7 | 10.0 | 66.7% | 0 | 32.73s | 635 | 18 | 12,424 | |
| Qwen3.7 Max | 7.7 | 10.0 | 66.7% | 0 | 975ms | 789 | 15 | 0 |
| 汎用知能 | スコア | 一貫性 | 試行ごとの合格率 | 不安定なテスト | 正解テスト | 応答時間(平均) | 入力トークン | 出力トークン | 推論トークン |
|---|---|---|---|---|---|---|---|---|---|
| Gemini 3.1 Pro Preview | 10.0 | 10.0 | 100.0% | 0 | 11.77s | 490 | 108 | 1,179 | |
| Qwen3.7 Max | 10.0 | 10.0 | 100.0% | 0 | 1.04s | 522 | 120 | 0 |
| 指示追従 | スコア | 一貫性 | 試行ごとの合格率 | 不安定なテスト | 正解テスト | 応答時間(平均) | 入力トークン | 出力トークン | 推論トークン |
|---|---|---|---|---|---|---|---|---|---|
| Gemini 3.1 Pro Preview | 10.0 | 10.0 | 100.0% | 0 | 9.56s | 621 | 72 | 2,236 | |
| Qwen3.7 Max | 10.0 | 10.0 | 100.0% | 0 | 943ms | 711 | 72 | 0 |
| パズル解決 | スコア | 一貫性 | 試行ごとの合格率 | 不安定なテスト | 正解テスト | 応答時間(平均) | 入力トークン | 出力トークン | 推論トークン |
|---|---|---|---|---|---|---|---|---|---|
| Gemini 3.1 Pro Preview | 10.0 | 10.0 | 100.0% | 0 | 6.90s | 570 | 235 | 3,128 | |
| Qwen3.7 Max | 10.0 | 10.0 | 100.0% | 0 | 1.13s | 714 | 314 | 0 |
| ツール呼び出し | スコア | 一貫性 | 試行ごとの合格率 | 不安定なテスト | 正解テスト | 応答時間(平均) | 入力トークン | 出力トークン | 推論トークン |
|---|---|---|---|---|---|---|---|---|---|
| Gemini 3.1 Pro Preview | 10.0 | 10.0 | 100.0% | 0 | 23.15s | 6,018 | 274 | 982 | |
| Qwen3.7 Max | 10.0 | 10.0 | 100.0% | 0 | 3.92s | 8,211 | 222 | 0 |
| 雑学 | スコア | 一貫性 | 試行ごとの合格率 | 不安定なテスト | 正解テスト | 応答時間(平均) | 入力トークン | 出力トークン | 推論トークン |
|---|---|---|---|---|---|---|---|---|---|
| Gemini 3.1 Pro Preview | 10.0 | 10.0 | 100.0% | 0 | 6.27s | 156 | 12 | 1,297 | |
| Qwen3.7 Max | 3.0 | 10.0 | 0.0% | 0 | 856ms | 210 | 13 | 0 |
クイック比較
比較ペアを切り替え
Claude Opus 5highvsGemini 3.1 Pro PreviewmediumLongCat 2.0mediumvsQwen3.7 MaxnoneGPT-5.4 MinimediumvsQwen3.7 MaxnoneGPT-5.6 TerralowvsQwen3.7 MaxnoneGemini 3 Flash PreviewlowvsQwen3.7 MaxnoneKAT-Coder-Pro V2.5lowvsQwen3.7 MaxnoneGPT-5.4 NanomediumvsQwen3.7 MaxnoneGemini 3.1 Pro PreviewmediumvsGPT-5.5lowKimi K2.7 CodemediumvsQwen3.7 MaxnoneNemotron 3 Ultramedium無料で利用可能vsQwen3.7 MaxnoneGemini 3.1 Pro PreviewmediumvsGPT-5.6 SolhighGemini 3.1 Flash Lite PreviewmediumvsQwen3.7 Maxnone