ナビゲーション
AI BENCHY
Advertise here

AI BENCHY Compare

MiniMax: MiniMax M2.7 vs Qwen: Qwen3.5 Plus 2026-02-15

概要

MiniMax M2.7 vs Qwen3.5 Plus 2026-02-15 の benchmark 比較: Qwen3.5 Plus 2026-02-15 が平均スコアでリードし、5.8 vs 5.2 です。 Qwen3.5 Plus 2026-02-15 の benchmark コストが低く、$0.016 vs $0.104 です。 Qwen3.5 Plus 2026-02-15 の方が高速で、2.31s vs 38.18s です、成功率は 46.0% vs 46.0% です。

おすすめモデル: Qwen3.5 Plus 2026-02-15 - ここでは最高スコア(5.8)で、MiniMax M2.7 より約 6.6 倍低コストです。

ベンチマークは AI BENCHY テストスイートから次の日時に生成: 2026-06-12

指標 MiniMax M2.7 MiniMax M2.7 medium リリース: 2026-03-18 Qwen3.5 Plus 2026-02-15 Qwen3.5 Plus 2026-02-15 none リリース: 2026-02-15
スコア 5.2 5.8
順位 #134 #111
信頼性 10.0 10.0
一貫性 6.8 9.4
正解テスト
試行ごとの合格率 46.0% 46.0%
不安定なテスト 8 2
総実行回数 63 63
結果あたりのコスト 2.494 0.204
合計コスト $0.104 $0.016
入力価格 $0.250 / 1M $0.260 / 1M
出力価格 $1.000 / 1M $1.560 / 1M
合計入力トークン 34,371 45,864
出力トークン 8,981 2,480
推論トークン 89,812 0
応答時間(平均) 38.18s 2.31s
応答時間(最大) 196.21s 6.65s
応答時間(合計) 763.60s 34.63s

Generation showcase

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#134 MiniMax M2.7

medium
Cost
$0.022
Time
22.8s
Tokens
9,250 tok

#111 Qwen3.5 Plus 2026-02-15

none
Cost
$0.012
Time
153.2s
Tokens
7,787 tok

スコア上位モデル

スコア vs 総コスト

応答時間(平均)

スコア vs 応答時間(平均)

合計出力トークン

スコア vs 合計出力トークン

カテゴリ内訳

反AIトリック スコア 一貫性 試行ごとの合格率 不安定なテスト 正解テスト 応答時間(平均) 入力トークン 出力トークン 推論トークン
MiniMax M2.7 7.9 6.3 83.3% 2 40.32s 654 3,010 17,716
Qwen3.5 Plus 2026-02-15 4.8 10.0 25.0% 0 1.91s 696 517 0
コーディング スコア 一貫性 試行ごとの合格率 不安定なテスト 正解テスト 応答時間(平均) 入力トークン 出力トークン 推論トークン
MiniMax M2.7 5.7 9.1 33.3% 0 101.89s 2,961 1,231 38,841
Qwen3.5 Plus 2026-02-15 4.3 7.9 11.1% 1 2.05s 7,913 473 0
複合 スコア 一貫性 試行ごとの合格率 不安定なテスト 正解テスト 応答時間(平均) 入力トークン 出力トークン 推論トークン
MiniMax M2.7 4.7 1.6 66.7% 1 41.03s 14,233 369 4,480
Qwen3.5 Plus 2026-02-15 3.0 10.0 0.0% 0 6.65s 18,304 314 0
データ解析と抽出 スコア 一貫性 試行ごとの合格率 不安定なテスト 正解テスト 応答時間(平均) 入力トークン 出力トークン 推論トークン
MiniMax M2.7 6.3 5.8 66.7% 1 21.95s 7,152 187 5,882
Qwen3.5 Plus 2026-02-15 10.0 10.0 100.0% 0 1.89s 7,794 243 0
ドメイン特化 スコア 一貫性 試行ごとの合格率 不安定なテスト 正解テスト 応答時間(平均) 入力トークン 出力トークン 推論トークン
MiniMax M2.7 3.0 10.0 0.0% 0 19.00s 245 8 2,796
Qwen3.5 Plus 2026-02-15 5.3 10.0 33.3% 0 1.17s 789 17 0
汎用知能 スコア 一貫性 試行ごとの合格率 不安定なテスト 正解テスト 応答時間(平均) 入力トークン 出力トークン 推論トークン
MiniMax M2.7 3.9 2.5 33.3% 1 38.70s 486 92 5,204
Qwen3.5 Plus 2026-02-15 4.4 3.0 33.3% 1 2.26s 522 117 0
指示追従 スコア 一貫性 試行ごとの合格率 不安定なテスト 正解テスト 応答時間(平均) 入力トークン 出力トークン 推論トークン
MiniMax M2.7 3.8 5.8 33.3% 1 12.80s 687 350 2,600
Qwen3.5 Plus 2026-02-15 10.0 10.0 100.0% 0 1.67s 711 72 0
パズル解決 スコア 一貫性 試行ごとの合格率 不安定なテスト 正解テスト 応答時間(平均) 入力トークン 出力トークン 推論トークン
MiniMax M2.7 5.9 7.2 55.6% 1 24.87s 675 362 7,840
Qwen3.5 Plus 2026-02-15 7.7 10.0 66.7% 0 2.71s 714 494 0
ツール呼び出し スコア 一貫性 試行ごとの合格率 不安定なテスト 正解テスト 応答時間(平均) 入力トークン 出力トークン 推論トークン
MiniMax M2.7 4.7 1.6 66.7% 1 12.05s 7,067 304 1,001
Qwen3.5 Plus 2026-02-15 10.0 10.0 100.0% 0 3.33s 8,211 222 0
雑学 スコア 一貫性 試行ごとの合格率 不安定なテスト 正解テスト 応答時間(平均) 入力トークン 出力トークン 推論トークン
MiniMax M2.7 3.0 10.0 0.0% 0 22.77s 211 3,068 3,452
Qwen3.5 Plus 2026-02-15 3.0 10.0 0.0% 0 1.11s 210 11 0

クイック比較

比較ペアを切り替え