ナビゲーション
AI BENCHY
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

AI BENCHY Compare

OpenAI: GPT-4o-mini vs Xiaomi: MiMo-V2.5-Pro

概要

GPT-4o-mini vs MiMo-V2.5-Pro の benchmark 比較: MiMo-V2.5-Pro が平均スコアでリードし、5.5 vs 5.0 です。 GPT-4o-mini の benchmark コストが低く、$0.006 vs $0.017 です。 GPT-4o-mini の方が高速で、1.77s vs 1.78s です、成功率は 23.8% vs 39.7% です。

おすすめモデル: MiMo-V2.5-Pro - この比較で最も高いスコア(5.5)を出し、全 2 モデルの中でコストと応答時間のバランスも最良です。

ベンチマークは AI BENCHY テストスイートから次の日時に生成: 2026-07-02

指標 GPT-4o-mini GPT-4o-mini none リリース: 2024-07-18 MiMo-V2.5-Pro MiMo-V2.5-Pro none リリース: 2026-04-22
スコア 5.0 5.5
順位 #144 #123
信頼性 10.0 10.0
一貫性 9.9 8.6
正解テスト
試行ごとの合格率 23.8% 39.7%
不安定なテスト 0 4
総実行回数 63 63
結果あたりのコスト 0.119 0.648
合計コスト $0.006 $0.017
入力価格 $0.150 / 1M $0.435 / 1M
出力価格 $0.600 / 1M $0.870 / 1M
合計入力トークン 31,518 30,724
出力トークン 1,982 3,043
推論トークン 0 0
応答時間(平均) 1.77s 1.78s
応答時間(最大) 7.58s 8.32s
応答時間(合計) 24.80s 37.42s

生成ショーケース

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#144 GPT-4o-mini

none
コスト
$0.001
時間
6.6s
トークン
742 tok

#123 MiMo-V2.5-Pro

none
コスト
$0.004
時間
46.4s
トークン
4,025 tok

スコア上位モデル

スコア vs 総コスト

応答時間(平均)

スコア vs 応答時間(平均)

合計出力トークン

スコア vs 合計出力トークン

カテゴリ内訳

反AIトリック スコア 一貫性 試行ごとの合格率 不安定なテスト 正解テスト 応答時間(平均) 入力トークン 出力トークン 推論トークン
GPT-4o-mini 4.8 10.0 25.0% 0 1.34s 618 186 0
MiMo-V2.5-Pro 3.3 8.1 8.3% 1 2.67s 645 994 0
コーディング スコア 一貫性 試行ごとの合格率 不安定なテスト 正解テスト 応答時間(平均) 入力トークン 出力トークン 推論トークン
GPT-4o-mini 3.2 9.6 0.0% 0 1.63s 7,314 367 0
MiMo-V2.5-Pro 4.3 7.8 22.2% 1 1.41s 6,559 485 0
複合 スコア 一貫性 試行ごとの合格率 不安定なテスト 正解テスト 応答時間(平均) 入力トークン 出力トークン 推論トークン
GPT-4o-mini 3.0 10.0 0.0% 0 7.58s 8,298 568 0
MiMo-V2.5-Pro 3.0 10.0 0.0% 0 3.54s 4,695 596 0
データ解析と抽出 スコア 一貫性 試行ごとの合格率 不安定なテスト 正解テスト 応答時間(平均) 入力トークン 出力トークン 推論トークン
GPT-4o-mini 10.0 10.0 100.0% 0 1.27s 7,161 183 0
MiMo-V2.5-Pro 10.0 10.0 100.0% 0 1.32s 7,758 249 0
ドメイン特化 スコア 一貫性 試行ごとの合格率 不安定なテスト 正解テスト 応答時間(平均) 入力トークン 出力トークン 推論トークン
GPT-4o-mini 3.0 10.0 0.0% 0 637ms 732 15 0
MiMo-V2.5-Pro 5.3 10.0 33.3% 0 877ms 753 27 0
汎用知能 スコア 一貫性 試行ごとの合格率 不安定なテスト 正解テスト 応答時間(平均) 入力トークン 出力トークン 推論トークン
GPT-4o-mini 4.0 10.0 0.0% 0 909ms 480 66 0
MiMo-V2.5-Pro 4.0 10.0 0.0% 0 2.58s 498 87 0
指示追従 スコア 一貫性 試行ごとの合格率 不安定なテスト 正解テスト 応答時間(平均) 入力トークン 出力トークン 推論トークン
GPT-4o-mini 6.3 10.0 50.0% 0 1.11s 666 69 0
MiMo-V2.5-Pro 6.4 10.0 50.0% 0 1.03s 684 66 0
パズル解決 スコア 一貫性 試行ごとの合格率 不安定なテスト 正解テスト 応答時間(平均) 入力トークン 出力トークン 推論トークン
GPT-4o-mini 3.5 10.0 0.0% 0 1.21s 651 308 0
MiMo-V2.5-Pro 6.7 4.7 77.8% 2 1.30s 678 267 0
ツール呼び出し スコア 一貫性 試行ごとの合格率 不安定なテスト 正解テスト 応答時間(平均) 入力トークン 出力トークン 推論トークン
GPT-4o-mini 10.0 10.0 100.0% 0 2.51s 5,400 205 0
MiMo-V2.5-Pro 10.0 10.0 100.0% 0 3.30s 8,238 258 0
雑学 スコア 一貫性 試行ごとの合格率 不安定なテスト 正解テスト 応答時間(平均) 入力トークン 出力トークン 推論トークン
GPT-4o-mini 3.0 10.0 0.0% 0 794ms 198 15 0
MiMo-V2.5-Pro 3.0 10.0 0.0% 0 1.89s 216 14 0

クイック比較

比較ペアを切り替え