AI BENCHY 失敗分析
API エラー の失敗
どのAIモデルで API エラー が起きやすいかを確認し、選ぶ前に信頼性のリスクを見極められます。
| 順位 | モデル | 企業 | API エラー 件数 | スコア | 正解テスト | 応答時間(平均) |
|---|---|---|---|---|---|---|
| #101 | Mimo V2 Omni none | Xiaomi | 1 | 6.0 | 8/21 | 2.44s |
| #111 | Owl Alpha medium | Openrouter | 1 | 5.7 | 8/21 | 11.9s |
| #113 | DeepSeek V4 Pro none | DeepSeek | 1 | 5.7 | 7/21 | 12.4s |
| #116 | Hunter Alpha none | OpenRouter | 1 | 5.7 | 6/18 | 4.70s |
| #119 | Cobuddy medium | Baidu | 1 | 5.6 | 7/21 | 39.9s |
| #120 | Mimo V2 PRO none | Xiaomi | 1 | 5.6 | 7/21 | 2.27s |
| #130 | MiniMax M2.7 medium | Minimax | 1 | 5.3 | 5/21 | 38.2s |
| #152 | MiMo-V2-Flash none | Xiaomi | 1 | 4.6 | 4/21 | 2.76s |
| #161 | Qwen3.5-9B medium | Qwen | 1 | 4.2 | 3/21 | 82.2s |