余分な書式 の失敗
どのAIモデルで 余分な書式 が起きやすいかを確認し、選ぶ前に信頼性のリスクを見極められます。 並び替え: 合計コスト ↓.
67/67
モデルを絞り込む
現在の検索条件とフィルターに一致するモデルはありません。
| 順位 | モデル | 企業 | 余分な書式 件数 | スコア | 合計コスト | 正解テスト | 応答時間(平均) |
|---|---|---|---|---|---|---|---|
| #95 | Qwen3.5-27B medium | Qwen | 1 | 7.5 | $0.982 | 13/22 | 113.3s |
| #132 | Grok 4.20 medium | X AI | 2 | 7.0 | $0.805 | 11/22 | 32.6s |
| #126 | Grok 4.3 medium | X AI | 1 | 7.0 | $0.741 | 12/22 | 44.2s |
| #129 | GLM 5.1 medium | Z.ai | 1 | 7.0 | $0.727 | 12/22 | 58.8s |
| #204 | Mimo V2 Omni medium | Xiaomi | 1 | 5.9 | $0.683 | 10/21 | 41.2s |
| #108 | Claude Sonnet 4.6 none | Anthropic | 4 | 7.3 | $0.661 | 12/22 | 7.67s |
| #181 | Claude Sonnet 5 none | Anthropic | 4 | 6.1 | $0.548 | 7/22 | 6.05s |
| #109 | GLM 5.3 high | Z.ai | 2 | 7.3 | $0.403 | 13/22 | 27.8s |
| #176 | Mimo V2 PRO medium | Xiaomi | 1 | 6.3 | $0.333 | 12/21 | 22.2s |
| #92 | MiniMax M3 medium | Minimax | 1 | 7.5 | $0.300 | 11/22 | 75.2s |
| #145 | DeepSeek V4 Pro none | DeepSeek | 1 | 6.8 | $0.226 | 9/22 | 11.7s |
| #147 | MiMo-V2.5-Pro medium | Xiaomi | 3 | 6.8 | $0.221 | 11/22 | 48.7s |
| #243 | Seed-2.0-Code none | Bytedance Seed | 2 | 5.3 | $0.151 | 6/22 | 14.7s |
| #248 | Inkling none | Thinkingmachines | 1 | 5.2 | $0.147 | 6/22 | 3.47s |
| #227 | Nemotron 3.5 Lightning high | NVIDIA | 1 | 5.6 | $0.134 | 5/22 | 58.3s |