AI BENCHY カテゴリ
雑学 ランキング
雑学 でどのAIモデルが最も強いか、どのモデルが安定しているか、差が大きいのはどこかを確認できます。 並び替え: 応答時間(平均) ↓.
169/169
モデルを絞り込む
現在の検索条件とフィルターに一致するモデルはありません。
| 順位 | モデル | 企業 | 雑学 スコア | スコア | 合計コスト | 正解テスト | 応答時間(平均) |
|---|---|---|---|---|---|---|---|
| #65 | Kimi K2.7 Code medium | Moonshot AI | 3.0 | 7.0 | $0.583 | 0/1 | 341.8s |
| #107 | North Mini Code medium | Cohere | 3.0 | 5.8 | $0.000 | 0/1 | 305.0s |
| #73 | Mimo V2 Omni medium | Xiaomi | 3.0 | 6.8 | $0.683 | 0/1 | 234.2s |
| #59 | Gemma 4 26B A4B medium | 3.0 | 7.2 | $0.045 | 0/1 | 180.9s | |
| #89 | Qwen3.5-35B-A3B medium | Qwen | 3.0 | 6.3 | $0.401 | 0/1 | 177.4s |
| #165 | Qwen3.5-9B medium | Qwen | 3.0 | 3.8 | $0.036 | 0/1 | 177.0s |
| #63 | Step 3.7 Flash high | Stepfun | 3.0 | 7.1 | $1.148 | 0/1 | 149.3s |
| #144 | Ring-2.6-1T none | Inclusionai | 3.0 | 4.8 | $0.026 | 0/1 | 133.6s |
| #35 | Kimi K2.6 medium | Moonshot AI | 3.0 | 7.8 | $0.889 | 0/1 | 130.3s |
| #39 | Step 3.7 Flash low | Stepfun | 3.0 | 7.7 | $0.341 | 0/1 | 124.8s |
| #47 | Qwen3.6 Flash medium | Qwen | 3.0 | 7.5 | $0.288 | 0/1 | 122.9s |
| #168 | Step 3.5 Flash none | Stepfun | 3.0 | 2.6 | $0.020 | 0/1 | 114.1s |
| #20 | Step 3.7 Flash medium | Stepfun | 3.0 | 8.5 | $0.376 | 0/1 | 114.0s |
| #72 | Ring-2.6-1T medium | Inclusionai | 3.0 | 6.8 | $0.033 | 0/1 | 113.9s |
| #80 | Step 3.5 Flash medium | Stepfun | 3.0 | 6.6 | $0.070 | 0/1 | 108.4s |