エージェントタスク ランキング
エージェントタスク でどのAIモデルが最も強いか、どのモデルが安定しているか、差が大きいのはどこかを確認できます。 並び替え: 合計コスト ↓.
380/380
モデルを絞り込む
現在の検索条件とフィルターに一致するモデルはありません。
| 順位 | モデル | 企業 | エージェントタスク スコア | スコア | 合計コスト | 正解テスト | 応答時間(平均) |
|---|---|---|---|---|---|---|---|
| #370 | Laguna Xs.2 none | Poolside | 0.0 | 3.1 | $0.004 | 0/0 | 0ms |
| #331 | Ring 2.6 1t none | Inclusionai | 3.0 | 4.5 | $0.004 | 0/1 | 19ms |
| #375 | Jev 1.13 none | Typesafe | 0.0 | 2.6 | $0.003 | 0/0 | 0ms |
| #376 | Kev 4B none | Jaredpalmer | 0.0 | 2.4 | $0.002 | 0/0 | 0ms |
| #329 | Ling 2.6 Flash none | Inclusionai | 3.0 | 4.5 | $0.002 | 0/1 | 32ms |
| #335 | Trinity Large Preview none | Arcee AI | 3.0 | 4.4 | $0.001 | 0/1 | 88ms |
| #379 | LFM2-24B-A2B none | Liquid | 0.0 | 1.8 | $0.001 | 0/0 | 0ms |
| #117 | Space Bunny Alpha high | Stealth | 10.0 | 7.5 | $0.000 | 1/1 | 73.4s |
| #173 | Space Bunny Alpha max | Stealth | 6.1 | 6.7 | $0.000 | 0/1 | 90.6s |
| #210 | Dots 3 Note Preview high | Dots Studio | 6.1 | 6.4 | $0.000 | 0/1 | 129.1s |
| #211 | Dots 3 Note Preview low | Dots Studio | 6.1 | 6.4 | $0.000 | 0/1 | 161.2s |
| #221 | Space Bunny Alpha medium | Stealth | 6.1 | 6.3 | $0.000 | 0/1 | 153.1s |
| #226 | Space Bunny Alpha xhigh | Stealth | 5.2 | 6.2 | $0.000 | 0/1 | 159.1s |
| #251 | Ling 3.0 Flash high | Inclusionai | 3.0 | 5.8 | $0.000 | 0/1 | 42ms |
| #257 | Dots 3 Note Preview medium | Dots Studio | 4.7 | 5.7 | $0.000 | 0/1 | 140.5s |