通用智能 排名
看看哪些 AI 模型在 通用智能 上表现最好,哪些更稳定,以及差距主要出现在哪里。
319/319
筛选模型
没有模型匹配当前搜索和筛选条件。
| 排名 | 模型 | 公司 | 通用智能 得分 | 分数 | 总成本 | 测试正确 | 响应时间(平均) |
|---|---|---|---|---|---|---|---|
| #273 | Mercury 2.5 Preview none | Inception | 5.0 | 4.9 | $0.018 | 0/1 | 482ms |
| #282 | KAT-Coder-Air V2.5 none | Kwaipilot | 5.0 | 4.8 | $0.070 | 0/1 | 12.0s |
| #293 | Laguna S 2.1 none | Poolside | 5.0 | 4.5 | $0.022 | 0/1 | 815ms |
| #294 | Grok 4.20 Beta none | X AI | 5.0 | 4.4 | $0.087 | 0/1 | 541ms |
| #299 | Granite 4.2 8B none | IBM Granite | 5.0 | 4.3 | $0.026 | 0/1 | 770ms |
| #127 | Qwen3.5 Plus 2026-04-20 medium | Qwen | 4.9 | 7.2 | $0.323 | 0/1 | 25.3s |
| #63 | Claude Sonnet 5 medium | Anthropic | 4.8 | 8.2 | $0.922 | 0/1 | 4.32s |
| #99 | GPT-5.6 Terra low | OpenAI | 4.8 | 7.5 | $0.420 | 0/1 | 3.52s |
| #112 | LongCat 2.0 medium | Meituan | 4.8 | 7.4 | $0.499 | 0/1 | 16.4s |
| #150 | Seed-2.0-Code medium | Bytedance Seed | 4.8 | 6.8 | $1.153 | 0/1 | 11.4s |
| #159 | KAT-Coder-Pro V2.5 none | Kwaipilot | 4.8 | 6.7 | $0.487 | 0/1 | 5.16s |
| #148 | Qwen3.6 Flash medium | Qwen | 4.8 | 6.8 | $0.741 | 0/1 | 9.88s |
| #61 | Gemini 2.5 Flash medium | 4.8 | 8.2 | $0.644 | 0/1 | 4.86s | |
| #139 | Mercury 2 medium | Inception | 4.8 | 7.0 | $0.094 | 0/1 | 821ms |
| #200 | Qwen3.5 Plus 2026-04-20 none | Qwen | 4.8 | 6.1 | $0.122 | 0/1 | 1.41s |