谜题求解 排名
看看哪些 AI 模型在 谜题求解 上表现最好,哪些更稳定,以及差距主要出现在哪里。
311/311
筛选模型
没有模型匹配当前搜索和筛选条件。
| 排名 | 模型 | 公司 | 谜题求解 得分 | 分数 | 总成本 | 测试正确 | 响应时间(平均) |
|---|---|---|---|---|---|---|---|
| #203 | Dots 3 Note Preview medium | Dots Studio | 5.3 | 5.9 | $0.000 | 1/3 | 8.71s |
| #214 | Inkling Small low | Thinkingmachines | 5.3 | 5.7 | $0.055 | 1/3 | 1.56s |
| #222 | Owl Alpha medium | Openrouter | 5.3 | 5.6 | $0.000 | 1/3 | 3.40s |
| #229 | Qwen3.6 27B none | Qwen | 5.3 | 5.5 | $0.116 | 1/3 | 5.15s |
| #284 | MiniMax M2.5 medium | Minimax | 5.3 | 4.6 | $0.327 | 1/3 | 11.2s |
| #189 | Trinity Large Thinking medium | Arcee AI | 5.2 | 6.1 | $0.756 | 0/3 | 2.90s |
| #50 | Inkling Small high | Thinkingmachines | 4.8 | 8.4 | $0.398 | 0/3 | 14.4s |
| #272 | Trinity Large Thinking high | Arcee AI | 4.7 | 4.8 | $0.592 | 0/3 | 3.84s |
| #268 | Hy4 preview none | Tencent | 4.6 | 4.8 | $0.041 | 0/3 | 24.1s |
| #250 | Nemotron 3.5 Lightning medium | NVIDIA | 4.2 | 5.1 | $0.156 | 0/3 | 10.5s |
| #288 | Elephant Alpha none | Openrouter | 4.2 | 4.3 | $0.000 | 0/3 | 807ms |
| #90 | GPT-5.4 Nano medium | OpenAI | 4.1 | 7.5 | $0.142 | 0/3 | 3.79s |
| #172 | LongCat 2.0 none | Meituan | 4.0 | 6.4 | $0.044 | 0/3 | 2.74s |
| #218 | Qwen3.5-122B-A10B none | Qwen | 3.8 | 5.7 | $0.283 | 0/3 | 1.00s |
| #311 | LFM2-24B-A2B none | Liquid | 3.8 | 2.2 | $0.001 | 0/3 | 1.78s |