API 错误失败排名

看看哪些 AI 模型最常遇到 API 错误，让你在选择前先发现稳定性风险。排序方式: 测试正确 ↑.

显示的模型数

失败总数

163

受影响最多的模型

Nemotron 3 Nano Omni 30b A3b Reasoning 6

分类

在分类编程中46 在分类综合中26 在分类工具调用中17 在分类反AI技巧中15 在分类数据解析与提取中14 在分类常识问答中13 在分类谜题求解中12 在分类通用智能中12 在分类领域专项中7 在分类指令遵循中1

70/70

排名	模型	公司	API 错误次数	分数	总成本	测试正确	响应时间（平均）
#212	Grok Build 0.1 none	X AI	3	4.0	$0.547	7/19	28.7s
总测试数 19 错误测试数 12 总成本 $0.547 响应时间（平均） 28.7s
#152	Owl Alpha medium	Openrouter	1	5.6	$0.000	8/21	11.9s
总测试数 21 错误测试数 13 总成本 $0.000 响应时间（平均） 11.9s
#163	Mimo V2 Omni none	Xiaomi	1	5.5	$0.021	8/21	2.44s
总测试数 21 错误测试数 13 总成本 $0.021 响应时间（平均） 2.44s
#143	North Mini Code medium	Cohere	1	5.9	$0.000	9/22	137.1s
总测试数 22 错误测试数 13 总成本 $0.000 响应时间（平均） 137.1s
#188	Ring-2.6-1T none	Inclusionai	6	4.8	$0.026	9/22	55.1s
总测试数 22 错误测试数 13 总成本 $0.026 响应时间（平均） 55.1s
#190	Grok 4.20 Multi Agent Beta medium	X AI	2	4.8	$5.599	8/18	9.69s
总测试数 18 错误测试数 10 总成本 $5.599 响应时间（平均） 9.69s
#193	Hunter Alpha medium	OpenRouter	1	4.7	$0.000	8/18	10.3s
总测试数 18 错误测试数 10 总成本 $0.000 响应时间（平均） 10.3s
#50	DeepSeek V4 Pro high	DeepSeek	1	7.7	$0.200	10/22	79.1s
总测试数 22 错误测试数 12 总成本 $0.200 响应时间（平均） 79.1s
#96	LongCat 2.0 low	Meituan	1	6.7	$0.391	10/22	100.3s
总测试数 22 错误测试数 12 总成本 $0.391 响应时间（平均） 100.3s
#121	Gemma 4 31B none	Google	2	6.2	$0.021	10/22	5.34s
总测试数 22 错误测试数 12 总成本 $0.021 响应时间（平均） 5.34s
#184	Qwen3.6 Plus Preview medium	Qwen	8	4.9	$0.000	9/19	15.2s
总测试数 19 错误测试数 10 总成本 $0.000 响应时间（平均） 15.2s
#195	Laguna M.1 medium	Poolside	4	4.7	$0.033	9/19	14.7s
总测试数 19 错误测试数 10 总成本 $0.033 响应时间（平均） 14.7s
#140	Mimo V2 Omni medium	Xiaomi	1	5.9	$0.683	10/21	41.2s
总测试数 21 错误测试数 11 总成本 $0.683 响应时间（平均） 41.2s
#159	Hy3 preview low	Tencent	7	5.5	$0.015	10/21	24.6s
总测试数 21 错误测试数 11 总成本 $0.015 响应时间（平均） 24.6s
#66	KAT-Coder-Pro V2.5 low	Kwaipilot	1	7.4	$0.387	11/22	19.5s
总测试数 22 错误测试数 11 总成本 $0.387 响应时间（平均） 19.5s

←

1 2 3 4 5

→

API 错误失败

筛选模型

按 API 错误次数排名的顶级模型

API 错误次数对比分数

按响应时间（平均）排名的顶级模型

API 错误 失败

筛选模型

按 API 错误 次数 排名的顶级模型

API 错误 次数 对比 分数

按 响应时间（平均） 排名的顶级模型

API 错误失败

按 API 错误次数排名的顶级模型

API 错误次数对比分数

按响应时间（平均）排名的顶级模型