AI BENCHY
Advertise here

AI BENCHY 分类

数据解析与提取 排名

看看哪些 AI 模型在 数据解析与提取 上表现最好,哪些更稳定,以及差距主要出现在哪里。 排序方式: 测试正确 ↑.

显示的模型数

15

数据解析与提取 得分 平均值

8.7

最佳模型

MiMo-V2.5 2.7
排名 模型 公司 数据解析与提取 得分 分数 测试正确 响应时间(平均)
#67 MiniMax M3 medium Minimax 10.0 7.1 2/2 14.9s
#69 Claude Opus 4.6 medium Anthropic 10.0 7.0 2/2 7.37s
#70 GPT-5.4 Nano medium OpenAI 10.0 7.0 2/2 2.54s
#71 Step 3.7 Flash high Stepfun 10.0 7.0 2/2 14.7s
#72 DeepSeek V3.2 medium DeepSeek 10.0 7.0 2/2 36.1s
#73 Seed-2.0-Mini medium Bytedance Seed 10.0 6.9 2/2 24.3s
#74 Qwen3.6 Max Preview none Qwen 10.0 6.9 2/2 2.87s
#76 Kimi K2.5 medium Moonshot AI 10.0 6.8 2/2 49.8s
#77 Claude Sonnet 4.6 none Anthropic 10.0 6.8 2/2 3.43s
#79 Hunter Alpha medium OpenRouter 10.0 6.7 2/2 23.2s
#80 Mimo V2 Omni medium Xiaomi 10.0 6.7 2/2 3.04s
#84 Grok 4.20 Multi Agent Beta medium X AI 10.0 6.6 2/2 5.54s
#85 Gemma 4 31B none Google 10.0 6.5 2/2 2.25s
#86 Grok 4.1 Fast medium X AI 10.0 6.5 2/2 6.63s
#87 Gemini 3.1 Flash Lite minimal Google 10.0 6.4 2/2 1.04s

按 数据解析与提取 得分 排名的顶级模型

数据解析与提取 得分 vs 总成本

按 响应时间(平均) 排名的顶级模型