- 排名
- #232
- 总输出令牌
- 1,033,971
- 响应时间(平均)
- 84.01s
- 总成本
- $0.820
Trinity Large Thinking (medium) vs Inkling
平均分几乎持平,为 6.1 vs 6.1。 Inkling benchmark 成本更低,为 $0.304 vs $0.820。 Inkling 更快,为 5.30s vs 84.01s,通过率为 49.3% vs 31.9%。
已对比模型
- 排名
- #233
- 总输出令牌
- 16,536
- 响应时间(平均)
- 5.30s
- 总成本
- $0.304
推荐模型
Inkling
它在这里得分最高(6.1),同时成本比Trinity Large Thinking (medium)低约 2.7 倍。
详细对比
| 指标 | Trinity Large Thinking Trinity Large Thinking medium | Inkling Inkling none 免费可用 |
|---|---|---|
| 分数 | 6.1 | 6.1 |
| 排名 | #232 | #233 |
| 可靠性 | 10.0 | 10.0 |
| 一致性 | 7.7 | 9.6 |
| 尝试次数 | 69/69 | 69/69 |
| 测试正确 | ||
| 尝试通过率 | 49.3% | 31.9% |
| 不稳定测试 | 7 | 1 |
| 总运行次数 | 69 | 69 |
| 每个结果成本 | 10.772 | 4.337 |
| 总成本 | $0.820 | $0.304 |
| 输入价格 | $0.250 / 1M | $1.000 / 1M |
| 输出价格 | $0.800 / 1M | $4.050 / 1M |
| 总输入令牌 | 319,352 | 236,599 |
| 输出令牌 | 158,447 | 16,536 |
| 推理令牌 | 875,524 | 0 |
| 响应时间(平均) | 84.01s | 5.30s |
| 响应时间(最大) | 525.14s | 48.02s |
| 响应时间(总计) | 1932.24s | 121.91s |
| 参数量 | 398B 总计 (13B 激活) | 975B 总计 (41B 激活) |
| 开放状态 | 权重可用 | 开源 |
模型生成展示
Hamster playing table tennis
Prompt: Create a detailed SVG illustration of a hamster playing table tennis.
#232 Trinity Large Thinking
medium- 成本
- $0.016
- 时间
- 75.9s
- 令牌
- 19,401 tok
#233 Thinking Machines: Inkling
none
Provider returned error
- 成本
- $0.000
- 时间
- 5.3s
- 令牌
- 0 tok
按分数排名的模型
分数 vs 总成本
响应时间(平均)
分数 vs 响应时间(平均)
总输出令牌
分数 vs 总输出令牌
类别细分
| 智能体任务 | 分数 | 一致性 | 尝试通过率 | 不稳定测试 | 测试正确 | 响应时间(平均) | 输入令牌 | 输出令牌 | 推理令牌 |
|---|---|---|---|---|---|---|---|---|---|
| Trinity Large Thinking | 6.1 | 3.1 | 66.7% | 1 | 52.50s | 200,866 | 2,281 | 14,905 | |
| Inkling | 10.0 | 10.0 | 100.0% | 0 | 45.64s | 132,479 | 5,982 | 0 |
| 反AI技巧 | 分数 | 一致性 | 尝试通过率 | 不稳定测试 | 测试正确 | 响应时间(平均) | 输入令牌 | 输出令牌 | 推理令牌 |
|---|---|---|---|---|---|---|---|---|---|
| Trinity Large Thinking | 6.8 | 9.8 | 50.0% | 0 | 5.11s | 663 | 1,531 | 6,078 | |
| Inkling | 4.8 | 10.0 | 25.0% | 0 | 1.43s | 678 | 261 | 0 |
| 编程 | 分数 | 一致性 | 尝试通过率 | 不稳定测试 | 测试正确 | 响应时间(平均) | 输入令牌 | 输出令牌 | 推理令牌 |
|---|---|---|---|---|---|---|---|---|---|
| Trinity Large Thinking | 7.5 | 10.0 | 66.7% | 0 | 179.02s | 7,248 | 7,413 | 351,155 | |
| Inkling | 4.5 | 10.0 | 0.0% | 0 | 1.01s | 7,356 | 436 | 0 |
| 综合 | 分数 | 一致性 | 尝试通过率 | 不稳定测试 | 测试正确 | 响应时间(平均) | 输入令牌 | 输出令牌 | 推理令牌 |
|---|---|---|---|---|---|---|---|---|---|
| Trinity Large Thinking | 2.9 | 6.0 | 16.7% | 1 | 382.70s | 93,292 | 35,814 | 269,745 | |
| Inkling | 2.9 | 5.8 | 16.7% | 1 | 25.74s | 80,195 | 8,777 | 0 |
| 数据解析与提取 | 分数 | 一致性 | 尝试通过率 | 不稳定测试 | 测试正确 | 响应时间(平均) | 输入令牌 | 输出令牌 | 推理令牌 |
|---|---|---|---|---|---|---|---|---|---|
| Trinity Large Thinking | 6.3 | 5.8 | 66.7% | 1 | 16.38s | 6,906 | 475 | 11,153 | |
| Inkling | 10.0 | 10.0 | 100.0% | 0 | 1.14s | 7,056 | 279 | 0 |
| 领域专项 | 分数 | 一致性 | 尝试通过率 | 不稳定测试 | 测试正确 | 响应时间(平均) | 输入令牌 | 输出令牌 | 推理令牌 |
|---|---|---|---|---|---|---|---|---|---|
| Trinity Large Thinking | 5.3 | 7.2 | 44.4% | 1 | 124.17s | 756 | 99,334 | 172,018 | |
| Inkling | 5.3 | 10.0 | 33.3% | 0 | 1.18s | 786 | 45 | 0 |
| 通用智能 | 分数 | 一致性 | 尝试通过率 | 不稳定测试 | 测试正确 | 响应时间(平均) | 输入令牌 | 输出令牌 | 推理令牌 |
|---|---|---|---|---|---|---|---|---|---|
| Trinity Large Thinking | 10.0 | 10.0 | 100.0% | 0 | 32.22s | 501 | 7,035 | 7,774 | |
| Inkling | 5.0 | 10.0 | 0.0% | 0 | 859ms | 495 | 156 | 0 |
| 指令遵循 | 分数 | 一致性 | 尝试通过率 | 不稳定测试 | 测试正确 | 响应时间(平均) | 输入令牌 | 输出令牌 | 推理令牌 |
|---|---|---|---|---|---|---|---|---|---|
| Trinity Large Thinking | 4.4 | 6.9 | 16.7% | 1 | 3.99s | 684 | 77 | 3,798 | |
| Inkling | 6.3 | 10.0 | 50.0% | 0 | 1.72s | 696 | 72 | 0 |
| 谜题求解 | 分数 | 一致性 | 尝试通过率 | 不稳定测试 | 测试正确 | 响应时间(平均) | 输入令牌 | 输出令牌 | 推理令牌 |
|---|---|---|---|---|---|---|---|---|---|
| Trinity Large Thinking | 5.2 | 5.4 | 44.5% | 2 | 2.90s | 678 | 2,508 | 3,231 | |
| Inkling | 5.6 | 9.9 | 33.3% | 0 | 931ms | 696 | 291 | 0 |
| 工具调用 | 分数 | 一致性 | 尝试通过率 | 不稳定测试 | 测试正确 | 响应时间(平均) | 输入令牌 | 输出令牌 | 推理令牌 |
|---|---|---|---|---|---|---|---|---|---|
| Trinity Large Thinking | 10.0 | 10.0 | 100.0% | 0 | 5.26s | 7,551 | 299 | 1,372 | |
| Inkling | 3.0 | 10.0 | 0.0% | 0 | 2.50s | 5,949 | 213 | 0 |
| 常识问答 | 分数 | 一致性 | 尝试通过率 | 不稳定测试 | 测试正确 | 响应时间(平均) | 输入令牌 | 输出令牌 | 推理令牌 |
|---|---|---|---|---|---|---|---|---|---|
| Trinity Large Thinking | 3.0 | 10.0 | 0.0% | 0 | 97.44s | 207 | 1,680 | 34,295 | |
| Inkling | 3.0 | 10.0 | 0.0% | 0 | 670ms | 213 | 24 | 0 |
快速对比
切换对比组合
Trinity Large ThinkingmediumvsQwen3.5 Plus 2026-04-20noneGranite 4.2 8BmediumvsInklingnone免费可用Trinity Large ThinkingmediumvsGemini 3.5 FlashnoneTrinity Large ThinkingmediumvsKAT-Coder-Pro V2.5noneClaude Fable 5.1lowvsTrinity Large ThinkingmediumClaude Fable 5.1lowvsInklingnone免费可用Trinity Large ThinkingmediumvsGemini 3.1 Flash Lite PreviewnoneTrinity Large ThinkingmediumvsDeepSeek V4 Flash 0731noneInklingnone免费可用vsGLM 5.3 FlashXlowTrinity Large ThinkingmediumvsGLM 5.3 FlashXlowTrinity Large ThinkingmediumvsSpace Bunny AlphaxhighTrinity Large ThinkingmediumvsMiMo-V2.6-Pronone