- 順位
- #306
- 合計出力トークン
- 2,169
- 応答時間(平均)
- 2.98s
- 合計コスト
- $0.008
Trinity Large Preview vs Mercury 2.5 Preview (low)
Mercury 2.5 Preview (low) が平均スコアでリードし、5.0 vs 4.8 です。 Trinity Large Preview の benchmark コストが低く、$0.008 vs $0.011 です。 Mercury 2.5 Preview (low) の方が高速で、1.31s vs 2.98s です、成功率は 21.2% vs 47.0% です。
比較対象モデル
- 順位
- #290
- 合計出力トークン
- 31,975
- 応答時間(平均)
- 1.31s
- 合計コスト
- $0.011
おすすめモデル
Mercury 2.5 Preview (low)
ここでは最高スコア(5.0)で、Trinity Large Preview より約 2.3 倍速く応答します。
詳細比較
| 指標 | Trinity Large Preview Trinity Large Preview none | Mercury 2.5 Preview Mercury 2.5 Preview low |
|---|---|---|
| スコア | 4.8 | 5.0 |
| 順位 | #306 | #290 |
| 信頼性 | 10.0 | 10.0 |
| 一貫性 | 8.9 | 7.0 |
| 試行回数 | 63/66 | 66/66 |
| 正解テスト | ||
| 試行ごとの合格率 | 21.2% | 47.0% |
| 不安定なテスト | 2 | 8 |
| 総実行回数 | 63 | 66 |
| 結果あたりのコスト | 0.017 | 0.169 |
| 合計コスト | $0.008 | $0.011 |
| 入力価格 | $0.243 / 1M | $0.040 / 1M |
| 出力価格 | $0.243 / 1M | $0.150 / 1M |
| 合計入力トークン | 29,828 | 133,525 |
| 出力トークン | 2,169 | 7,259 |
| 推論トークン | 0 | 24,716 |
| 応答時間(平均) | 2.98s | 1.31s |
| 応答時間(最大) | 14.34s | 7.29s |
| 応答時間(合計) | 56.57s | 28.77s |
| パラメータ | 398B 総数 (13B アクティブ) | ~100B |
| 公開状況 | オープンソース | クローズド |
モデル生成ショーケース
Hamster playing table tennis
Prompt: Create a detailed SVG illustration of a hamster playing table tennis.
#306 Trinity Large Preview
none
No endpoints found for arcee-ai/trinity-large-preview:free.
- コスト
- $0.000
- 時間
- 0.0s
- トークン
- 0 tok
#290 Mercury 2.5 Preview
low- コスト
- $0.001
- 時間
- 1.5s
- トークン
- 1,169 tok
スコア上位モデル
スコア vs 総コスト
応答時間(平均)
スコア vs 応答時間(平均)
合計出力トークン
スコア vs 合計出力トークン
カテゴリ内訳
| 反AIトリック | スコア | 一貫性 | 試行ごとの合格率 | 不安定なテスト | 正解テスト | 応答時間(平均) | 入力トークン | 出力トークン | 推論トークン |
|---|---|---|---|---|---|---|---|---|---|
| Trinity Large Preview | 3.1 | 10.0 | 0.0% | 0 | 2.07s | 651 | 550 | 0 | |
| Mercury 2.5 Preview | 5.6 | 3.8 | 66.7% | 3 | 759ms | 786 | 290 | 3,019 |
| コーディング | スコア | 一貫性 | 試行ごとの合格率 | 不安定なテスト | 正解テスト | 応答時間(平均) | 入力トークン | 出力トークン | 推論トークン |
|---|---|---|---|---|---|---|---|---|---|
| Trinity Large Preview | 3.7 | 7.7 | 11.1% | 1 | 14.34s | 738 | 397 | 0 | |
| Mercury 2.5 Preview | 5.5 | 10.0 | 33.3% | 0 | 972ms | 7,794 | 695 | 2,263 |
| 複合 | スコア | 一貫性 | 試行ごとの合格率 | 不安定なテスト | 正解テスト | 応答時間(平均) | 入力トークン | 出力トークン | 推論トークン |
|---|---|---|---|---|---|---|---|---|---|
| Trinity Large Preview | 1.5 | 5.0 | 0.0% | 0 | 8.91s | 12,053 | 294 | 0 | |
| Mercury 2.5 Preview | 3.0 | 10.0 | 0.0% | 0 | 4.77s | 110,517 | 5,013 | 9,661 |
| データ解析と抽出 | スコア | 一貫性 | 試行ごとの合格率 | 不安定なテスト | 正解テスト | 応答時間(平均) | 入力トークン | 出力トークン | 推論トークン |
|---|---|---|---|---|---|---|---|---|---|
| Trinity Large Preview | 10.0 | 10.0 | 100.0% | 0 | 3.26s | 6,900 | 186 | 0 | |
| Mercury 2.5 Preview | 6.3 | 5.8 | 66.7% | 1 | 1.12s | 8,309 | 611 | 1,521 |
| ドメイン特化 | スコア | 一貫性 | 試行ごとの合格率 | 不安定なテスト | 正解テスト | 応答時間(平均) | 入力トークン | 出力トークン | 推論トークン |
|---|---|---|---|---|---|---|---|---|---|
| Trinity Large Preview | 5.3 | 10.0 | 33.3% | 0 | 877ms | 738 | 25 | 0 | |
| Mercury 2.5 Preview | 4.1 | 4.4 | 44.5% | 2 | 836ms | 849 | 45 | 2,247 |
| 汎用知能 | スコア | 一貫性 | 試行ごとの合格率 | 不安定なテスト | 正解テスト | 応答時間(平均) | 入力トークン | 出力トークン | 推論トークン |
|---|---|---|---|---|---|---|---|---|---|
| Trinity Large Preview | 4.5 | 10.0 | 0.0% | 0 | 873ms | 498 | 104 | 0 | |
| Mercury 2.5 Preview | 5.0 | 10.0 | 0.0% | 0 | 1.05s | 540 | 105 | 749 |
| 指示追従 | スコア | 一貫性 | 試行ごとの合格率 | 不安定なテスト | 正解テスト | 応答時間(平均) | 入力トークン | 出力トークン | 推論トークン |
|---|---|---|---|---|---|---|---|---|---|
| Trinity Large Preview | 3.5 | 10.0 | 0.0% | 0 | 822ms | 678 | 63 | 0 | |
| Mercury 2.5 Preview | 6.3 | 10.0 | 50.0% | 0 | 1.60s | 745 | 99 | 1,492 |
| パズル解決 | スコア | 一貫性 | 試行ごとの合格率 | 不安定なテスト | 正解テスト | 応答時間(平均) | 入力トークン | 出力トークン | 推論トークン |
|---|---|---|---|---|---|---|---|---|---|
| Trinity Large Preview | 3.6 | 7.7 | 11.1% | 1 | 1.97s | 669 | 265 | 0 | |
| Mercury 2.5 Preview | 8.2 | 7.2 | 88.9% | 1 | 710ms | 777 | 312 | 2,271 |
| ツール呼び出し | スコア | 一貫性 | 試行ごとの合格率 | 不安定なテスト | 正解テスト | 応答時間(平均) | 入力トークン | 出力トークン | 推論トークン |
|---|---|---|---|---|---|---|---|---|---|
| Trinity Large Preview | 10.0 | 10.0 | 100.0% | 0 | 6.67s | 6,699 | 267 | 0 | |
| Mercury 2.5 Preview | 2.8 | 1.6 | 33.3% | 1 | 1.57s | 2,983 | 76 | 739 |
| 雑学 | スコア | 一貫性 | 試行ごとの合格率 | 不安定なテスト | 正解テスト | 応答時間(平均) | 入力トークン | 出力トークン | 推論トークン |
|---|---|---|---|---|---|---|---|---|---|
| Trinity Large Preview | 3.0 | 10.0 | 0.0% | 0 | 777ms | 204 | 18 | 0 | |
| Mercury 2.5 Preview | 3.0 | 10.0 | 0.0% | 0 | 591ms | 225 | 13 | 754 |
クイック比較
比較ペアを切り替え
Mercury 2.5 PreviewlowvsMiniMax M2.7mediumDeepSeek V3.2nonevsMercury 2.5 PreviewlowNorth Mini Codenone無料で利用可能vsMercury 2.5 PreviewlowTrinity Large PreviewnonevsNemotron 3.5 Lightninglow無料で利用可能Mercury 2.5 PreviewlowvsGPT-4o-mininoneMercury 2.5 PreviewlowvsQwen3.5-9BnoneTrinity Large PreviewnonevsCobuddymediumMercury 2.5 PreviewlowvsMiMo-V2.5noneMercury 2.5 PreviewlowvsQwen3 Coder NextnoneMercury 2.5 PreviewlowvsMistral Small 4mediumMercury 2.5 PreviewlowvsMistral Small 4noneMercury 2.5 PreviewlowvsNemotron 3.5 Lightningmedium無料で利用可能