ナビゲーション
AI BENCHY
Advertise here

Mercury 2.5 Preview (low) vs Ling-2.6-flash

Mercury 2.5 Preview (low) が平均スコアでリードし、5.0 vs 4.9 です。 Ling-2.6-flash の benchmark コストが低く、$0.002 vs $0.011 です。 Mercury 2.5 Preview (low) の方が高速で、1.31s vs 10.71s です、成功率は 47.0% vs 30.3% です。

ベンチマークは AI BENCHY テストスイートから次の日時に生成: 2026-09-02

順位
#254
合計出力トークン
31,975
応答時間(平均)
1.31s
合計コスト
$0.011
順位
#260
合計出力トークン
14,903
応答時間(平均)
10.71s
合計コスト
$0.002
おすすめモデル Mercury 2.5 Preview (low)

ここでは最高スコア(5.0)で、Ling-2.6-flash より約 8.2 倍速く応答します。

詳細比較

指標 Mercury 2.5 Preview Mercury 2.5 Preview low リリース: 2026-09-02 Ling-2.6-flash Ling-2.6-flash none リリース: 2026-04-21
スコア 5.0 4.9
順位 #254 #260
信頼性 10.0 9.6
一貫性 7.0 9.3
試行回数 66/66 66/66
正解テスト
試行ごとの合格率 47.0% 30.3%
不安定なテスト 8 2
総実行回数 66 66
結果あたりのコスト 0.169 0.024
合計コスト $0.011 $0.002
入力価格 $0.040 / 1M $0.010 / 1M
出力価格 $0.150 / 1M $0.030 / 1M
合計入力トークン 133,525 114,384
出力トークン 7,259 14,903
推論トークン 24,716 0
応答時間(平均) 1.31s 10.71s
応答時間(最大) 7.29s 36.03s
応答時間(合計) 28.77s 214.28s
パラメータ ~100B 104B 総数 (7.4B アクティブ)
公開状況 クローズド オープンソース

モデル生成ショーケース

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#254 Mercury 2.5 Preview

low
コスト
$0.001
時間
1.5s
トークン
1,169 tok

#260 Ling-2.6-flash

none
Ling-2.6-flash is no longer available as a free model. It has transitioned to a paid model. Continue using it here: https://openrouter.ai/inclusionai/ling-2.6-flash
コスト
$0.000
時間
0.0s
トークン
0 tok

スコア上位モデル

スコア vs 総コスト

応答時間(平均)

スコア vs 応答時間(平均)

合計出力トークン

スコア vs 合計出力トークン

カテゴリ内訳

コーディング スコア 一貫性 試行ごとの合格率 不安定なテスト 正解テスト 応答時間(平均) 入力トークン 出力トークン 推論トークン
Mercury 2.5 Preview 5.5 10.0 33.3% 0 972ms 7,794 695 2,263
Ling-2.6-flash 5.3 10.0 33.3% 0 11.21s 813 381 0

クイック比較

比較ペアを切り替え