ナビゲーション
AI BENCHY
Advertise here

inclusionAI: Ling-2.6-flash vs Poolside: Laguna XS 2.1

Laguna XS 2.1 が平均スコアでリードし、5.3 vs 4.9 です。 Ling-2.6-flash の benchmark コストが低く、$0.002 vs $0.008 です。 Laguna XS 2.1 の方が高速で、1.55s vs 10.68s です、成功率は 30.3% vs 30.3% です。

おすすめモデルLaguna XS 2.1ここでは最高スコア(5.3)で、Ling-2.6-flash より約 6.9 倍速く応答します。

ベンチマークは AI BENCHY テストスイートから次の日時に生成: 2026-07-21

指標 Ling-2.6-flash Ling-2.6-flash none リリース: 2026-04-21 Laguna XS 2.1 Laguna XS 2.1 none リリース: 2026-07-02 無料で利用可能
スコア 4.9 5.3
順位 #184 #166
信頼性 10.0 10.0
一貫性 9.3 9.0
正解テスト
試行ごとの合格率 30.3% 30.3%
不安定なテスト 2 3
総実行回数 66 66
結果あたりのコスト 0.024 0.143
合計コスト $0.002 $0.008
入力価格 $0.010 / 1M $0.060 / 1M
出力価格 $0.030 / 1M $0.120 / 1M
合計入力トークン 114,375 91,598
出力トークン 14,903 13,377
推論トークン 0 0
応答時間(平均) 10.68s 1.55s
応答時間(最大) 36.03s 19.02s
応答時間(合計) 213.51s 34.19s

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#184 Ling-2.6-flash

none
Ling-2.6-flash is no longer available as a free model. It has transitioned to a paid model. Continue using it here: https://openrouter.ai/inclusionai/ling-2.6-flash
コスト
$0.000
時間
0.0s
トークン
0 tok

#166 Laguna XS 2.1

none
コスト
$0.001
時間
27.6s
トークン
4,344 tok

スコア上位モデル

スコア vs 総コスト

応答時間(平均)

スコア vs 応答時間(平均)

合計出力トークン

スコア vs 合計出力トークン

カテゴリ内訳

コーディング スコア 一貫性 試行ごとの合格率 不安定なテスト 正解テスト 応答時間(平均) 入力トークン 出力トークン 推論トークン
Ling-2.6-flash 5.3 10.0 33.3% 0 11.21s 813 381 0
Laguna XS 2.1 4.3 7.8 22.2% 1 623ms 7,995 562 0

クイック比較

比較ペアを切り替え