ナビゲーション
AI BENCHY
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

AI BENCHY Compare

inclusionAI: Ring-2.6-1T vs Qwen: Qwen3.5-27B

ベンチマークは AI BENCHY テストスイートから次の日時に生成: 2026-05-28

指標 Ring-2.6-1T Ring-2.6-1T medium リリース: 2026-05-10 Qwen3.5-27B Qwen3.5-27B medium リリース: 2026-02-24
スコア 7.2 7.9
順位 #66 #27
信頼性 10.0 10.0
一貫性 8.7 8.9
正解テスト
試行ごとの合格率 66.7% 73.3%
不安定なテスト 3 3
総実行回数 60 60
結果あたりのコスト 0.000 4.532
合計コスト $0.033 $0.488
入力価格 $0.075 / 1M $0.195 / 1M
出力価格 $0.625 / 1M $1.560 / 1M
出力トークン 21,752 2,569
推論トークン 42,754 304,894
応答時間(平均) 61.29s 60.09s
応答時間(最大) 304.19s 177.36s
応答時間(合計) 1164.50s 1201.89s

スコア上位モデル

スコア vs 総コスト

応答時間(平均)

スコア vs 応答時間(平均)

合計出力トークン

スコア vs 合計出力トークン

カテゴリ内訳

反AIトリック スコア 一貫性 試行ごとの合格率 不安定なテスト 正解テスト 応答時間(平均) 出力トークン 推論トークン
Ring-2.6-1T 10.0 10.0 100.0% 0 42.21s 3,833 4,891
Qwen3.5-27B 8.7 7.9 91.7% 1 19.75s 569 31,505
コーディング スコア 一貫性 試行ごとの合格率 不安定なテスト 正解テスト 応答時間(平均) 出力トークン 推論トークン
Ring-2.6-1T 10.0 10.0 100.0% 0 59.65s 1,369 3,985
Qwen3.5-27B 7.0 9.8 50.0% 0 123.86s 416 64,993
複合 スコア 一貫性 試行ごとの合格率 不安定なテスト 正解テスト 応答時間(平均) 出力トークン 推論トークン
Ring-2.6-1T 10.0 10.0 100.0% 0 304.19s 324 6,088
Qwen3.5-27B 10.0 10.0 100.0% 0 163.96s 483 9,991
データ解析と抽出 スコア 一貫性 試行ごとの合格率 不安定なテスト 正解テスト 応答時間(平均) 出力トークン 推論トークン
Ring-2.6-1T 6.5 10.0 50.0% 0 37.36s 840 1,937
Qwen3.5-27B 10.0 10.0 100.0% 0 30.26s 270 16,150
ドメイン特化 スコア 一貫性 試行ごとの合格率 不安定なテスト 正解テスト 応答時間(平均) 出力トークン 推論トークン
Ring-2.6-1T 3.5 4.4 33.3% 2 64.92s 9,744 15,013
Qwen3.5-27B 5.3 10.0 33.3% 0 79.53s 43 52,368
汎用知能 スコア 一貫性 試行ごとの合格率 不安定なテスト 正解テスト 応答時間(平均) 出力トークン 推論トークン
Ring-2.6-1T 4.1 10.0 0.0% 0 58.26s 150 583
Qwen3.5-27B 6.1 3.1 66.7% 1 101.41s 70 23,147
指示追従 スコア 一貫性 試行ごとの合格率 不安定なテスト 正解テスト 応答時間(平均) 出力トークン 推論トークン
Ring-2.6-1T 9.8 10.0 100.0% 0 11.78s 266 1,831
Qwen3.5-27B 10.0 10.0 100.0% 0 19.66s 97 11,638
パズル解決 スコア 一貫性 試行ごとの合格率 不安定なテスト 正解テスト 応答時間(平均) 出力トークン 推論トークン
Ring-2.6-1T 5.9 7.2 55.6% 1 20.73s 697 2,479
Qwen3.5-27B 8.2 7.7 77.8% 1 59.60s 242 70,096
ツール呼び出し スコア 一貫性 試行ごとの合格率 不安定なテスト 正解テスト 応答時間(平均) 出力トークン 推論トークン
Ring-2.6-1T 10.0 10.0 100.0% 0 104.44s 234 1,531
Qwen3.5-27B 10.0 10.0 100.0% 0 7.45s 348 1,323
雑学 スコア 一貫性 試行ごとの合格率 不安定なテスト 正解テスト 応答時間(平均) 出力トークン 推論トークン
Ring-2.6-1T 3.0 10.0 0.0% 0 113.91s 4,295 4,416
Qwen3.5-27B 3.0 10.0 0.0% 0 85.11s 31 23,683

クイック比較

比較ペアを切り替え