ナビゲーション
AI BENCHY
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

AI BENCHY Compare

inclusionAI: Ring-2.6-1T vs xAI: Grok Build 0.1

ベンチマークは AI BENCHY テストスイートから次の日時に生成: 2026-05-21

指標 Ring-2.6-1T Ring-2.6-1T medium リリース: 2026-05-10 Grok Build 0.1 Grok Build 0.1 medium リリース: 2026-05-21
スコア 7.2 7.8
順位 #61 #41
信頼性 9.9 10.0
一貫性 8.7 8.9
正解テスト
試行ごとの合格率 66.7% 71.9%
不安定なテスト 3 3
総実行回数 57 57
結果あたりのコスト 0.000 4.064
合計コスト $0.000 $0.488
???? $0.075 / 1M $1.000 / 1M
???? $0.625 / 1M $2.000 / 1M
出力トークン 21,752 1,947
推論トークン 42,754 223,372
応答時間(平均) 61.29s 22.28s
応答時間(最大) 304.19s 88.28s
応答時間(合計) 1164.50s 423.30s

スコア上位モデル

スコア vs 総コスト

応答時間(平均)

スコア vs 応答時間(平均)

合計出力トークン

スコア vs 合計出力トークン

カテゴリ内訳

反AIトリック スコア 一貫性 試行ごとの合格率 不安定なテスト 正解テスト 応答時間(平均) 出力トークン 推論トークン
Ring-2.6-1T 10.0 10.0 100.0% 0 42.21s 3,833 4,891
Grok Build 0.1 10.0 10.0 100.0% 0 5.46s 195 9,825
コーディング スコア 一貫性 試行ごとの合格率 不安定なテスト 正解テスト 応答時間(平均) 出力トークン 推論トークン
Ring-2.6-1T 10.0 10.0 100.0% 0 59.65s 1,369 3,985
Grok Build 0.1 7.3 3.7 66.7% 1 30.98s 354 17,734
複合 スコア 一貫性 試行ごとの合格率 不安定なテスト 正解テスト 応答時間(平均) 出力トークン 推論トークン
Ring-2.6-1T 10.0 10.0 100.0% 0 304.19s 324 6,088
Grok Build 0.1 10.0 10.0 100.0% 0 30.81s 231 18,779
データ解析と抽出 スコア 一貫性 試行ごとの合格率 不安定なテスト 正解テスト 応答時間(平均) 出力トークン 推論トークン
Ring-2.6-1T 6.5 10.0 50.0% 0 37.36s 840 1,937
Grok Build 0.1 10.0 10.0 100.0% 0 7.76s 180 10,343
ドメイン特化 スコア 一貫性 試行ごとの合格率 不安定なテスト 正解テスト 応答時間(平均) 出力トークン 推論トークン
Ring-2.6-1T 3.5 4.4 33.3% 2 64.92s 9,744 15,013
Grok Build 0.1 5.3 10.0 33.3% 0 77.75s 501 111,807
汎用知能 スコア 一貫性 試行ごとの合格率 不安定なテスト 正解テスト 応答時間(平均) 出力トークン 推論トークン
Ring-2.6-1T 4.1 10.0 0.0% 0 58.26s 150 583
Grok Build 0.1 3.8 2.5 33.3% 1 10.14s 78 5,386
指示追従 スコア 一貫性 試行ごとの合格率 不安定なテスト 正解テスト 応答時間(平均) 出力トークン 推論トークン
Ring-2.6-1T 9.8 10.0 100.0% 0 11.78s 266 1,831
Grok Build 0.1 9.8 10.0 100.0% 0 9.62s 57 12,436
パズル解決 スコア 一貫性 試行ごとの合格率 不安定なテスト 正解テスト 応答時間(平均) 出力トークン 推論トークン
Ring-2.6-1T 5.9 7.2 55.6% 1 20.73s 697 2,479
Grok Build 0.1 6.2 7.5 55.6% 1 8.67s 161 15,476
ツール呼び出し スコア 一貫性 試行ごとの合格率 不安定なテスト 正解テスト 応答時間(平均) 出力トークン 推論トークン
Ring-2.6-1T 10.0 10.0 100.0% 0 104.44s 234 1,531
Grok Build 0.1 10.0 10.0 100.0% 0 9.40s 180 5,319
雑学 スコア 一貫性 試行ごとの合格率 不安定なテスト 正解テスト 応答時間(平均) 出力トークン 推論トークン
Ring-2.6-1T 3.0 10.0 0.0% 0 113.91s 4,295 4,416
Grok Build 0.1 3.0 10.0 0.0% 0 26.07s 10 16,267

クイック比較

比較ペアを切り替え