AI BENCHY Compare

inclusionAI: Ring-2.6-1T vs Qwen: Qwen3.5-35B-A3B

ベンチマークは AI BENCHY テストスイートから次の日時に生成: 2026-05-28

指標	Ring-2.6-1T Ring-2.6-1T medium リリース: 2026-05-10	Qwen3.5-35B-A3B Qwen3.5-35B-A3B medium リリース: 2026-02-24

指標	Ring-2.6-1T Ring-2.6-1T medium リリース: 2026-05-10	Qwen3.5-35B-A3B Qwen3.5-35B-A3B medium リリース: 2026-02-24
スコア	7.2	7.3
順位	#66	#65
信頼性	10.0	10.0
一貫性	8.7	7.5
正解テスト
試行ごとの合格率	66.7%	73.3%
不安定なテスト	3	6
総実行回数	60	60
結果あたりのコスト	0.000	4.865
合計コスト	$0.033	$0.368
入力価格	$0.075 / 1M	$0.139 / 1M
出力価格	$0.625 / 1M	$1.000 / 1M
出力トークン	21,752	31,242
推論トークン	42,754	330,546
応答時間（平均）	61.29s	69.66s
応答時間（最大）	304.19s	409.98s
応答時間（合計）	1164.50s	1393.17s

スコア上位モデル

スコア vs 総コスト

応答時間（平均）

スコア vs 応答時間（平均）

合計出力トークン

スコア vs 合計出力トークン

カテゴリ内訳

反AIトリック	スコア	一貫性	試行ごとの合格率	不安定なテスト	正解テスト	応答時間（平均）	出力トークン	推論トークン
Ring-2.6-1T	10.0	10.0	100.0%	0		42.21s	3,833	4,891
Qwen3.5-35B-A3B	10.0	10.0	100.0%	0		21.13s	798	42,652

コーディング	スコア	一貫性	試行ごとの合格率	不安定なテスト	正解テスト	応答時間（平均）	出力トークン	推論トークン
Ring-2.6-1T	10.0	10.0	100.0%	0		59.65s	1,369	3,985
Qwen3.5-35B-A3B	6.5	10.0	50.0%	0		244.54s	14,456	88,431

複合	スコア	一貫性	試行ごとの合格率	不安定なテスト	正解テスト	応答時間（平均）	出力トークン	推論トークン
Ring-2.6-1T	10.0	10.0	100.0%	0		304.19s	324	6,088
Qwen3.5-35B-A3B	4.7	1.6	66.7%	1		75.34s	775	12,485

データ解析と抽出	スコア	一貫性	試行ごとの合格率	不安定なテスト	正解テスト	応答時間（平均）	出力トークン	推論トークン
Ring-2.6-1T	6.5	10.0	50.0%	0		37.36s	840	1,937
Qwen3.5-35B-A3B	7.3	5.9	83.3%	1		59.33s	235	19,493

ドメイン特化	スコア	一貫性	試行ごとの合格率	不安定なテスト	正解テスト	応答時間（平均）	出力トークン	推論トークン
Ring-2.6-1T	3.5	4.4	33.3%	2		64.92s	9,744	15,013
Qwen3.5-35B-A3B	4.1	4.4	44.5%	2		88.34s	41	46,368

汎用知能	スコア	一貫性	試行ごとの合格率	不安定なテスト	正解テスト	応答時間（平均）	出力トークン	推論トークン
Ring-2.6-1T	4.1	10.0	0.0%	0		58.26s	150	583
Qwen3.5-35B-A3B	2.8	1.6	33.3%	1		30.30s	20	3,753

指示追従	スコア	一貫性	試行ごとの合格率	不安定なテスト	正解テスト	応答時間（平均）	出力トークン	推論トークン
Ring-2.6-1T	9.8	10.0	100.0%	0		11.78s	266	1,831
Qwen3.5-35B-A3B	10.0	10.0	100.0%	0		24.45s	97	17,361

パズル解決	スコア	一貫性	試行ごとの合格率	不安定なテスト	正解テスト	応答時間（平均）	出力トークン	推論トークン
Ring-2.6-1T	5.9	7.2	55.6%	1		20.73s	697	2,479
Qwen3.5-35B-A3B	8.2	7.2	88.9%	1		33.13s	3,592	26,585

ツール呼び出し	スコア	一貫性	試行ごとの合格率	不安定なテスト	正解テスト	応答時間（平均）	出力トークン	推論トークン
Ring-2.6-1T	10.0	10.0	100.0%	0		104.44s	234	1,531
Qwen3.5-35B-A3B	10.0	10.0	100.0%	0		4.65s	309	1,365

雑学	スコア	一貫性	試行ごとの合格率	不安定なテスト	正解テスト	応答時間（平均）	出力トークン	推論トークン
Ring-2.6-1T	3.0	10.0	0.0%	0		113.91s	4,295	4,416
Qwen3.5-35B-A3B	3.0	10.0	0.0%	0		177.35s	10,919	72,053

クイック比較

比較ペアを切り替え

Claude Opus 4.8nonevsQwen3.5-35B-A3Bmedium Ring-2.6-1TnonevsQwen3.5-35B-A3Bmedium Claude Opus 4.8nonevsRing-2.6-1Tmedium Ring-2.6-1TmediumvsQwen3.6 Max Previewnone GPT-5.3 ChatnonevsQwen3.5-35B-A3Bmedium Ring-2.6-1TmediumvsGPT-5.3 Chatnone Gemini 3.1 Flash LitelowvsQwen3.5-35B-A3Bmedium Gemini 3.1 Flash LitelowvsRing-2.6-1Tmedium Gemini 3.1 Flash Lite PreviewnonevsQwen3.5-35B-A3Bmedium Claude Sonnet 4.6nonevsRing-2.6-1Tmedium Gemini 3.1 Flash Lite PreviewnonevsRing-2.6-1Tmedium Claude Sonnet 4.6nonevsQwen3.5-35B-A3Bmedium