AI BENCHY Compare

Elephant Alpha vs Qwen: Qwen3.5-9B

ベンチマークは AI BENCHY テストスイートから次の日時に生成: 2026-05-29

指標	Elephant Alpha Elephant Alpha none リリース: 2026-04-14	Qwen3.5-9B Qwen3.5-9B medium リリース: 2026-03-02

指標	Elephant Alpha Elephant Alpha none リリース: 2026-04-14	Qwen3.5-9B Qwen3.5-9B medium リリース: 2026-03-02
スコア	5.2	4.2
順位	#136	#156
信頼性	該当なし	5.0
一貫性	9.6	7.9
正解テスト
試行ごとの合格率	29.8%	28.3%
不安定なテスト	1	5
総実行回数	60	60
結果あたりのコスト	0.000	1.127
合計コスト	$0.000	$0.034
入力価格	$0.000 / 1M	$0.040 / 1M
出力価格	$0.000 / 1M	$0.150 / 1M
出力トークン	2,573	27,305
推論トークン	0	199,780
応答時間（平均）	1.22s	83.32s
応答時間（最大）	3.81s	226.38s
応答時間（合計）	22.03s	1249.74s

スコア上位モデル

スコア vs 総コスト

応答時間（平均）

スコア vs 応答時間（平均）

合計出力トークン

スコア vs 合計出力トークン

カテゴリ内訳

反AIトリック	スコア	一貫性	試行ごとの合格率	不安定なテスト	正解テスト	応答時間（平均）	出力トークン	推論トークン
Elephant Alpha	6.6	10.0	50.0%	0		963ms	610	0
Qwen3.5-9B	5.1	5.8	50.0%	2		34.44s	2,621	12,411

コーディング	スコア	一貫性	試行ごとの合格率	不安定なテスト	正解テスト	応答時間（平均）	出力トークン	推論トークン
Elephant Alpha	4.7	6.7	33.3%	1		1.39s	375	0
Qwen3.5-9B	2.8	10.0	0.0%	0		135.61s	6,150	31,393

複合	スコア	一貫性	試行ごとの合格率	不安定なテスト	正解テスト	応答時間（平均）	出力トークン	推論トークン
Elephant Alpha	3.0	10.0	0.0%	0		3.81s	731	0
Qwen3.5-9B	3.0	10.0	0.0%	0		0ms	0	0

データ解析と抽出	スコア	一貫性	試行ごとの合格率	不安定なテスト	正解テスト	応答時間（平均）	出力トークン	推論トークン
Elephant Alpha	6.5	10.0	50.0%	0		1.04s	246	0
Qwen3.5-9B	3.6	5.6	33.3%	1		87.31s	1,383	32,113

ドメイン特化	スコア	一貫性	試行ごとの合格率	不安定なテスト	正解テスト	応答時間（平均）	出力トークン	推論トークン
Elephant Alpha	3.0	10.0	0.0%	0		927ms	24	0
Qwen3.5-9B	3.6	7.2	22.2%	1		137.75s	11,549	48,475

汎用知能	スコア	一貫性	試行ごとの合格率	不安定なテスト	正解テスト	応答時間（平均）	出力トークン	推論トークン
Elephant Alpha	4.0	10.0	0.0%	0		854ms	106	0
Qwen3.5-9B	2.8	1.6	33.3%	1		226.38s	0	30,695

指示追従	スコア	一貫性	試行ごとの合格率	不安定なテスト	正解テスト	応答時間（平均）	出力トークン	推論トークン
Elephant Alpha	9.8	10.0	100.0%	0		1.03s	81	0
Qwen3.5-9B	6.5	10.0	50.0%	0		5.75s	491	1,824

パズル解決	スコア	一貫性	試行ごとの合格率	不安定なテスト	正解テスト	応答時間（平均）	出力トークン	推論トークン
Elephant Alpha	4.2	10.0	0.0%	0		807ms	170	0
Qwen3.5-9B	3.0	10.0	0.0%	0		32.27s	1,593	12,026

ツール呼び出し	スコア	一貫性	試行ごとの合格率	不安定なテスト	正解テスト	応答時間（平均）	出力トークン	推論トークン
Elephant Alpha	3.0	10.0	0.0%	0		2.79s	230	0
Qwen3.5-9B	10.0	10.0	100.0%	0		4.31s	444	1,149

雑学	スコア	一貫性	試行ごとの合格率	不安定なテスト	正解テスト	応答時間（平均）	出力トークン	推論トークン
Elephant Alpha	0.0	0.0	0.0%	0		0ms	0	0
Qwen3.5-9B	3.0	10.0	0.0%	0		177.02s	3,074	29,694

クイック比較

比較ペアを切り替え

Granite 4.1 8BnonevsQwen3.5-9Bmedium MiniMax M2.7mediumvsElephant Alphanone Mistral Small 4mediumvsElephant Alphanone MiniMax M2.5medium無料で利用可能vsElephant Alphanone Ling-2.6-1TnonevsQwen3.5-9Bmedium Mercury 2nonevsQwen3.5-9Bmedium Qwen3.5-9BmediumvsMiMo-V2-Flashnone CobuddymediumvsElephant Alphanone Elephant AlphanonevsQwen3 Coder Nextmedium GPT-5.4 NanononevsQwen3.5-9Bmedium Trinity Large PreviewnonevsQwen3.5-9Bmedium GPT-4o-mininonevsQwen3.5-9Bmedium