ナビゲーション
AI BENCHY
Advertise here

Qwen3.8 27B vs Hy4 preview (low)

平均スコアは 5.5 vs 5.6 でほぼ同等です。 Qwen3.8 27B の benchmark コストが低く、~$0.006 vs $1.745 です。 Qwen3.8 27B の方が高速で、3.12s vs 214.25s です、成功率は 40.9% vs 19.7% です。

ベンチマークは AI BENCHY テストスイートから次の日時に生成: 2026-08-29

順位
#220
合計出力トークン
11,445
応答時間(平均)
3.12s
合計コスト
~$0.006
順位
#217
合計出力トークン
682,538
応答時間(平均)
214.25s
合計コスト
$1.745
おすすめモデル Qwen3.8 27B

ここでは最高スコア(5.5)で、Hy4 preview (low) より約 308.3 倍低コストです。

詳細比較

指標 Qwen3.8 27B Qwen3.8 27B none リリース: 2026-08-14 Hy4 preview Hy4 preview low リリース: 2026-08-29
スコア 5.5 5.6
順位 #220 #217
信頼性 10.0 5.4
一貫性 10.0 8.5
試行回数 66/66 66/66
正解テスト
試行ごとの合格率 40.9% 19.7%
不安定なテスト 0 3
総実行回数 66 66
結果あたりのコスト ~0.063 58.157
合計コスト ~$0.006 $1.745
入力価格 該当なし $0.834 / 1M
出力価格 該当なし $2.501 / 1M
合計入力トークン 122,463 45,154
出力トークン 11,445 4,022
推論トークン 0 678,516
応答時間(平均) 3.12s 214.25s
応答時間(最大) 44.76s 597.45s
応答時間(合計) 68.69s 4713.56s
パラメータ 27.3B 770B 総数 (49B アクティブ)
公開状況 重み公開 オープンソース

モデル生成ショーケース

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#220 Qwen3.8 27B

none
コスト
~$0.001
時間
23.9s
トークン
1,922 tok

#217 Hy4 preview

low
Provider returned error
コスト
$0.000
時間
1.1s
トークン
0 tok

スコア上位モデル

スコア vs 総コスト

応答時間(平均)

スコア vs 応答時間(平均)

合計出力トークン

スコア vs 合計出力トークン

カテゴリ内訳

コーディング スコア 一貫性 試行ごとの合格率 不安定なテスト 正解テスト 応答時間(平均) 入力トークン 出力トークン 推論トークン
Qwen3.8 27B 5.5 10.0 33.3% 0 1.19s 7,911 408 0
Hy4 preview 5.2 8.6 0.0% 0 219.15s 6,110 135 96,407

クイック比較

比較ペアを切り替え