ナビゲーション
Advertise here

Hy4 preview (low) vs GLM 5.1

GLM 5.1 が平均スコアでリードし、5.7 vs 5.6 です。 GLM 5.1 の benchmark コストが低く、$0.164 vs $1.745 です。 GLM 5.1 の方が高速で、6.74s vs 214.25s です、成功率は 19.7% vs 45.5% です。

ベンチマークは AI BENCHY テストスイートから次の日時に生成: 2026-09-23

比較対象モデル

順位
#266
合計出力トークン
682,538
応答時間(平均)
214.25s
合計コスト
$1.745
順位
#253
合計出力トークン
14,393
応答時間(平均)
6.74s
合計コスト
$0.164
おすすめモデル GLM 5.1

ここでは最高スコア(5.7)で、Hy4 preview (low) より約 10.7 倍低コストです。

詳細比較

指標 Hy4 preview Hy4 preview low リリース: 2026-08-29 GLM 5.1 GLM 5.1 none リリース: 2026-04-07
スコア 5.6 5.7
順位 #266 #253
信頼性 5.4 10.0
一貫性 8.5 8.2
試行回数 66/66 66/66
正解テスト
試行ごとの合格率 19.7% 45.5%
不安定なテスト 3 5
総実行回数 66 66
結果あたりのコスト 58.157 2.073
合計コスト $1.745 $0.164
入力価格 $0.834 / 1M $0.966 / 1M
出力価格 $2.501 / 1M $3.036 / 1M
合計入力トークン 45,154 124,219
出力トークン 4,022 14,393
推論トークン 678,516 0
応答時間(平均) 214.25s 6.74s
応答時間(最大) 597.45s 61.20s
応答時間(合計) 4713.56s 148.20s
パラメータ 770B 総数 (49B アクティブ) 744B 総数 (40B アクティブ)
公開状況 オープンソース オープンソース

モデル生成ショーケース

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#266 Hy4 preview

low
Provider returned error
コスト
$0.000
時間
1.1s
トークン
0 tok

#253 GLM 5.1

none
Reached the allocated time limit (300 seconds) without receiving showcase output.
コスト
$0.000
時間
300.0s
トークン
0 tok

スコア上位モデル

スコア vs 総コスト

応答時間(平均)

スコア vs 応答時間(平均)

合計出力トークン

スコア vs 合計出力トークン

カテゴリ内訳

コーディング スコア 一貫性 試行ごとの合格率 不安定なテスト 正解テスト 応答時間(平均) 入力トークン 出力トークン 推論トークン
Hy4 preview 5.2 8.6 0.0% 0 219.15s 6,110 135 96,407
GLM 5.1 3.9 9.7 0.0% 0 4.96s 7,256 525 0

クイック比較

比較ペアを切り替え