ナビゲーション
AI BENCHY
Advertise here

AI BENCHY Compare

Anthropic: Claude Opus 4.8 vs Z.ai: GLM 5V Turbo

ベンチマークは AI BENCHY テストスイートから次の日時に生成: 2026-05-28

指標 Claude Opus 4.8 Claude Opus 4.8 none リリース: 2026-05-28 GLM 5V Turbo GLM 5V Turbo medium リリース: 2026-04-01
スコア 7.3 7.4
順位 #63 #60
信頼性 10.0 10.0
一貫性 9.2 8.2
正解テスト
試行ごとの合格率 65.0% 68.3%
不安定なテスト 2 5
総実行回数 60 60
結果あたりのコスト 4.324 3.695
合計コスト $0.519 $0.407
入力価格 $5.000 / 1M $1.200 / 1M
出力価格 $25.000 / 1M $4.000 / 1M
出力トークン 8,098 2,334
推論トークン 0 86,653
応答時間(平均) 3.51s 20.21s
応答時間(最大) 17.73s 95.88s
応答時間(合計) 70.19s 404.14s

スコア上位モデル

スコア vs 総コスト

応答時間(平均)

スコア vs 応答時間(平均)

合計出力トークン

スコア vs 合計出力トークン

カテゴリ内訳

反AIトリック スコア 一貫性 試行ごとの合格率 不安定なテスト 正解テスト 応答時間(平均) 出力トークン 推論トークン
Claude Opus 4.8 6.5 10.0 50.0% 0 3.40s 1,472 0
GLM 5V Turbo 7.2 6.1 75.0% 2 10.76s 587 7,872
コーディング スコア 一貫性 試行ごとの合格率 不安定なテスト 正解テスト 応答時間(平均) 出力トークン 推論トークン
Claude Opus 4.8 6.8 10.0 50.0% 0 3.59s 1,323 0
GLM 5V Turbo 6.8 10.0 50.0% 0 54.83s 427 26,111
複合 スコア 一貫性 試行ごとの合格率 不安定なテスト 正解テスト 応答時間(平均) 出力トークン 推論トークン
Claude Opus 4.8 9.5 10.0 100.0% 0 17.73s 3,259 0
GLM 5V Turbo 6.9 3.8 66.7% 1 15.06s 403 2,523
データ解析と抽出 スコア 一貫性 試行ごとの合格率 不安定なテスト 正解テスト 応答時間(平均) 出力トークン 推論トークン
Claude Opus 4.8 7.3 5.8 83.3% 1 1.77s 308 0
GLM 5V Turbo 10.0 10.0 100.0% 0 9.60s 236 4,333
ドメイン特化 スコア 一貫性 試行ごとの合格率 不安定なテスト 正解テスト 応答時間(平均) 出力トークン 推論トークン
Claude Opus 4.8 5.3 7.2 44.4% 1 1.66s 61 0
GLM 5V Turbo 5.3 7.2 44.4% 1 38.15s 32 29,035
汎用知能 スコア 一貫性 試行ごとの合格率 不安定なテスト 正解テスト 応答時間(平均) 出力トークン 推論トークン
Claude Opus 4.8 10.0 10.0 100.0% 0 3.48s 230 0
GLM 5V Turbo 10.0 10.0 100.0% 0 11.09s 131 2,183
指示追従 スコア 一貫性 試行ごとの合格率 不安定なテスト 正解テスト 応答時間(平均) 出力トークン 推論トークン
Claude Opus 4.8 9.9 10.0 100.0% 0 1.37s 95 0
GLM 5V Turbo 9.9 10.0 100.0% 0 3.74s 72 1,813
パズル解決 スコア 一貫性 試行ごとの合格率 不安定なテスト 正解テスト 応答時間(平均) 出力トークン 推論トークン
Claude Opus 4.8 7.7 10.0 66.7% 0 2.74s 783 0
GLM 5V Turbo 7.7 10.0 66.7% 0 10.24s 131 4,496
ツール呼び出し スコア 一貫性 試行ごとの合格率 不安定なテスト 正解テスト 応答時間(平均) 出力トークン 推論トークン
Claude Opus 4.8 10.0 10.0 100.0% 0 5.35s 355 0
GLM 5V Turbo 7.0 3.7 66.7% 1 12.53s 293 765
雑学 スコア 一貫性 試行ごとの合格率 不安定なテスト 正解テスト 応答時間(平均) 出力トークン 推論トークン
Claude Opus 4.8 3.0 10.0 0.0% 0 3.41s 212 0
GLM 5V Turbo 3.0 10.0 0.0% 0 40.96s 22 7,522

クイック比較

比較ペアを切り替え