ナビゲーション
Advertise here

Claude Opus 4.7 (medium) vs Seed-2.0-Code (low)

Seed-2.0-Code (low) が平均スコアでリードし、8.1 vs 8.1 です。 Seed-2.0-Code (low) の benchmark コストが低く、$0.881 vs $3.636 です。 Claude Opus 4.7 (medium) の方が高速で、14.12s vs 73.02s です、成功率は 81.2% vs 78.3% です。

ベンチマークは AI BENCHY テストスイートから次の日時に生成: 2026-10-01

比較対象モデル

順位
#88
合計出力トークン
57,978
応答時間(平均)
14.12s
合計コスト
$3.636
順位
#86
合計出力トークン
253,807
応答時間(平均)
73.02s
合計コスト
$0.881
おすすめモデル Seed-2.0-Code (low)

ここでは最高スコア(8.1)で、Claude Opus 4.7 (medium) より約 4.1 倍低コストです。

詳細比較

指標 Claude Opus 4.7 Claude Opus 4.7 medium リリース: 2026-04-16 Seed-2.0-Code Seed-2.0-Code low リリース: 2026-08-12
スコア 8.1 8.1
順位 #88 #86
信頼性 10.0 8.9
一貫性 9.3 7.9
試行回数 69/69 69/69
正解テスト
試行ごとの合格率 81.2% 78.3%
不安定なテスト 2 6
総実行回数 69 69
結果あたりのコスト 20.200 6.288
合計コスト $3.636 $0.881
入力価格 $5.000 / 1M $0.500 / 1M
出力価格 $25.000 / 1M $3.000 / 1M
合計入力トークン 437,293 237,604
出力トークン 29,102 9,617
推論トークン 28,876 244,190
応答時間(平均) 14.12s 73.02s
応答時間(最大) 150.60s 485.92s
応答時間(合計) 310.55s 1679.49s
パラメータ ~5T 総数 (~500B アクティブ) ~200B 総数 (~20B アクティブ)
公開状況 クローズド クローズド

モデル生成ショーケース

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#88 Claude Opus 4.7

medium
コスト
$0.059
時間
26.8s
トークン
2,475 tok

#86 Seed-2.0-Code

low
Provider returned error
コスト
$0.000
時間
0.3s
トークン
0 tok

スコア上位モデル

スコア vs 総コスト

応答時間(平均)

スコア vs 応答時間(平均)

合計出力トークン

スコア vs 合計出力トークン

カテゴリ内訳

コーディング スコア 一貫性 試行ごとの合格率 不安定なテスト 正解テスト 応答時間(平均) 入力トークン 出力トークン 推論トークン
Claude Opus 4.7 7.6 7.2 77.8% 1 12.96s 10,635 7,629 1,114
Seed-2.0-Code 7.0 7.1 55.6% 1 109.70s 7,948 455 55,759

クイック比較

比較ペアを切り替え