ナビゲーション
Advertise here

GPT-5.3-Codex (medium) vs GPT-6.1 Sol (low)

GPT-6.1 Sol (low) が平均スコアでリードし、9.6 vs 9.1 です。 GPT-6.1 Sol (low) の benchmark コストが低く、$0.460 vs $1.318 です。 GPT-6.1 Sol (low) の方が高速で、7.15s vs 18.87s です、成功率は 84.1% vs 92.8% です。

ベンチマークは AI BENCHY テストスイートから次の日時に生成: 2026-10-07

比較対象モデル

順位
#34
合計出力トークン
66,287
応答時間(平均)
18.87s
合計コスト
$1.318
順位
#16
合計出力トークン
13,138
応答時間(平均)
7.15s
合計コスト
$0.460
おすすめモデル GPT-6.1 Sol (low)

ここでは最高スコア(9.6)で、GPT-5.3-Codex (medium) より約 2.9 倍低コストです。

詳細比較

指標 GPT-5.3-Codex GPT-5.3-Codex medium リリース: 2026-02-05 GPT-6.1 Sol GPT-6.1 Sol low リリース: 2026-09-29
スコア 9.1 9.6
順位 #34 #16
信頼性 10.0 10.0
一貫性 8.6 9.6
試行回数 69/69 69/69
正解テスト
試行ごとの合格率 84.1% 92.8%
不安定なテスト 4 1
総実行回数 69 69
結果あたりのコスト 7.753 2.187
合計コスト $1.318 $0.460
入力価格 $1.750 / 1M $2.000 / 1M
出力価格 $14.000 / 1M $10.000 / 1M
キャッシュ読み取り料金 $0.175 / 1M $0.100 / 1M
キャッシュ書き込み料金 該当なし $2.500 / 1M
合計入力トークン 222,794 163,900
出力トークン 7,357 4,958
推論トークン 58,930 8,180
応答時間(平均) 18.87s 7.15s
応答時間(最大) 100.93s 46.57s
応答時間(合計) 433.94s 164.47s
パラメータ ~1.2T 総数 (~80B アクティブ) ~2T 総数 (~150B アクティブ)
公開状況 クローズド クローズド

キャッシュ料金は入力トークンに適用されます。読み取りは保存済みのプロンプトを再利用し、書き込みは保存するため追加料金がかかる場合があります。出力トークンには出力料金が適用されます。

モデル生成ショーケース

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#34 GPT-5.3-Codex

medium
コスト
$0.049
時間
54.9s
トークン
3,580 tok

#16 GPT-6.1 Sol

low
コスト
$0.028
時間
44.6s
トークン
2,881 tok

スコア上位モデル

スコア vs 総コスト

応答時間(平均)

スコア vs 応答時間(平均)

合計出力トークン

スコア vs 合計出力トークン

カテゴリ内訳

コーディング スコア 一貫性 試行ごとの合格率 不安定なテスト 正解テスト 応答時間(平均) 入力トークン 出力トークン 推論トークン
GPT-5.3-Codex 10.0 10.0 100.0% 0 19.50s 7,302 535 10,890
GPT-6.1 Sol 10.0 10.0 100.0% 0 4.48s 7,302 388 1,286

比較ペアを切り替え