ナビゲーション
AI BENCHY
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

GPT-5.5 vs Qwen3.5-35B-A3B (medium)

GPT-5.5 が平均スコアでリードし、6.9 vs 6.2 です。 GPT-5.5 の benchmark コストが低く、$0.544 vs $0.837 です。 GPT-5.5 の方が高速で、2.36s vs 112.47s です、成功率は 56.1% vs 66.7% です。

ベンチマークは AI BENCHY テストスイートから次の日時に生成: 2026-07-28

順位
#98
合計出力トークン
4,915
応答時間(平均)
2.36s
合計コスト
$0.544
順位
#133
合計出力トークン
826,670
応答時間(平均)
112.47s
合計コスト
$0.837
おすすめモデル GPT-5.5

ここでは最高スコア(6.9)で、Qwen3.5-35B-A3B (medium) より約 1.5 倍低コストです。

詳細比較

指標 GPT-5.5 GPT-5.5 none リリース: 2026-04-24 Qwen3.5-35B-A3B Qwen3.5-35B-A3B medium リリース: 2026-02-24
スコア 6.9 6.2
順位 #98 #133
信頼性 10.0 10.0
一貫性 8.9 7.6
正解テスト
試行ごとの合格率 56.1% 66.7%
不安定なテスト 3 6
総実行回数 66 66
結果あたりのコスト 4.945 9.130
合計コスト $0.544 $0.837
入力価格 $5.000 / 1M $0.140 / 1M
出力価格 $30.000 / 1M $1.000 / 1M
合計入力トークン 79,285 130,388
出力トークン 4,915 40,630
推論トークン 0 786,040
応答時間(平均) 2.36s 112.47s
応答時間(最大) 12.24s 950.25s
応答時間(合計) 51.88s 2474.28s

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#98 GPT-5.5

none
コスト
$0.090
時間
54.3s
トークン
3,063 tok

#133 Qwen3.5-35B-A3B

medium
コスト
$0.009
時間
71.4s
トークン
8,631 tok

スコア上位モデル

スコア vs 総コスト

応答時間(平均)

スコア vs 応答時間(平均)

合計出力トークン

スコア vs 合計出力トークン

カテゴリ内訳

コーディング スコア 一貫性 試行ごとの合格率 不安定なテスト 正解テスト 応答時間(平均) 入力トークン 出力トークン 推論トークン
GPT-5.5 5.5 10.0 33.3% 0 1.35s 7,305 462 0
Qwen3.5-35B-A3B 5.9 9.3 33.3% 0 206.65s 4,106 23,844 111,462

クイック比較

比較ペアを切り替え