Navigasi
AI BENCHY
Advertise here

Anthropic: Claude Opus 4.6 vs OpenAI: GPT-5.6 Terra

GPT-5.6 Terra (medium) unggul dalam skor rata-rata dengan 7.8 vs 7.7. GPT-5.6 Terra (medium) memiliki biaya benchmark lebih rendah di $0.676 vs $3.059. GPT-5.6 Terra (medium) lebih cepat di 7.11s vs 34.27s, dengan tingkat keberhasilan 63.6% vs 69.7%.

Model yang direkomendasikanGPT-5.6 Terra (medium)It has the best score here (7.8), while costing about 4.5x less than Claude Opus 4.6 (medium).

Benchmark dihasilkan dari suite pengujian AI BENCHY pada: 2026-07-25

Metrik Claude Opus 4.6 Claude Opus 4.6 medium Rilis: 2026-02-05 GPT-5.6 Terra GPT-5.6 Terra medium Rilis: 2026-07-09
Skor 7.7 7.8
Peringkat #50 #46
Keandalan 10.0 10.0
Konsistensi 8.8 9.3
Tes benar
Tingkat lulus per percobaan 63.6% 69.7%
Tes tidak stabil 3 2
Total Run 66 66
Biaya per hasil 23.524 4.825
Total Biaya $3.059 $0.676
Harga input $5.000 / 1M $2.500 / 1M
Harga output $25.000 / 1M $15.000 / 1M
Total token input 108,615 79,175
Token output 72,286 4,878
Token penalaran 28,315 26,952
Waktu respons (rata-rata) 34.27s 7.11s
Waktu respons (maks) 151.51s 41.68s
Waktu respons (total) 513.99s 156.42s

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#50 Claude Opus 4.6

medium
SVG tidak valid
Biaya
$0.000
Waktu
300.0s
Token
0 tok

#46 GPT-5.6 Terra

medium
Biaya
$0.035
Waktu
16.3s
Token
2,418 tok

Model teratas berdasarkan skor

Skor vs Total Biaya

Waktu respons (rata-rata)

Skor vs Waktu respons (rata-rata)

Total token output

Skor vs Total token output

Rincian Kategori

Pemrograman Skor Konsistensi Tingkat lulus per percobaan Tes tidak stabil Tes benar Waktu respons (rata-rata) Token input Token output Token penalaran
Claude Opus 4.6 5.7 7.1 44.4% 1 30.10s 8,522 13,057 4,121
GPT-5.6 Terra 6.1 7.2 55.6% 1 7.19s 7,302 427 4,527

Perbandingan Cepat

Ganti Pasangan Perbandingan