Navigasi
Advertise here

Claude Opus 4.7 (medium) vs Qwen3.8 Flash Next (low)

Claude Opus 4.7 (medium) unggul dalam skor rata-rata dengan 8.1 vs 8.0. Qwen3.8 Flash Next (low) memiliki biaya benchmark lebih rendah di ~$0.045 vs $3.636. Claude Opus 4.7 (medium) lebih cepat di 14.12s vs 23.66s, dengan tingkat keberhasilan 81.2% vs 79.7%.

Benchmark dihasilkan dari suite pengujian AI BENCHY pada: 2026-10-07

Model yang Dibandingkan

Peringkat
#93
Total token output
57,978
Waktu respons (rata-rata)
14.12s
Total Biaya
$3.636
Peringkat
#100
Total token output
135,295
Waktu respons (rata-rata)
23.66s
Total Biaya
~$0.045
Model yang direkomendasikan Qwen3.8 Flash Next (low)

Its score stays close to the best score here (8.0 vs 8.1), while costing about 81.1x less than Claude Opus 4.7 (medium).

Perbandingan terperinci

Metrik Claude Opus 4.7 Claude Opus 4.7 medium Rilis: 2026-04-16 Qwen3.8 Flash Next Qwen3.8 Flash Next low Rilis: 2026-10-04
Skor 8.1 8.0
Peringkat #93 #100
Keandalan 10.0 10.0
Konsistensi 9.3 8.0
Percobaan 69/69 69/69
Tes benar
Tingkat lulus per percobaan 81.2% 79.7%
Tes tidak stabil 2 6
Total Run 69 69
Biaya per hasil 20.200 ~0.299
Total Biaya $3.636 ~$0.045
Harga input $5.000 / 1M T/A
Harga output $25.000 / 1M T/A
Harga baca cache $0.500 / 1M T/A
Harga tulis cache $6.250 / 1M T/A
Total token input 437,293 342,163
Token output 29,102 1,518
Token penalaran 28,876 133,777
Waktu respons (rata-rata) 14.12s 23.66s
Waktu respons (maks) 150.60s 166.72s
Waktu respons (total) 310.55s 544.16s
Parameter ~5T total (~500B aktif) 180B total (6B aktif)
Ketersediaan Tertutup Bobot tersedia

Harga cache berlaku untuk token input. Pembacaan memakai kembali prompt tersimpan; penulisan menyimpannya dan dapat menambah biaya. Token output menggunakan harga output.

Showcase generasi model

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#93 Claude Opus 4.7

medium
Biaya
$0.059
Waktu
26.8s
Token
2,475 tok

#100 Qwen3.8 Flash Next

low
Biaya
~$0.002
Waktu
47.2s
Token
5,270 tok

Model teratas berdasarkan skor

Skor vs Total Biaya

Waktu respons (rata-rata)

Skor vs Waktu respons (rata-rata)

Total token output

Skor vs Total token output

Rincian Kategori

Pemrograman Skor Konsistensi Tingkat lulus per percobaan Tes tidak stabil Tes benar Waktu respons (rata-rata) Token input Token output Token penalaran
Claude Opus 4.7 7.6 7.2 77.8% 1 12.96s 10,635 7,629 1,114
Qwen3.8 Flash Next 10.0 10.0 100.0% 0 29.46s 8,127 397 24,147

Ganti Pasangan Perbandingan

Claude Opus 4.7mediumvsDeepSeek V4 Flash 0423highGemini 3.8 FlashmediumvsQwen3.8 Flash NextlowGPT-5.4 NanomediumvsQwen3.8 Flash NextlowClaude Opus 4.7mediumvsDeepSeek V4 Pro 0423highClaude Opus 4.7mediumvsDeepSeek V4.1 FlashlowQwen3.8 Flash NextlowvsGLM 5.3 FlashXmaxClaude Fable 5.1highvsQwen3.8 Flash NextlowNemotron 3 UltramediumTersedia gratisvsQwen3.8 Flash NextlowGPT-5.4 MinimediumvsQwen3.8 Flash NextlowGPT-5.6 LunahighvsQwen3.8 Flash NextlowClaude Opus 4.7mediumvsGPT-5.6 LunahighClaude Opus 4.7mediumvsSeed-2.0-Codelow