Navigasi
AI BENCHY
Advertise here

AI BENCHY Compare

Anthropic: Claude Fable 5 vs OpenAI: GPT-5.2 Chat

Ringkasan

Perbandingan benchmark Claude Fable 5 vs GPT-5.2 Chat: Claude Fable 5 unggul dalam skor rata-rata dengan 8.7 vs 7.9. GPT-5.2 Chat memiliki biaya benchmark lebih rendah di $0.393 vs $3.165. GPT-5.2 Chat lebih cepat di 7.13s vs 17.01s, dengan tingkat keberhasilan 82.5% vs 74.6%.

Model yang direkomendasikan: GPT-5.2 Chat - Its score stays close to the best score here (7.9 vs 8.7), while costing about 8.1x less than Claude Fable 5.

Benchmark dihasilkan dari suite pengujian AI BENCHY pada: 2026-06-10

Metrik Claude Fable 5 Claude Fable 5 medium Rilis: 2026-06-10 GPT-5.2 Chat GPT-5.2 Chat none Rilis: 2025-12-11
Skor 8.7 7.9
Peringkat #12 #25
Keandalan 10.0 10.0
Konsistensi 9.6 8.9
Tes benar
Tingkat lulus per percobaan 82.5% 74.6%
Tes tidak stabil 1 3
Total Run 63 63
Biaya per hasil 18.614 2.803
Total Biaya $3.165 $0.393
Harga input $10.000 / 1M $1.750 / 1M
Harga output $50.000 / 1M $14.000 / 1M
Total token input 58,383 34,212
Token output 41,340 23,744
Token penalaran 10,269 0
Waktu respons (rata-rata) 17.01s 7.13s
Waktu respons (maks) 80.80s 38.52s
Waktu respons (total) 357.17s 149.69s

Generation showcase

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#12 Claude Fable 5

medium
Cost
$0.606
Time
156.7s
Tokens
12,264 tok

#25 GPT-5.2 Chat

none
Cost
$0.010
Time
15.3s
Tokens
797 tok

Model teratas berdasarkan skor

Skor vs Total Biaya

Waktu respons (rata-rata)

Skor vs Waktu respons (rata-rata)

Total token output

Skor vs Total token output

Rincian Kategori

Trik anti-AI Skor Konsistensi Tingkat lulus per percobaan Tes tidak stabil Tes benar Waktu respons (rata-rata) Token input Token output Token penalaran
Claude Fable 5 10.0 10.0 100.0% 0 6.20s 834 530 402
GPT-5.2 Chat 8.7 7.9 91.7% 1 3.40s 606 1,807 0
Pemrograman Skor Konsistensi Tingkat lulus per percobaan Tes tidak stabil Tes benar Waktu respons (rata-rata) Token input Token output Token penalaran
Claude Fable 5 10.0 10.0 100.0% 0 15.59s 10,590 7,383 1,318
GPT-5.2 Chat 8.8 7.8 88.9% 1 9.82s 7,305 6,731 0
Gabungan Skor Konsistensi Tingkat lulus per percobaan Tes tidak stabil Tes benar Waktu respons (rata-rata) Token input Token output Token penalaran
Claude Fable 5 10.0 10.0 100.0% 0 33.70s 20,937 2,353 1,599
GPT-5.2 Chat 10.0 10.0 100.0% 0 9.12s 11,019 1,243 0
Parsing dan ekstraksi data Skor Konsistensi Tingkat lulus per percobaan Tes tidak stabil Tes benar Waktu respons (rata-rata) Token input Token output Token penalaran
Claude Fable 5 10.0 10.0 100.0% 0 7.18s 10,503 521 363
GPT-5.2 Chat 10.0 10.0 100.0% 0 3.05s 7,140 980 0
Spesifik domain Skor Konsistensi Tingkat lulus per percobaan Tes tidak stabil Tes benar Waktu respons (rata-rata) Token input Token output Token penalaran
Claude Fable 5 5.3 7.2 44.4% 1 53.40s 975 25,215 5,001
GPT-5.2 Chat 5.3 10.0 33.3% 0 17.78s 723 7,810 0
Kecerdasan umum Skor Konsistensi Tingkat lulus per percobaan Tes tidak stabil Tes benar Waktu respons (rata-rata) Token input Token output Token penalaran
Claude Fable 5 10.0 10.0 100.0% 0 7.42s 708 366 144
GPT-5.2 Chat 4.4 3.0 33.3% 1 3.20s 477 335 0
Kepatuhan instruksi Skor Konsistensi Tingkat lulus per percobaan Tes tidak stabil Tes benar Waktu respons (rata-rata) Token input Token output Token penalaran
Claude Fable 5 10.0 10.0 100.0% 0 5.90s 909 139 202
GPT-5.2 Chat 9.8 10.0 100.0% 0 5.51s 660 1,441 0
Pemecahan teka-teki Skor Konsistensi Tingkat lulus per percobaan Tes tidak stabil Tes benar Waktu respons (rata-rata) Token input Token output Token penalaran
Claude Fable 5 7.7 10.0 66.7% 0 5.18s 894 402 324
GPT-5.2 Chat 7.7 10.0 66.7% 0 4.10s 642 1,603 0
Pemanggilan alat Skor Konsistensi Tingkat lulus per percobaan Tes tidak stabil Tes benar Waktu respons (rata-rata) Token input Token output Token penalaran
Claude Fable 5 10.0 10.0 100.0% 0 16.96s 11,775 729 344
GPT-5.2 Chat 10.0 10.0 100.0% 0 4.68s 5,445 555 0
Pengetahuan umum Skor Konsistensi Tingkat lulus per percobaan Tes tidak stabil Tes benar Waktu respons (rata-rata) Token input Token output Token penalaran
Claude Fable 5 3.0 10.0 0.0% 0 25.64s 258 3,702 572
GPT-5.2 Chat 3.0 10.0 0.0% 0 6.89s 195 1,239 0

Perbandingan Cepat

Ganti Pasangan Perbandingan