Navigasi
AI BENCHY
Your ad here

AI BENCHY Compare

Anthropic: Claude Opus 4.6 vs HY3 Preview

Benchmark dihasilkan dari suite pengujian AI BENCHY pada: 2026-04-29

Metrik Claude Opus 4.6 Claude Opus 4.6 medium Rilis: 2026-02-05 HY3 Preview HY3 Preview high Rilis: 2026-04-22 Tersedia gratis
Skor 7.6 8.5
Peringkat #49 #13
Keandalan T/A T/A
Konsistensi 9.1 8.8
Tes benar
Tingkat lulus per percobaan 70.4% 81.5%
Tes tidak stabil 2 3
Total Run 54 50
Biaya per hasil 12.047 0.000
Total Biaya $1.446 $0.000
Harga input $5.000 / 1M $0.000 / 1M
Harga output $25.000 / 1M $0.000 / 1M
Token output 29,829 238,920
Token penalaran 18,938 0
Waktu respons (rata-rata) 21.08s 55.19s
Waktu respons (maks) 83.40s 149.94s
Waktu respons (total) 231.84s 938.23s

Model teratas berdasarkan skor

Skor vs Total Biaya

Waktu respons (rata-rata)

Skor vs Waktu respons (rata-rata)

Total token output

Skor vs Total token output

Rincian Kategori

Trik anti-AI Skor Konsistensi Tingkat lulus per percobaan Tes tidak stabil Tes benar Waktu respons (rata-rata) Token output Token penalaran
Claude Opus 4.6 6.4 5.8 66.7% 2 7.45s 986 1,071
HY3 Preview 10.0 10.0 100.0% 0 32.69s 26,550 0
Pemrograman Skor Konsistensi Tingkat lulus per percobaan Tes tidak stabil Tes benar Waktu respons (rata-rata) Token output Token penalaran
Claude Opus 4.6 10.0 10.0 100.0% 0 23.11s 3,486 1,504
HY3 Preview 10.0 10.0 100.0% 0 99.76s 38,167 0
Gabungan Skor Konsistensi Tingkat lulus per percobaan Tes tidak stabil Tes benar Waktu respons (rata-rata) Token output Token penalaran
Claude Opus 4.6 10.0 10.0 100.0% 0 76.66s 8,178 5,194
HY3 Preview 10.0 10.0 100.0% 0 113.09s 31,319 0
Parsing dan ekstraksi data Skor Konsistensi Tingkat lulus per percobaan Tes tidak stabil Tes benar Waktu respons (rata-rata) Token output Token penalaran
Claude Opus 4.6 10.0 10.0 100.0% 0 7.37s 691 757
HY3 Preview 6.5 10.0 50.0% 0 12.11s 4,323 0
Spesifik domain Skor Konsistensi Tingkat lulus per percobaan Tes tidak stabil Tes benar Waktu respons (rata-rata) Token output Token penalaran
Claude Opus 4.6 3.0 10.0 0.0% 0 83.40s 14,642 8,687
HY3 Preview 5.3 7.2 44.4% 1 109.04s 87,559 0
Kecerdasan umum Skor Konsistensi Tingkat lulus per percobaan Tes tidak stabil Tes benar Waktu respons (rata-rata) Token output Token penalaran
Claude Opus 4.6 10.0 10.0 100.0% 0 5.04s 188 292
HY3 Preview 10.0 10.0 100.0% 0 24.31s 5,490 0
Kepatuhan instruksi Skor Konsistensi Tingkat lulus per percobaan Tes tidak stabil Tes benar Waktu respons (rata-rata) Token output Token penalaran
Claude Opus 4.6 10.0 10.0 100.0% 0 2.43s 266 467
HY3 Preview 8.5 6.8 83.3% 1 34.02s 13,331 0
Pemecahan teka-teki Skor Konsistensi Tingkat lulus per percobaan Tes tidak stabil Tes benar Waktu respons (rata-rata) Token output Token penalaran
Claude Opus 4.6 7.7 10.0 66.7% 0 4.60s 531 637
HY3 Preview 9.0 7.9 88.9% 1 28.07s 21,811 0
Pemanggilan alat Skor Konsistensi Tingkat lulus per percobaan Tes tidak stabil Tes benar Waktu respons (rata-rata) Token output Token penalaran
Claude Opus 4.6 10.0 10.0 100.0% 0 9.73s 861 329
HY3 Preview 10.0 10.0 100.0% 0 78.83s 10,370 0

Perbandingan Cepat

Ganti Pasangan Perbandingan