Navigasi
AI BENCHY
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

Thinking Machines: Inkling vs xAI: Grok 4.5

Grok 4.5 (medium) unggul dalam skor rata-rata dengan 8.3 vs 8.0. Inkling (high) memiliki biaya benchmark lebih rendah di $1.006 vs $1.928. Grok 4.5 (medium) lebih cepat di 61.71s vs 64.16s, dengan tingkat keberhasilan 77.3% vs 78.8%.

Model yang direkomendasikanInkling (high)Its score stays close to the best score here (8.0 vs 8.3), while costing about 1.9x less than Grok 4.5 (medium).

Benchmark dihasilkan dari suite pengujian AI BENCHY pada: 2026-07-22

Metrik Inkling Inkling high Rilis: 2026-07-18 Grok 4.5 Grok 4.5 medium Rilis: 2026-07-08
Skor 8.0 8.3
Peringkat #32 #25
Keandalan 9.8 10.0
Konsistensi 8.9 8.9
Tes benar
Tingkat lulus per percobaan 77.3% 78.8%
Tes tidak stabil 3 3
Total Run 66 66
Biaya per hasil 6.704 12.049
Total Biaya $1.006 $1.928
Harga input $1.000 / 1M $2.000 / 1M
Harga output $4.050 / 1M $6.000 / 1M
Total token input 86,746 122,146
Token output 6,055 5,514
Token penalaran 220,791 275,053
Waktu respons (rata-rata) 64.16s 61.71s
Waktu respons (maks) 327.51s 436.38s
Waktu respons (total) 1411.59s 1357.56s

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#32 Thinking Machines: Inkling

high
Biaya
$0.005
Waktu
32.2s
Token
1,275 tok

#25 xAI: Grok 4.5

medium
Biaya
$0.044
Waktu
59.4s
Token
7,512 tok

Model teratas berdasarkan skor

Skor vs Total Biaya

Waktu respons (rata-rata)

Skor vs Waktu respons (rata-rata)

Total token output

Skor vs Total token output

Rincian Kategori

Pemrograman Skor Konsistensi Tingkat lulus per percobaan Tes tidak stabil Tes benar Waktu respons (rata-rata) Token input Token output Token penalaran
Inkling 8.5 10.0 66.7% 0 148.36s 7,374 430 78,982
Grok 4.5 7.6 7.2 77.8% 1 155.69s 9,579 390 104,634

Perbandingan Cepat

Ganti Pasangan Perbandingan