#105 Ling 3.1 Flash
high- Biaya
- $0.000
- Waktu
- 181.1s
- Token
- 21,073 tok
Ringkasan
Ling 3.1 Flash mendapat skor 7.9 di AI BENCHY dan berada di peringkat #105. Model ini memiliki reliabilitas 9.8, tingkat keberhasilan 69.6%, total biaya $0.000, dan waktu respons rata-rata 87.39s.
Yang membuat Ling 3.1 Flash unik: Model ini paling menonjol di Parsing dan ekstraksi data, dengan peringkat #1, sementara Gabungan adalah area terlemahnya di #17. Total biaya benchmark-nya sangat rendah untuk kisaran skornya.
Ditelaah pada 2026-10-03
7.9
Konsistensi
9.3
9.8
$0.000
Total token output
687,692
Total token input
324,691
Harga input
$0.000 / 1M
Harga output
$0.000 / 1M
Harga baca cache
T/A
Harga tulis cache
T/A
Harga cache berlaku untuk token input. Pembacaan memakai kembali prompt tersimpan; penulisan menyimpannya dan dapat menambah biaya. Token output menggunakan harga output.
Tes tidak stabil
2
Tes tidak stabil memiliki hasil campuran antar run (setidaknya satu lulus dan satu gagal).
Prompt: Create a detailed SVG illustration of a hamster playing table tennis.
Pilih model pertama, lalu klik model kedua untuk membuka halaman berdampingan.
| Kategori | Skor | Konsistensi | Tes benar |
|---|---|---|---|
| Tugas agen | 10.0 | 10.0 | |
| Trik anti-AI | 10.0 | 10.0 | |
| Pemrograman | 8.2 | 7.2 | |
| Gabungan | 6.3 | 10.0 | |
| Parsing dan ekstraksi data | 10.0 | 10.0 | |
| Spesifik domain | 3.0 | 10.0 | |
| Kecerdasan umum | 3.9 | 9.4 | |
| Kepatuhan instruksi | 10.0 | 10.0 | |
| Pemecahan teka-teki | 10.0 | 10.0 | |
| Pemanggilan alat | 2.8 | 2.1 | |
| Pengetahuan umum | 3.0 | 10.0 |