- Scor
- 8.0 (+0.86 puncte)
- Cost total (preț curent)
- $0.045 · cu 77.0% mai ieftin
- Timp de răspuns (mediu)
- 23.66s · cu 77.0% mai rapid
Rezumat
Qwen3.8 Flash Next obține 7.1 pe AI BENCHY și este pe #154. Are fiabilitate 9.9, rată de reușită 72.5%, cost total ~$0.195 și timp mediu de răspuns 102.66s.
Ce face Qwen3.8 Flash Next unic: Folosește neobișnuit de multe tokenuri de raționament, ceea ce poate explica rulări mai lente sau mai scumpe.
Alternative recomandate
Recomandăm să alegi acest model în schimb:
Date despre model
Documentat la 2026-10-04
- Parametri
- 180B în total (6B activi)
- Arhitectură
- MoE
- Disponibilitate
- Ponderi disponibile
- Licență
- Qwen Community License 1.0
7.1
Consistență
7.9
9.9
~$0.195
Total tokenuri de ieșire
621,056
Total tokenuri de intrare
301,749
Cost estimat al energiei pentru benchmark
~$0.195
Teste instabile
6
Testele instabile au avut rezultate mixte între rulări (cel puțin un succes și un eșec).
Hamster playing table tennis
Prompt: Create a detailed SVG illustration of a hamster playing table tennis.
#154 Qwen3.8 Flash Next
xhigh- Cost
- ~$0.010
- Timp
- 333.1s
- Tokenuri
- 30,654 tok
Grafice
Alege primul model, apoi fă clic pe al doilea model pentru a deschide o pagină alăturată.
Top modele după scor
Scor vs Cost total
Timp de răspuns (mediu)
Scor vs Timp de răspuns (mediu)
Total tokenuri de ieșire
Scor vs Total tokenuri de ieșire
Comparație rapidă
Defalcare pe categorii
| Categorie | Scor | Consistență | Teste corecte |
|---|---|---|---|
| Sarcini agentice | 4.7 | 3.1 | |
| Trucuri anti-AI | 10.0 | 10.0 | |
| Programare | 7.4 | 7.0 | |
| Combinat | 7.3 | 5.8 | |
| Parsare și extragere de date | 10.0 | 10.0 | |
| Specific domeniului | 3.5 | 4.4 | |
| Inteligență generală | 4.7 | 3.1 | |
| Respectarea instrucțiunilor | 9.8 | 10.0 | |
| Rezolvare de puzzle-uri | 7.7 | 10.0 | |
| Apelare instrumente | 10.0 | 10.0 | |
| Cultură generală | 3.0 | 10.0 |