AI BENCHY Categorie
Domeinspecifiek-ranglijst
Zie welke AI-modellen het best presteren op Domeinspecifiek, welke betrouwbaar blijven en waar de grootste verschillen zitten. Sorteren op: Correcte tests โ.
| Rang | Model | Bedrijf | Domeinspecifiek-score | Score | Correcte tests | Responstijd (gem.) |
|---|---|---|---|---|---|---|
| #14 | Gemma 4 31B medium | 7.7 | 8.3 | 2/3 | 38.5s | |
| #21 | Gemini 3 Flash Preview none | 7.7 | 8.1 | 2/3 | 963ms | |
| #42 | Claude Sonnet 4.6 none | Anthropic | 7.7 | 7.4 | 2/3 | 3.54s |
| #48 | Gemma 4 31B none | 7.7 | 6.9 | 2/3 | 3.22s | |
| #59 | Qwen3.5-Flash none | Qwen | 7.7 | 6.2 | 2/3 | 905ms |
| #63 | Qwen3.5-35B-A3B none | Qwen | 7.7 | 6.1 | 2/3 | 485ms |
| #74 | GLM 4.7 Flash none | Z.ai | 7.7 | 5.6 | 2/3 | 744ms |
| #1 | Gemini 3 Flash Preview medium | 10.0 | 10.0 | 3/3 | 21.1s |