AI BENCHY
Advertise here

AI BENCHY Categorie

Domeinspecifiek-ranglijst

Zie welke AI-modellen het best presteren op Domeinspecifiek, welke betrouwbaar blijven en waar de grootste verschillen zitten. Sorteren op: Metriek โ†‘.

Getoonde modellen

15

Gemiddelde Domeinspecifiek-score

4.8

Beste model

GLM 5 Turbo 2.9
Rang Model Bedrijf Domeinspecifiek-score Score Correcte tests Responstijd (gem.)
#42 GPT-5.2 medium OpenAI 5.9 7.5 1/3 77.8s
#64 MiMo-V2-Flash medium Xiaomi 5.9 7.2 1/3 96.0s
#70 GPT-5.4 Nano medium OpenAI 5.9 7.0 1/3 38.2s
#89 Hy3 preview low Tencent 5.9 6.4 1/3 40.4s
#97 Gemini 2.5 Flash none Google 5.9 6.2 1/3 495ms
#157 Grok 4.1 Fast none X AI 5.9 4.4 1/3 1.06s
#160 LFM2-24B-A2B none Liquid 5.9 4.2 1/3 287ms
#2 Gemini 3.5 Flash high Google 7.6 9.6 2/3 14.1s
#20 Gemini 3.5 Flash none Google 7.6 8.1 2/3 10.6s
#3 Gemini 3.5 Flash low Google 7.7 9.4 2/3 3.39s
#4 Gemini 3.1 Pro Preview medium Google 7.7 9.4 2/3 32.7s
#7 Gemini 3.5 Flash medium Google 7.7 9.0 2/3 5.24s
#8 Claude Opus 4.7 none Anthropic 7.7 8.9 2/3 1.19s
#11 Claude Opus 4.7 medium Anthropic 7.7 8.7 2/3 1.17s
#22 Step 3.7 Flash medium Stepfun 7.7 8.0 2/3 48.3s

Topmodellen op Domeinspecifiek-score

Domeinspecifiek-score vs totale kosten

Topmodellen op Responstijd (gem.)