Programare: Răspuns greșit
Programare
Răspuns greșit
Vezi ce modele AI au cele mai mari șanse să întâmpine Răspuns greșit la Programare, ca să găsești mai repede punctele slabe.
Motive de eșec
197/197
Filtrează modelele
Niciun model nu corespunde căutării și filtrelor curente.
| Rang | Model | Companie | Număr de Răspuns greșit | Scor de categorie | Cost total | Teste corecte | Timp de răspuns (mediu) |
|---|---|---|---|---|---|---|---|
| #96 | Grok 4.6 low | X AI | 2 | 5.5 | $0.449 | 1/3 | 21.7s |
| #97 | Gemini 3 Flash Preview low | 2 | 5.8 | $0.185 | 1/3 | 6.00s | |
| #99 | GLM 5.3 high | Z.ai | 2 | 6.6 | $0.403 | 1/3 | 18.9s |
| #101 | Gemini 3.1 Flash Lite medium | 2 | 5.5 | $0.120 | 1/3 | 3.81s | |
| #102 | Qwen3.7 Plus none | Qwen | 2 | 5.5 | $0.106 | 1/3 | 2.15s |
| #106 | KAT-Coder-Pro V2.5 high | Kwaipilot | 2 | 6.4 | $0.506 | 1/3 | 22.0s |
| #108 | Qwen3.5 Plus 2026-04-20 medium | Qwen | 2 | 6.2 | $0.323 | 1/3 | 125.3s |
| #109 | Qwen3.7 Flash low | Qwen | 2 | 6.7 | $0.043 | 1/3 | 42.4s |
| #116 | GPT-5.6 Sol none | OpenAI | 2 | 5.5 | $0.262 | 1/3 | 1.39s |
| #119 | GPT-5.5 none | OpenAI | 2 | 5.5 | $0.544 | 1/3 | 1.35s |
| #121 | Grok 4.20 medium | X AI | 2 | 6.3 | $0.805 | 1/3 | 109.9s |
| #125 | Qwen3.7 Flash medium | Qwen | 2 | 6.2 | $0.065 | 1/3 | 46.8s |
| #134 | GLM 5.3 low | Z.ai | 2 | 6.2 | $0.257 | 1/3 | 21.0s |
| #136 | Gemini 3 Flash Preview none | 2 | 5.5 | $0.085 | 1/3 | 1.80s | |
| #138 | GLM 5.2 none | Z.ai | 2 | 3.7 | $0.153 | 0/3 | 7.55s |