Kushindwa kwa kategoria za AI BENCHY
Mbinu za kupinga AI
Muundo wa ziada
Mbinu za kupinga AI
Muundo wa ziada
Ona ni modeli gani za AI zina uwezekano mkubwa wa kupata Muundo wa ziada katika Mbinu za kupinga AI, ili uone udhaifu haraka. Panga kwa: Muda wa majibu (wastani) ↑.
Sababu zinazohusiana za kushindwa
Kategoria zinazohusiana
| Nafasi | Modeli | Kampuni | Idadi ya Muundo wa ziada | Alama ya kategoria | Majaribio sahihi | Muda wa majibu (wastani) |
|---|---|---|---|---|---|---|
| #48 | Qwen3 Coder Next none | Qwen | 1 | 2.3 | 0/3 | 4.39s |
| #25 | Claude Sonnet 4.6 none | Anthropic | 2 | 4.0 | 1/3 | 4.83s |
| #11 | Claude Sonnet 4.6 medium | Anthropic | 1 | 7.0 | 2/3 | 4.95s |
| #33 | DeepSeek V3.2 none | DeepSeek | 2 | 10.0 | 0/3 | 8.79s |
| #26 | Claude Opus 4.6 medium | Anthropic | 2 | 4.0 | 1/3 | 11.9s |