AI BENCHY
तुलना करें चार्ट
❤️ Made by XCS
Your ad here

#7

GPT-5.4

OpenAI · रिलीज़: 2026-03-05 · openai/gpt-5.4::medium

औसत स्कोर

8.2

प्रति परिणाम लागत

6.533

संगति

8.9

कुल लागत

$0.784

सही परीक्षण

12

कोई टेस्ट तभी पूरी तरह पास माना जाएगा जब उसके सभी रन पास हों।

गलत टेस्ट

3

प्रति प्रयास पास दर: 86.7%

अस्थिर टेस्ट

2

अस्थिर टेस्ट में रनों के बीच मिले-जुले परिणाम रहे (कम से कम एक पास और एक फेल)।

प्रतिक्रिया समय (औसत)

21.06s

प्रतिक्रिया समय (अधिकतम): 100.41s

प्रतिक्रिया समय (कुल): 315.95s

गलत उत्तर: 2 निर्देशों का पालन नहीं किया: 1

स्कोर के अनुसार शीर्ष मॉडल

पहले मॉडल चुनें, फिर दूसरा मॉडल क्लिक करके साइड-बाय-साइड पेज खोलें।

त्वरित तुलना

श्रेणी विवरण

श्रेणी औसत स्कोर संगति सही परीक्षण
Anti-AI Tricks 10.0 10.0 3/3
Combined 10.0 10.0 1/1
Data parsing and extraction 9.9 10.0 2/2
Domain specific 4.0 7.2 1/3
Instructions following 10.0 10.0 2/2
Puzzle Solving 7.0 7.2 2/3
Tool Calling 10.0 10.0 1/1