AI BENCHY
Advertise here
#22

GPT-5.2 Chat

OpenAI रिलीज़: 2025-12-11 परीक्षण किया गया: 2026-06-04 13:47 openai/gpt-5.2-chat::none

सारांश

GPT-5.2 Chat AI BENCHY पर 8.5 स्कोर करता है और #22 पर है। इसकी reliability 10.0, pass rate 74.6%, कुल लागत $0.393, और औसत response time 7.13s है।

GPT-5.2 Chat को अलग क्या बनाता है: यह समान मॉडलों की तुलना में काफ़ी तेज है।

संगति

8.9

कुल आउटपुट टोकन

23,744

कुल इनपुट टोकन

34,212

इनपुट कीमत

$1.750 / 1M

आउटपुट कीमत

$14.000 / 1M

सही परीक्षण

गलत टेस्ट: 7

प्रति प्रयास पास दर: 74.6%

अस्थिर टेस्ट

3

अस्थिर टेस्ट में रनों के बीच मिले-जुले परिणाम रहे (कम से कम एक पास और एक फेल)।

प्रतिक्रिया समय (औसत)

7.13s

प्रतिक्रिया समय (अधिकतम): 38.52s

प्रतिक्रिया समय (कुल): 149.69s

Generation showcase

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#22 GPT-5.2 Chat

none
Cost
$0.010
Time
15.3s
Tokens
797 tok

रन इतिहास

परीक्षण किया गया स्कोर विश्वसनीयता सही परीक्षण कुल लागत तुलना करें
2026-06-04 13:47 नया टेस्ट जोड़ा गया 7.9 10.0 $0.393 वर्तमान रन
2026-05-22 00:19 सूट बदला गया 7.6 10.0 $0.355 तुलना करें
2026-04-11 01:44 पहला दर्ज रन 7.9 लागू नहीं $0.291 तुलना करें

इस रन में अलग बेंचमार्क सूट इस्तेमाल हुआ था। ऐतिहासिक बदलाव पढ़ते समय सूट बदलाव को ध्यान में रखें।

कीमत का इतिहास

OpenRouter से इस मॉडल का ऐतिहासिक मूल्य डेटा।

तारीख इनपुट कीमत आउटपुट कीमत
2026-06-04 15:40 $1.750 / 1M $14.000 / 1M

चार्ट

पहले मॉडल चुनें, फिर दूसरा मॉडल क्लिक करके साइड-बाय-साइड पेज खोलें।

कुल आउटपुट टोकन

स्कोर vs कुल आउटपुट टोकन

त्वरित तुलना

श्रेणी विवरण

श्रेणी स्कोर संगति सही परीक्षण
एंटी-एआई ट्रिक्स 8.7 7.9
कोडिंग 8.8 7.8
संयुक्त 10.0 10.0
डेटा पार्सिंग और निष्कर्षण 10.0 10.0
डोमेन-विशिष्ट 5.3 10.0
Samanya Buddhimatta 4.4 3.0
निर्देश पालन 9.8 10.0
पहेली समाधान 7.7 10.0
टूल कॉलिंग 10.0 10.0
सामान्य ज्ञान 3.0 10.0

तुलना किए गए मॉडल