नेविगेशन
AI BENCHY
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

OpenAI: GPT-5.5 vs Hunter Alpha

GPT-5.5 (low) average score में आगे है: 9.3 vs 4.7. Hunter Alpha (medium) की benchmark लागत कम है: $0.000 vs $1.253. GPT-5.5 (low) तेज है: 10.13s vs 10.33s, pass rates 86.4% vs 53.0%.

अनुशंसित मॉडलGPT-5.5 (low)It has the strongest score in this comparison (9.3) and the best overall balance of cost and response time across all 2 models.

बेंचमार्क AI BENCHY टेस्ट सूट्स से इस समय जनरेट किए गए:: 2026-07-25

मेट्रिक GPT-5.5 GPT-5.5 low रिलीज़: 2026-04-24 Hunter Alpha Hunter Alpha medium रिलीज़: 2026-03-11
स्कोर 9.3 4.7
रैंक #9 #199
विश्वसनीयता 10.0 लागू नहीं
संगति 10.0 6.0
सही परीक्षण
प्रति प्रयास पास दर 86.4% 53.0%
अस्थिर टेस्ट 0 6
कुल रन 66 52
प्रति परिणाम लागत 6.594 0.000
कुल लागत $1.253 $0.000
इनपुट कीमत $5.000 / 1M $0.000 / 1M
आउटपुट कीमत $30.000 / 1M $0.000 / 1M
कुल इनपुट टोकन 80,058 28,927
आउटपुट टोकन 5,378 4,682
रीजनिंग टोकन 23,040 17,969
प्रतिक्रिया समय (औसत) 10.13s 10.33s
प्रतिक्रिया समय (अधिकतम) 56.19s 30.53s
प्रतिक्रिया समय (कुल) 222.82s 175.58s

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#9 GPT-5.5

low
लागत
$0.068
समय
37.0s
टोकन
2,339 tok

#199 Hunter Alpha

medium
Hunter Alpha was a stealth model revealed on March 18th as an early testing version of MiMo-V2-Pro. Find it here: https://openrouter.ai/xiaomi/mimo-v2-pro
लागत
$0.000
समय
0.0s
टोकन
0 tok

स्कोर के अनुसार शीर्ष मॉडल

स्कोर बनाम कुल लागत

प्रतिक्रिया समय (औसत)

स्कोर vs प्रतिक्रिया समय (औसत)

कुल आउटपुट टोकन

स्कोर vs कुल आउटपुट टोकन

श्रेणी विवरण

कोडिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
GPT-5.5 10.0 10.0 100.0% 0 15.04s 7,302 423 6,402
Hunter Alpha 9.8 3.3 0.0% 0 0ms 0 0 0

त्वरित तुलना

तुलना जोड़ी बदलें