AI BENCHY तुलना

DeepSeek: DeepSeek V3.2 vs Owl Alpha

बेंचमार्क AI BENCHY टेस्ट सूट्स से इस समय जनरेट किए गए:: 2026-04-30

मेट्रिक	DeepSeek V3.2 DeepSeek V3.2 none रिलीज़: 2025-12-01	Owl Alpha Owl Alpha medium रिलीज़: 2026-04-30

मेट्रिक	DeepSeek V3.2 DeepSeek V3.2 none रिलीज़: 2025-12-01	Owl Alpha Owl Alpha medium रिलीज़: 2026-04-30
स्कोर	6.0	5.8
रैंक	#85	#91
विश्वसनीयता	लागू नहीं	10.0
संगति	8.6	9.5
सही परीक्षण
प्रति प्रयास पास दर	46.3%	40.7%
अस्थिर टेस्ट	3	1
कुल रन	52	54
प्रति परिणाम लागत	0.225	0.000
कुल लागत	$0.016	$0.000
???? ???	$0.252 / 1M	$0.000 / 1M
????? ???	$0.378 / 1M	$0.000 / 1M
आउटपुट टोकन	8,378	1,596
रीजनिंग टोकन	0	0
प्रतिक्रिया समय (औसत)	12.07s	11.04s
प्रतिक्रिया समय (अधिकतम)	115.89s	58.63s
प्रतिक्रिया समय (कुल)	217.28s	198.65s

स्कोर के अनुसार शीर्ष मॉडल

स्कोर बनाम कुल लागत

प्रतिक्रिया समय (औसत)

स्कोर vs प्रतिक्रिया समय (औसत)

कुल आउटपुट टोकन

स्कोर vs कुल आउटपुट टोकन

श्रेणी विवरण

एंटी-एआई ट्रिक्स	स्कोर	संगति	प्रति प्रयास पास दर	अस्थिर टेस्ट	सही परीक्षण	प्रतिक्रिया समय (औसत)	आउटपुट टोकन	रीजनिंग टोकन
DeepSeek V3.2	3.2	9.8	0.0%	0		7.63s	1,419	0
Owl Alpha	4.8	10.0	25.0%	0		3.97s	87	0

कोडिंग	स्कोर	संगति	प्रति प्रयास पास दर	अस्थिर टेस्ट	सही परीक्षण	प्रतिक्रिया समय (औसत)	आउटपुट टोकन	रीजनिंग टोकन
DeepSeek V3.2	2.4	1.3	33.3%	1		7.63s	553	0
Owl Alpha	10.0	10.0	100.0%	0		7.35s	402	0

संयुक्त	स्कोर	संगति	प्रति प्रयास पास दर	अस्थिर टेस्ट	सही परीक्षण	प्रतिक्रिया समय (औसत)	आउटपुट टोकन	रीजनिंग टोकन
DeepSeek V3.2	6.5	10.0	0.0%	0		115.89s	2,887	0
Owl Alpha	3.0	10.0	0.0%	0		10.01s	315	0

डेटा पार्सिंग और निष्कर्षण	स्कोर	संगति	प्रति प्रयास पास दर	अस्थिर टेस्ट	सही परीक्षण	प्रतिक्रिया समय (औसत)	आउटपुट टोकन	रीजनिंग टोकन
DeepSeek V3.2	6.3	5.8	66.7%	1		9.42s	1,710	0
Owl Alpha	10.0	10.0	100.0%	0		21.64s	246	0

डोमेन-विशिष्ट	स्कोर	संगति	प्रति प्रयास पास दर	अस्थिर टेस्ट	सही परीक्षण	प्रतिक्रिया समय (औसत)	आउटपुट टोकन	रीजनिंग टोकन
DeepSeek V3.2	3.0	10.0	0.0%	0		1.52s	18	0
Owl Alpha	5.3	10.0	33.3%	0		8.58s	28	0

Samanya Buddhimatta	स्कोर	संगति	प्रति प्रयास पास दर	अस्थिर टेस्ट	सही परीक्षण	प्रतिक्रिया समय (औसत)	आउटपुट टोकन	रीजनिंग टोकन
DeepSeek V3.2	10.0	10.0	100.0%	0		2.86s	67	0
Owl Alpha	4.3	10.0	0.0%	0		58.63s	98	0

निर्देश पालन	स्कोर	संगति	प्रति प्रयास पास दर	अस्थिर टेस्ट	सही परीक्षण	प्रतिक्रिया समय (औसत)	आउटपुट टोकन	रीजनिंग टोकन
DeepSeek V3.2	10.0	10.0	100.0%	0		1.52s	66	0
Owl Alpha	6.3	10.0	50.0%	0		9.59s	57	0

पहेली समाधान	स्कोर	संगति	प्रति प्रयास पास दर	अस्थिर टेस्ट	सही परीक्षण	प्रतिक्रिया समय (औसत)	आउटपुट टोकन	रीजनिंग टोकन
DeepSeek V3.2	8.5	7.5	88.9%	1		7.37s	1,136	0
Owl Alpha	3.4	7.2	11.1%	1		3.44s	135	0

टूल कॉलिंग	स्कोर	संगति	प्रति प्रयास पास दर	अस्थिर टेस्ट	सही परीक्षण	प्रतिक्रिया समय (औसत)	आउटपुट टोकन	रीजनिंग टोकन
DeepSeek V3.2	10.0	10.0	100.0%	0		11.85s	522	0
Owl Alpha	10.0	10.0	100.0%	0		8.26s	228	0

त्वरित तुलना

तुलना जोड़ी बदलें

Kimi K2.6nonevsOwl Alphamedium GPT-5.4nonevsOwl Alphamedium Owl AlphamediumvsQwen3.5-122B-A10Bnone Owl AlphamediumvsQwen3.5 Plus 2026-04-20none Owl AlphamediumvsMiMo-V2.5-Pronone Owl AlphamediumvsQwen3.6 Flashnone Owl AlphamediumvsGLM 5.1none DeepSeek V3.2nonevsLaguna Xs.2mediumनिःशुल्क उपलब्ध Owl AlphamediumvsMiMo-V2-Pronone DeepSeek V3.2nonevsgpt-oss-120bmediumनिःशुल्क उपलब्ध Owl AlphamediumvsQwen3.5-27Bnone Owl AlphamediumvsQwen3.6 27Bnone