डोमेन-विशिष्ट मॉडल रैंकिंग

देखें कि डोमेन-विशिष्ट में कौन से AI मॉडल सबसे अच्छा प्रदर्शन करते हैं, कौन से भरोसेमंद बने रहते हैं और सबसे बड़े अंतर कहाँ दिखाई देते हैं। क्रमबद्ध करें: प्रतिक्रिया समय (औसत) ↓.

दिखाए गए मॉडल

औसत डोमेन-विशिष्ट स्कोर

4.7

सर्वश्रेष्ठ मॉडल

Kimi K3 5.9

विफलता के कारण

विफलता कारण गलत उत्तर के साथ412 विफलता कारण समय समाप्त के साथ43 विफलता कारण अतिरिक्त फॉर्मेटिंग के साथ17 विफलता कारण कोई उत्तर नहीं के साथ8 विफलता कारण API त्रुटि के साथ7 विफलता कारण निर्देशों का पालन नहीं किया के साथ1

210/210

रैंक	मॉडल	कंपनी	डोमेन-विशिष्ट स्कोर	स्कोर	कुल लागत	सही परीक्षण	प्रतिक्रिया समय (औसत)
#33	Kimi K3 max	Moonshot AI	5.9	8.0	$3.112	1/3	490.1s
कुल टेस्ट 3 गलत टेस्ट 2 कुल लागत $3.112 प्रतिक्रिया समय (औसत) 490.1s
#97	LongCat 2.0 high	Meituan	3.6	6.6	$0.469	0/3	400.3s
कुल टेस्ट 3 गलत टेस्ट 3 कुल लागत $0.469 प्रतिक्रिया समय (औसत) 400.3s
#60	LongCat 2.0 medium	Meituan	2.9	7.4	$0.478	0/3	339.9s
कुल टेस्ट 3 गलत टेस्ट 3 कुल लागत $0.478 प्रतिक्रिया समय (औसत) 339.9s
#12	Grok 4.5 high	X AI	3.6	8.9	$1.707	0/3	332.1s
कुल टेस्ट 3 गलत टेस्ट 3 कुल लागत $1.707 प्रतिक्रिया समय (औसत) 332.1s
#190	MiniMax M2.5 medium	Minimax	2.9	4.6	$0.340	0/3	237.3s
कुल टेस्ट 3 गलत टेस्ट 3 कुल लागत $0.340 प्रतिक्रिया समय (औसत) 237.3s
#47	MiniMax M3 medium	Minimax	5.5	7.6	$0.286	1/3	233.1s
कुल टेस्ट 3 गलत टेस्ट 2 कुल लागत $0.286 प्रतिक्रिया समय (औसत) 233.1s
#52	Kimi K2.7 Code medium	Moonshot AI	5.5	7.5	$0.751	1/3	213.3s
कुल टेस्ट 3 गलत टेस्ट 2 कुल लागत $0.751 प्रतिक्रिया समय (औसत) 213.3s
#128	GPT-5 Nano medium	OpenAI	5.2	6.1	$0.114	1/3	204.0s
कुल टेस्ट 3 गलत टेस्ट 2 कुल लागत $0.114 प्रतिक्रिया समय (औसत) 204.0s
#68	Kimi K2.6 medium	Moonshot AI	5.3	7.2	$1.036	1/3	202.4s
कुल टेस्ट 3 गलत टेस्ट 2 कुल लागत $1.036 प्रतिक्रिया समय (औसत) 202.4s
#22	Grok 4.5 medium	X AI	2.9	8.3	$1.928	0/3	198.9s
कुल टेस्ट 3 गलत टेस्ट 3 कुल लागत $1.928 प्रतिक्रिया समय (औसत) 198.9s
#28	Inkling high	Thinkingmachines	7.7	8.0	$1.006	2/3	186.4s
कुल टेस्ट 3 गलत टेस्ट 1 कुल लागत $1.006 प्रतिक्रिया समय (औसत) 186.4s
#73	Grok 4.3 medium	X AI	5.3	7.1	$0.779	1/3	181.7s
कुल टेस्ट 3 गलत टेस्ट 2 कुल लागत $0.779 प्रतिक्रिया समय (औसत) 181.7s
#194	GLM 4.7 Flash medium	Z.ai	3.5	4.3	$0.166	0/3	174.6s
कुल टेस्ट 3 गलत टेस्ट 3 कुल लागत $0.166 प्रतिक्रिया समय (औसत) 174.6s
#130	Step 3.5 Flash medium	Stepfun	5.3	6.0	$0.108	1/3	170.5s
कुल टेस्ट 3 गलत टेस्ट 2 कुल लागत $0.108 प्रतिक्रिया समय (औसत) 170.5s
#10	GPT-5.5 medium	OpenAI	5.3	9.0	$4.137	1/3	164.1s
कुल टेस्ट 3 गलत टेस्ट 2 कुल लागत $4.137 प्रतिक्रिया समय (औसत) 164.1s

1 2 14

→

डोमेन-विशिष्ट रैंकिंग

मॉडल फ़िल्टर करें

डोमेन-विशिष्ट स्कोर के अनुसार शीर्ष मॉडल

डोमेन-विशिष्ट स्कोर बनाम कुल लागत

प्रतिक्रिया समय (औसत) के अनुसार शीर्ष मॉडल