डोमेन-विशिष्ट मॉडल रैंकिंग

देखें कि डोमेन-विशिष्ट में कौन से AI मॉडल सबसे अच्छा प्रदर्शन करते हैं, कौन से भरोसेमंद बने रहते हैं और सबसे बड़े अंतर कहाँ दिखाई देते हैं।

दिखाए गए मॉडल

औसत डोमेन-विशिष्ट स्कोर

4.7

सर्वश्रेष्ठ मॉडल

Gemini 3 Flash Preview 10.0

विफलता के कारण

विफलता कारण गलत उत्तर के साथ412 विफलता कारण समय समाप्त के साथ43 विफलता कारण अतिरिक्त फॉर्मेटिंग के साथ17 विफलता कारण कोई उत्तर नहीं के साथ8 विफलता कारण API त्रुटि के साथ7 विफलता कारण निर्देशों का पालन नहीं किया के साथ1

210/210

रैंक	मॉडल	कंपनी	डोमेन-विशिष्ट स्कोर	स्कोर	कुल लागत	सही परीक्षण	प्रतिक्रिया समय (औसत)
#113	MiMo-V2-Flash medium	Xiaomi	5.9	6.3	$0.043	1/3	96.0s
कुल टेस्ट 3 गलत टेस्ट 2 कुल लागत $0.043 प्रतिक्रिया समय (औसत) 96.0s
#118	Gemini 2.5 Flash none	Google	5.9	6.2	$0.017	1/3	495ms
कुल टेस्ट 3 गलत टेस्ट 2 कुल लागत $0.017 प्रतिक्रिया समय (औसत) 495ms
#153	Hy3 preview low	Tencent	5.9	5.5	$0.015	1/3	40.4s
कुल टेस्ट 3 गलत टेस्ट 2 कुल लागत $0.015 प्रतिक्रिया समय (औसत) 40.4s
#203	Grok 4.1 Fast none	X AI	5.9	3.8	$0.008	1/3	1.06s
कुल टेस्ट 3 गलत टेस्ट 2 कुल लागत $0.008 प्रतिक्रिया समय (औसत) 1.06s
#210	LFM2-24B-A2B none	Liquid	5.9	2.2	$0.001	1/3	287ms
कुल टेस्ट 3 गलत टेस्ट 2 कुल लागत $0.001 प्रतिक्रिया समय (औसत) 287ms
#33	Kimi K3 max	Moonshot AI	5.9	8.0	$3.112	1/3	490.1s
कुल टेस्ट 3 गलत टेस्ट 2 कुल लागत $3.112 प्रतिक्रिया समय (औसत) 490.1s
#185	Grok 4.1 Fast medium	X AI	5.8	4.7	$0.069	1/3	121.8s
कुल टेस्ट 3 गलत टेस्ट 2 कुल लागत $0.069 प्रतिक्रिया समय (औसत) 121.8s
#47	MiniMax M3 medium	Minimax	5.5	7.6	$0.286	1/3	233.1s
कुल टेस्ट 3 गलत टेस्ट 2 कुल लागत $0.286 प्रतिक्रिया समय (औसत) 233.1s
#52	Kimi K2.7 Code medium	Moonshot AI	5.5	7.5	$0.751	1/3	213.3s
कुल टेस्ट 3 गलत टेस्ट 2 कुल लागत $0.751 प्रतिक्रिया समय (औसत) 213.3s
#6	GPT-5.5 low	OpenAI	5.3	9.3	$1.253	1/3	28.1s
कुल टेस्ट 3 गलत टेस्ट 2 कुल लागत $1.253 प्रतिक्रिया समय (औसत) 28.1s
#14	Claude Opus 4.8 medium	Anthropic	5.3	8.8	$1.931	1/3	14.6s
कुल टेस्ट 3 गलत टेस्ट 2 कुल लागत $1.931 प्रतिक्रिया समय (औसत) 14.6s
#30	GPT-5.2 Chat none	OpenAI	5.3	8.0	$0.604	1/3	17.8s
कुल टेस्ट 3 गलत टेस्ट 2 कुल लागत $0.604 प्रतिक्रिया समय (औसत) 17.8s
#34	GPT-5.6 Terra high	OpenAI	5.3	8.0	$1.055	1/3	43.4s
कुल टेस्ट 3 गलत टेस्ट 2 कुल लागत $1.055 प्रतिक्रिया समय (औसत) 43.4s
#39	GPT-5.6 Terra medium	OpenAI	5.3	7.8	$0.676	1/3	23.4s
कुल टेस्ट 3 गलत टेस्ट 2 कुल लागत $0.676 प्रतिक्रिया समय (औसत) 23.4s
#41	Claude Opus 4.8 low	Anthropic	5.3	7.8	$2.077	1/3	45.5s
कुल टेस्ट 3 गलत टेस्ट 2 कुल लागत $2.077 प्रतिक्रिया समय (औसत) 45.5s

डोमेन-विशिष्ट रैंकिंग

मॉडल फ़िल्टर करें

डोमेन-विशिष्ट स्कोर के अनुसार शीर्ष मॉडल

डोमेन-विशिष्ट स्कोर बनाम कुल लागत

प्रतिक्रिया समय (औसत) के अनुसार शीर्ष मॉडल