पहेली समाधान मॉडल रैंकिंग

देखें कि पहेली समाधान में कौन से AI मॉडल सबसे अच्छा प्रदर्शन करते हैं, कौन से भरोसेमंद बने रहते हैं और सबसे बड़े अंतर कहाँ दिखाई देते हैं। क्रमबद्ध करें: सही परीक्षण ↓.

दिखाए गए मॉडल

औसत पहेली समाधान स्कोर

6.7

सर्वश्रेष्ठ मॉडल

Gemini 3 Flash Preview 10.0

विफलता के कारण

विफलता कारण गलत उत्तर के साथ201 विफलता कारण निर्देशों का पालन नहीं किया के साथ90 विफलता कारण API त्रुटि के साथ12 विफलता कारण अतिरिक्त फॉर्मेटिंग के साथ8 विफलता कारण समय समाप्त के साथ5 विफलता कारण कोई उत्तर नहीं के साथ3

210/210

रैंक	मॉडल	कंपनी	पहेली समाधान स्कोर	स्कोर	कुल लागत	सही परीक्षण	प्रतिक्रिया समय (औसत)
#33	Kimi K3 max	Moonshot AI	10.0	8.0	$3.112	3/3	7.36s
कुल टेस्ट 3 गलत टेस्ट 0 कुल लागत $3.112 प्रतिक्रिया समय (औसत) 7.36s
#36	Qwen3.7 Plus medium	Qwen	10.0	7.9	$0.267	3/3	16.4s
कुल टेस्ट 3 गलत टेस्ट 0 कुल लागत $0.267 प्रतिक्रिया समय (औसत) 16.4s
#37	Qwen3.6 Plus medium	Qwen	10.0	7.8	$0.405	3/3	6.34s
कुल टेस्ट 3 गलत टेस्ट 0 कुल लागत $0.405 प्रतिक्रिया समय (औसत) 6.34s
#40	Claude Sonnet 4.6 medium	Anthropic	10.0	7.8	$2.057	3/3	5.31s
कुल टेस्ट 3 गलत टेस्ट 0 कुल लागत $2.057 प्रतिक्रिया समय (औसत) 5.31s
#41	Claude Opus 4.8 low	Anthropic	10.0	7.8	$2.077	3/3	3.01s
कुल टेस्ट 3 गलत टेस्ट 0 कुल लागत $2.077 प्रतिक्रिया समय (औसत) 3.01s
#42	GLM 5 medium	Z.ai	10.0	7.7	$0.307	3/3	11.3s
कुल टेस्ट 3 गलत टेस्ट 0 कुल लागत $0.307 प्रतिक्रिया समय (औसत) 11.3s
#54	GPT-5.3 Chat none	OpenAI	10.0	7.5	$0.571	3/3	2.99s
कुल टेस्ट 3 गलत टेस्ट 0 कुल लागत $0.571 प्रतिक्रिया समय (औसत) 2.99s
#55	GPT-5.6 Terra low	OpenAI	10.0	7.5	$0.519	3/3	4.46s
कुल टेस्ट 3 गलत टेस्ट 0 कुल लागत $0.519 प्रतिक्रिया समय (औसत) 4.46s
#57	Qwen3.5 Plus 2026-02-15 medium	Qwen	10.0	7.5	$0.437	3/3	32.5s
कुल टेस्ट 3 गलत टेस्ट 0 कुल लागत $0.437 प्रतिक्रिया समय (औसत) 32.5s
#59	Qwen3.7 Max none	Qwen	10.0	7.4	$0.197	3/3	1.13s
कुल टेस्ट 3 गलत टेस्ट 0 कुल लागत $0.197 प्रतिक्रिया समय (औसत) 1.13s
#61	Gemini 3 Flash Preview low	Google	10.0	7.4	$0.177	3/3	5.77s
कुल टेस्ट 3 गलत टेस्ट 0 कुल लागत $0.177 प्रतिक्रिया समय (औसत) 5.77s
#72	Qwen3.5-122B-A10B medium	Qwen	10.0	7.1	$1.046	3/3	17.9s
कुल टेस्ट 3 गलत टेस्ट 0 कुल लागत $1.046 प्रतिक्रिया समय (औसत) 17.9s
#79	Gemini 3.5 Flash none	Google	10.0	7.0	$1.079	3/3	3.13s
कुल टेस्ट 3 गलत टेस्ट 0 कुल लागत $1.079 प्रतिक्रिया समय (औसत) 3.13s
#82	DeepSeek V4 Pro none	DeepSeek	10.0	6.9	$0.096	3/3	3.61s
कुल टेस्ट 3 गलत टेस्ट 0 कुल लागत $0.096 प्रतिक्रिया समय (औसत) 3.61s
#88	Gemini 3.5 Flash minimal	Google	10.0	6.8	$0.300	3/3	1.45s
कुल टेस्ट 3 गलत टेस्ट 0 कुल लागत $0.300 प्रतिक्रिया समय (औसत) 1.45s

पहेली समाधान रैंकिंग

मॉडल फ़िल्टर करें

पहेली समाधान स्कोर के अनुसार शीर्ष मॉडल

पहेली समाधान स्कोर बनाम कुल लागत

प्रतिक्रिया समय (औसत) के अनुसार शीर्ष मॉडल