عمومی ذہانت ماڈل درجہ بندی

دیکھیں کہ عمومی ذہانت میں کون سے AI ماڈلز بہترین کارکردگی دکھاتے ہیں، کون سے قابلِ اعتماد رہتے ہیں، اور سب سے بڑے فرق کہاں نظر آتے ہیں۔ ترتیب دیں حسب: میٹرک ↑.

دکھائے گئے ماڈلز

اوسط عمومی ذہانت اسکور

6.1

بہترین ماڈل

Qwen3.5-35B-A3B 2.8

ناکامی کی وجوہات

ناکامی کی وجہ ہدایات پر عمل نہیں کیا کے ساتھ78 ناکامی کی وجہ غلط جواب کے ساتھ59 ناکامی کی وجہ API خرابی کے ساتھ12 ناکامی کی وجہ ٹائم آؤٹ کے ساتھ4

210/210

درجہ	ماڈل	کمپنی	عمومی ذہانت اسکور	اسکور	کل لاگت	درست ٹیسٹس	ردِعمل کا وقت (اوسط)
#119	Qwen3.5-35B-A3B medium	Qwen	2.8	6.2	$0.837	0/1	30.3s
کل ٹیسٹس 1 غلط ٹیسٹس 1 کل لاگت $0.837 ردِعمل کا وقت (اوسط) 30.3s
#204	Qwen3.5-9B medium	Qwen	2.8	3.8	$0.036	0/1	226.4s
کل ٹیسٹس 1 غلط ٹیسٹس 1 کل لاگت $0.036 ردِعمل کا وقت (اوسط) 226.4s
#135	Hy3 preview high	Tencent	3.0	5.9	$0.048	0/1	0ms
کل ٹیسٹس 1 غلط ٹیسٹس 1 کل لاگت $0.048 ردِعمل کا وقت (اوسط) 0ms
#153	Hy3 preview low	Tencent	3.0	5.5	$0.015	0/1	0ms
کل ٹیسٹس 1 غلط ٹیسٹس 1 کل لاگت $0.015 ردِعمل کا وقت (اوسط) 0ms
#175	Qwen3.6 Plus Preview medium	Qwen	3.0	4.9	$0.000	0/1	0ms
کل ٹیسٹس 1 غلط ٹیسٹس 1 کل لاگت $0.000 ردِعمل کا وقت (اوسط) 0ms
#186	Laguna M.1 medium	Poolside	3.0	4.7	$0.033	0/1	0ms
کل ٹیسٹس 1 غلط ٹیسٹس 1 کل لاگت $0.033 ردِعمل کا وقت (اوسط) 0ms
#192	Laguna M.1 none	Poolside	3.0	4.4	$0.009	0/1	0ms
کل ٹیسٹس 1 غلط ٹیسٹس 1 کل لاگت $0.009 ردِعمل کا وقت (اوسط) 0ms
#198	Laguna Xs.2 medium	Poolside	3.0	4.1	$0.015	0/1	0ms
کل ٹیسٹس 1 غلط ٹیسٹس 1 کل لاگت $0.015 ردِعمل کا وقت (اوسط) 0ms
#205	Laguna Xs.2 none	Poolside	3.0	3.8	$0.004	0/1	0ms
کل ٹیسٹس 1 غلط ٹیسٹس 1 کل لاگت $0.004 ردِعمل کا وقت (اوسط) 0ms
#207	Nemotron 3 Nano Omni 30b A3b Reasoning medium	NVIDIA	3.0	3.4	$0.000	0/1	0ms
کل ٹیسٹس 1 غلط ٹیسٹس 1 کل لاگت $0.000 ردِعمل کا وقت (اوسط) 0ms
#208	Nemotron 3 Nano Omni 30b A3b Reasoning none	NVIDIA	3.0	3.2	$0.000	0/1	0ms
کل ٹیسٹس 1 غلط ٹیسٹس 1 کل لاگت $0.000 ردِعمل کا وقت (اوسط) 0ms
#76	DeepSeek V3.2 medium	DeepSeek	3.4	7.0	$0.078	0/1	58.3s
کل ٹیسٹس 1 غلط ٹیسٹس 1 کل لاگت $0.078 ردِعمل کا وقت (اوسط) 58.3s
#72	Qwen3.5-122B-A10B medium	Qwen	3.4	7.1	$1.046	0/1	34.1s
کل ٹیسٹس 1 غلط ٹیسٹس 1 کل لاگت $1.046 ردِعمل کا وقت (اوسط) 34.1s
#91	LongCat 2.0 low	Meituan	3.4	6.7	$0.391	0/1	22.5s
کل ٹیسٹس 1 غلط ٹیسٹس 1 کل لاگت $0.391 ردِعمل کا وقت (اوسط) 22.5s
#67	Step 3.7 Flash low	Stepfun	3.4	7.3	$0.454	0/1	7.00s
کل ٹیسٹس 1 غلط ٹیسٹس 1 کل لاگت $0.454 ردِعمل کا وقت (اوسط) 7.00s

1 2 14

→

عمومی ذہانت درجہ بندی

ماڈلز فلٹر کریں

عمومی ذہانت اسکور کے لحاظ سے سرفہرست ماڈلز

عمومی ذہانت اسکور بمقابلہ کل لاگت

ردِعمل کا وقت (اوسط) کے لحاظ سے سرفہرست ماڈلز