नेविगेशन
AI BENCHY
Advertise here

AI BENCHY तुलना

Qwen: Qwen3.5-Flash vs Qwen: Qwen3.7 Plus

सारांश

Qwen3.5-Flash vs Qwen3.7 Plus benchmark तुलना: Qwen3.7 Plus average score में आगे है: 7.2 vs 6.8. Qwen3.7 Plus की benchmark लागत कम है: $0.023 vs $0.080. Qwen3.7 Plus तेज है: 2.85s vs 63.29s, pass rates 71.4% vs 47.6%.

अनुशंसित मॉडल: Qwen3.7 Plus - It has the best score here (7.2), while costing about 3.6x less than Qwen3.5-Flash.

बेंचमार्क AI BENCHY टेस्ट सूट्स से इस समय जनरेट किए गए:: 2026-06-18

मेट्रिक Qwen3.5-Flash Qwen3.5-Flash medium रिलीज़: 2026-02-24 Qwen3.7 Plus Qwen3.7 Plus none रिलीज़: 2026-06-03
स्कोर 6.8 7.2
रैंक #70 #60
विश्वसनीयता 10.0 10.0
संगति 8.1 10.0
सही परीक्षण
प्रति प्रयास पास दर 71.4% 47.6%
अस्थिर टेस्ट 5 0
कुल रन 63 63
प्रति परिणाम लागत 0.871 0.276
कुल लागत $0.080 $0.023
इनपुट कीमत $0.065 / 1M $0.320 / 1M
आउटपुट कीमत $0.260 / 1M $1.280 / 1M
कुल इनपुट टोकन 38,926 42,510
आउटपुट टोकन 2,088 6,578
रीजनिंग टोकन 294,598 0
प्रतिक्रिया समय (औसत) 63.29s 2.85s
प्रतिक्रिया समय (अधिकतम) 234.29s 29.38s
प्रतिक्रिया समय (कुल) 1265.85s 59.86s

जनरेशन शोकेस

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#70 Qwen3.5-Flash

medium
लागत
$0.002
समय
25.8s
टोकन
4,294 tok

#60 Qwen3.7 Plus

none
लागत
$0.019
समय
213.5s
टोकन
11,960 tok

स्कोर के अनुसार शीर्ष मॉडल

स्कोर बनाम कुल लागत

प्रतिक्रिया समय (औसत)

स्कोर vs प्रतिक्रिया समय (औसत)

कुल आउटपुट टोकन

स्कोर vs कुल आउटपुट टोकन

श्रेणी विवरण

एंटी-एआई ट्रिक्स स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Qwen3.5-Flash 10.0 10.0 100.0% 0 59.11s 672 383 32,992
Qwen3.7 Plus 6.5 10.0 50.0% 0 1.38s 696 349 0
कोडिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Qwen3.5-Flash 3.7 7.2 22.2% 1 58.87s 6,685 302 90,081
Qwen3.7 Plus 5.5 10.0 33.3% 0 2.15s 7,911 639 0
संयुक्त स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Qwen3.5-Flash 10.0 10.0 100.0% 0 17.78s 14,934 483 8,270
Qwen3.7 Plus 10.0 10.0 100.0% 0 29.38s 14,952 4,505 0
डेटा पार्सिंग और निष्कर्षण स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Qwen3.5-Flash 7.3 5.9 83.3% 1 56.99s 6,061 235 16,237
Qwen3.7 Plus 10.0 10.0 100.0% 0 1.43s 7,794 243 0
डोमेन-विशिष्ट स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Qwen3.5-Flash 5.3 7.2 44.4% 1 146.50s 581 58 43,615
Qwen3.7 Plus 3.0 10.0 0.0% 0 868ms 789 18 0
Samanya Buddhimatta स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Qwen3.5-Flash 6.1 3.1 66.7% 1 40.05s 516 99 38,486
Qwen3.7 Plus 5.3 10.0 0.0% 0 1.33s 522 78 0
निर्देश पालन स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Qwen3.5-Flash 10.0 10.0 100.0% 0 63.49s 699 98 14,139
Qwen3.7 Plus 6.3 10.0 50.0% 0 929ms 711 72 0
पहेली समाधान स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Qwen3.5-Flash 8.2 7.2 88.9% 1 27.61s 381 89 12,457
Qwen3.7 Plus 7.7 10.0 66.7% 0 1.71s 714 443 0
टूल कॉलिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Qwen3.5-Flash 10.0 10.0 100.0% 0 10.33s 8,193 309 1,284
Qwen3.7 Plus 10.0 10.0 100.0% 0 3.54s 8,211 222 0
सामान्य ज्ञान स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Qwen3.5-Flash 3.0 10.0 0.0% 0 48.98s 204 32 37,037
Qwen3.7 Plus 3.0 10.0 0.0% 0 1.21s 210 9 0

त्वरित तुलना

तुलना जोड़ी बदलें