नेविगेशन
AI BENCHY
Advertise here

AI BENCHY तुलना

DeepSeek: DeepSeek V4 Pro vs Poolside: Laguna XS 2.1

सारांश

DeepSeek V4 Pro vs Laguna XS 2.1 benchmark तुलना: DeepSeek V4 Pro average score में आगे है: 7.2 vs 7.0. DeepSeek V4 Pro की benchmark लागत कम है: $0.034 vs $0.036. DeepSeek V4 Pro तेज है: 6.41s vs 30.08s, pass rates 52.4% vs 44.4%.

अनुशंसित मॉडल: DeepSeek V4 Pro - It has the best score here (7.2), while responding about 4.7x faster than Laguna XS 2.1.

बेंचमार्क AI BENCHY टेस्ट सूट्स से इस समय जनरेट किए गए:: 2026-07-02

मेट्रिक DeepSeek V4 Pro DeepSeek V4 Pro none रिलीज़: 2026-04-24 Laguna XS 2.1 Laguna XS 2.1 medium रिलीज़: 2026-07-02 निःशुल्क उपलब्ध
स्कोर 7.2 7.0
रैंक #60 #67
विश्वसनीयता 9.9 10.0
संगति 8.8 9.6
सही परीक्षण
प्रति प्रयास पास दर 52.4% 44.4%
अस्थिर टेस्ट 3 1
कुल रन 63 63
प्रति परिणाम लागत 0.333 0.392
कुल लागत $0.034 $0.036
इनपुट कीमत $0.435 / 1M $0.060 / 1M
आउटपुट कीमत $0.870 / 1M $0.120 / 1M
कुल इनपुट टोकन 53,558 45,324
आउटपुट टोकन 11,424 25,761
रीजनिंग टोकन 0 268,677
प्रतिक्रिया समय (औसत) 6.41s 30.08s
प्रतिक्रिया समय (अधिकतम) 30.09s 155.23s
प्रतिक्रिया समय (कुल) 134.66s 631.77s

जनरेशन शोकेस

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#60 DeepSeek V4 Pro

none
अमान्य SVG
लागत
$0.000
समय
300.0s
टोकन
0 tok

#67 Laguna XS 2.1

medium
लागत
$0.001
समय
30.6s
टोकन
4,678 tok

स्कोर के अनुसार शीर्ष मॉडल

स्कोर बनाम कुल लागत

प्रतिक्रिया समय (औसत)

स्कोर vs प्रतिक्रिया समय (औसत)

कुल आउटपुट टोकन

स्कोर vs कुल आउटपुट टोकन

श्रेणी विवरण

एंटी-एआई ट्रिक्स स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
DeepSeek V4 Pro 3.2 6.1 16.7% 2 4.02s 540 1,168 0
Laguna XS 2.1 4.8 10.0 25.0% 0 41.96s 774 353 73,090
कोडिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
DeepSeek V4 Pro 5.6 10.0 33.3% 0 13.38s 7,275 5,500 0
Laguna XS 2.1 5.5 10.0 33.3% 0 70.35s 7,995 23,767 83,258
संयुक्त स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
DeepSeek V4 Pro 9.5 10.0 100.0% 0 23.74s 27,529 2,235 0
Laguna XS 2.1 9.6 10.0 100.0% 0 13.43s 18,033 507 5,908
डेटा पार्सिंग और निष्कर्षण स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
DeepSeek V4 Pro 10.0 10.0 100.0% 0 4.61s 7,568 200 0
Laguna XS 2.1 10.0 10.0 100.0% 0 4.50s 7,734 234 3,129
डोमेन-विशिष्ट स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
DeepSeek V4 Pro 5.3 10.0 33.3% 0 3.72s 666 24 0
Laguna XS 2.1 2.9 7.2 11.1% 1 65.66s 834 17 91,533
Samanya Buddhimatta स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
DeepSeek V4 Pro 5.0 10.0 0.0% 0 2.05s 471 126 0
Laguna XS 2.1 5.0 10.0 0.0% 0 4.15s 537 119 1,375
निर्देश पालन स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
DeepSeek V4 Pro 6.3 5.8 66.7% 1 4.12s 627 713 0
Laguna XS 2.1 9.8 10.0 100.0% 0 2.57s 753 82 1,844
पहेली समाधान स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
DeepSeek V4 Pro 10.0 10.0 100.0% 0 3.61s 594 442 0
Laguna XS 2.1 5.3 10.0 33.3% 0 3.43s 771 357 3,355
टूल कॉलिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
DeepSeek V4 Pro 10.0 10.0 100.0% 0 7.40s 8,105 328 0
Laguna XS 2.1 10.0 10.0 100.0% 0 3.01s 7,638 309 748
सामान्य ज्ञान स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
DeepSeek V4 Pro 3.0 10.0 0.0% 0 5.76s 183 688 0
Laguna XS 2.1 3.0 10.0 0.0% 0 10.88s 255 16 4,437

त्वरित तुलना

तुलना जोड़ी बदलें