नेविगेशन
AI BENCHY
Advertise here

AI BENCHY तुलना

MiniMax: MiniMax M2.7 vs Poolside: Laguna XS 2.1

सारांश

MiniMax M2.7 vs Laguna XS 2.1 benchmark तुलना: Laguna XS 2.1 average score में आगे है: 5.3 vs 5.2. Laguna XS 2.1 की benchmark लागत कम है: $0.003 vs $0.075. Laguna XS 2.1 तेज है: 722ms vs 38.18s, pass rates 46.0% vs 31.8%.

अनुशंसित मॉडल: Laguna XS 2.1 - It has the best score here (5.3), while costing about 26.0x less than MiniMax M2.7.

बेंचमार्क AI BENCHY टेस्ट सूट्स से इस समय जनरेट किए गए:: 2026-07-02

मेट्रिक MiniMax M2.7 MiniMax M2.7 medium रिलीज़: 2026-03-18 Laguna XS 2.1 Laguna XS 2.1 none रिलीज़: 2026-07-02 निःशुल्क उपलब्ध
स्कोर 5.2 5.3
रैंक #132 #128
विश्वसनीयता 10.0 10.0
संगति 6.8 9.0
सही परीक्षण
प्रति प्रयास पास दर 46.0% 31.8%
अस्थिर टेस्ट 8 3
कुल रन 63 63
प्रति परिणाम लागत 2.494 0.058
कुल लागत $0.075 $0.003
इनपुट कीमत $0.180 / 1M $0.060 / 1M
आउटपुट कीमत $0.720 / 1M $0.120 / 1M
कुल इनपुट टोकन 34,371 41,148
आउटपुट टोकन 8,981 3,451
रीजनिंग टोकन 89,812 0
प्रतिक्रिया समय (औसत) 38.18s 722ms
प्रतिक्रिया समय (अधिकतम) 196.21s 2.30s
प्रतिक्रिया समय (कुल) 763.60s 15.17s

जनरेशन शोकेस

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#132 MiniMax M2.7

medium
लागत
$0.022
समय
22.8s
टोकन
9,250 tok

#128 Laguna XS 2.1

none
लागत
$0.001
समय
27.6s
टोकन
4,344 tok

स्कोर के अनुसार शीर्ष मॉडल

स्कोर बनाम कुल लागत

प्रतिक्रिया समय (औसत)

स्कोर vs प्रतिक्रिया समय (औसत)

कुल आउटपुट टोकन

स्कोर vs कुल आउटपुट टोकन

श्रेणी विवरण

एंटी-एआई ट्रिक्स स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
MiniMax M2.7 7.9 6.3 83.3% 2 40.32s 654 3,010 17,716
Laguna XS 2.1 5.3 8.3 33.3% 1 755ms 774 1,015 0
कोडिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
MiniMax M2.7 5.7 9.1 33.3% 0 101.89s 2,961 1,231 38,841
Laguna XS 2.1 4.3 7.8 22.2% 1 623ms 7,995 562 0
संयुक्त स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
MiniMax M2.7 4.7 1.6 66.7% 1 41.03s 14,233 369 4,480
Laguna XS 2.1 3.0 10.0 0.0% 0 1.76s 14,197 402 0
डेटा पार्सिंग और निष्कर्षण स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
MiniMax M2.7 6.3 5.8 66.7% 1 21.95s 7,152 187 5,882
Laguna XS 2.1 10.0 10.0 100.0% 0 768ms 7,734 240 0
डोमेन-विशिष्ट स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
MiniMax M2.7 3.0 10.0 0.0% 0 19.00s 245 8 2,796
Laguna XS 2.1 5.3 10.0 33.3% 0 364ms 834 14 0
Samanya Buddhimatta स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
MiniMax M2.7 3.9 2.5 33.3% 1 38.70s 486 92 5,204
Laguna XS 2.1 5.0 10.0 0.0% 0 529ms 537 128 0
निर्देश पालन स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
MiniMax M2.7 3.8 5.8 33.3% 1 12.80s 687 350 2,600
Laguna XS 2.1 3.8 5.8 33.3% 1 364ms 638 50 0
पहेली समाधान स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
MiniMax M2.7 5.9 7.2 55.6% 1 24.87s 675 362 7,840
Laguna XS 2.1 3.0 10.0 0.0% 0 1.01s 771 730 0
टूल कॉलिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
MiniMax M2.7 4.7 1.6 66.7% 1 12.05s 7,067 304 1,001
Laguna XS 2.1 10.0 10.0 100.0% 0 1.36s 7,413 300 0
सामान्य ज्ञान स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
MiniMax M2.7 3.0 10.0 0.0% 0 22.77s 211 3,068 3,452
Laguna XS 2.1 3.0 10.0 0.0% 0 254ms 255 10 0

त्वरित तुलना

तुलना जोड़ी बदलें