नेव्हिगेशन
AI BENCHY
Advertise here

Poolside: Laguna S 2.1 vs xAI: Grok 4.20

Laguna S 2.1 (low) average score मध्ये पुढे आहे: 5.0 vs 4.1. Grok 4.20 चा benchmark खर्च कमी आहे: $0.057 vs $0.091. Grok 4.20 वेगवान आहे: 1.11s vs 85.35s, pass rates 25.8% vs 27.3%.

शिफारस केलेले मॉडेलLaguna S 2.1 (low)It has the strongest score in this comparison (5.0) and the best overall balance of cost and response time across all 2 models.

AI BENCHY टेस्ट सूटमधून बेंचमार्क या वेळी तयार झाले: 2026-07-25

मेट्रिक Laguna S 2.1 Laguna S 2.1 low प्रकाशन: 2026-07-21 मोफत उपलब्ध Grok 4.20 Grok 4.20 none प्रकाशन: 2026-03-31
स्कोअर 5.0 4.1
क्रमांक #187 #213
विश्वसनीयता 9.9 लागू नाही
सुसंगतता 7.8 8.1
बरोबर चाचण्या
प्रति प्रयत्न पास दर 25.8% 27.3%
अस्थिर चाचण्या 6 0
एकूण रन 66 54
प्रति निकाल खर्च 3.022 1.570
एकूण खर्च $0.091 $0.057
इनपुट किंमत $0.100 / 1M $1.250 / 1M
आउटपुट किंमत $0.200 / 1M $2.500 / 1M
एकूण इनपुट टोकन्स 118,746 41,313
आउटपुट टोकन्स 67,823 1,923
रिझनिंग टोकन्स 383,885 0
प्रतिसाद वेळ (सरासरी) 85.35s 1.11s
प्रतिसाद वेळ (कमाल) 814.73s 6.04s
प्रतिसाद वेळ (एकूण) 1877.64s 19.96s

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#187 Laguna S 2.1

low
खर्च
$0.001
वेळ
6.6s
टोकन्स
1,314 tok

#213 xAI: Grok 4.20

none
खर्च
$0.004
वेळ
6.5s
टोकन्स
1,367 tok

स्कोअरनुसार शीर्ष मॉडेल्स

स्कोअर विरुद्ध एकूण खर्च

प्रतिसाद वेळ (सरासरी)

स्कोअर vs प्रतिसाद वेळ (सरासरी)

एकूण आउटपुट टोकन्स

स्कोअर vs एकूण आउटपुट टोकन्स

श्रेणीवार तपशील

कोडिंग स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) इनपुट टोकन्स आउटपुट टोकन्स रिझनिंग टोकन्स
Laguna S 2.1 3.8 7.1 22.2% 1 167.51s 7,917 58,111 119,138
Grok 4.20 1.1 3.1 0.0% 0 1.22s 1,074 312 0

झटपट तुलना

तुलना जोडी बदला