Urambazaji
Advertise here

Mistral Large 4 (low) vs GPT-6 Luna (low)

average score iko karibu sawa: 7.6 vs 7.6. GPT-6 Luna (low) ina gharama ya chini ya benchmark: $0.033 vs $1.648. GPT-6 Luna (low) ni ya haraka zaidi: 23.23s vs 300.15s, na pass rates 65.2% vs 63.8%.

Benchmark zimetengenezwa kutoka seti za majaribio za AI BENCHY tarehe: 2026-10-06

Modeli zilizolinganishwa

Nafasi
#119
Jumla ya tokeni za matokeo
714,287
Muda wa majibu (wastani)
300.15s
Jumla ya gharama
$1.648
Nafasi
#121
Jumla ya tokeni za matokeo
24,880
Muda wa majibu (wastani)
23.23s
Jumla ya gharama
$0.033
Muundo unaopendekezwa GPT-6 Luna (low)

It has the best score here (7.6), while costing about 51.4x less than Mistral Large 4 (low).

Ulinganisho wa kina

Kipimo Mistral Large 4 Mistral Large 4 low Toleo: 2026-10-06 GPT-6 Luna GPT-6 Luna low Toleo: 2026-09-23
Alama 7.6 7.6
Nafasi #119 #121
Uaminifu 9.0 9.7
Uthabiti 8.7 8.5
Majaribio 69/69 69/69
Majaribio sahihi
Kiwango cha kupita kwa kila jaribio 65.2% 63.8%
Majaribio yasiyo thabiti 4 4
Jumla ya uendeshaji 69 69
Gharama kwa matokeo 12.670 0.267
Jumla ya gharama $1.648 $0.033
Bei ya ingizo $0.680 / 1M $0.100 / 1M
Bei ya toleo $2.090 / 1M $0.500 / 1M
Bei ya kusoma akiba $0.070 / 1M $0.010 / 1M
Bei ya kuandika akiba Haipo $0.125 / 1M
Jumla ya tokeni za ingizo 226,734 195,928
Tokeni za matokeo 278,013 5,728
Tokeni za hoja 638,296 19,152
Muda wa majibu (wastani) 300.15s 23.23s
Muda wa majibu (upeo) 1798.01s 89.37s
Muda wa majibu (jumla) 6903.40s 534.22s
Vigezo 1.05T jumla (49B vinavyotumika) ~400B jumla (~17B vinavyotumika)
Upatikanaji Imefungwa Imefungwa

Bei za akiba zinahusu tokeni za ingizo. Kusoma hutumia tena maelekezo yaliyohifadhiwa; kuandika huyahifadhi na kunaweza kuongeza gharama. Tokeni za matokeo hutumia bei ya matokeo.

Onyesho la kizazi cha modeli

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#119 Mistral Large 4

low
Gharama
$0.015
Muda
115.1s
Tokeni
6,915 tok

#121 GPT-6 Luna

low
Gharama
$0.002
Muda
19.2s
Tokeni
2,598 tok

Modeli bora kwa alama

Alama dhidi ya gharama ya jumla

Muda wa majibu (wastani)

Alama vs Muda wa majibu (wastani)

Jumla ya tokeni za matokeo

Alama vs Jumla ya tokeni za matokeo

Mgawanyo wa kategoria

Uandishi wa msimbo Alama Uthabiti Kiwango cha kupita kwa kila jaribio Majaribio yasiyo thabiti Majaribio sahihi Muda wa majibu (wastani) Tokeni za ingizo Tokeni za matokeo Tokeni za hoja
Mistral Large 4 3.4 7.2 22.2% 1 1379.72s 5,896 129,426 386,126
GPT-6 Luna 6.0 7.2 55.6% 1 15.39s 7,302 493 6,655

Ulinganisho wa haraka

Badilisha jozi ya ulinganisho