Navigatie
Advertise here

Ling 3.1 Flash vs GPT-6 Luna

De gemiddelde score is vrijwel gelijk met 5.5 vs 5.5. Ling 3.1 Flash heeft lagere benchmarkkosten met $0.000 vs $0.026. Ling 3.1 Flash is sneller met 15.75s vs 20.48s, met slagingspercentages van 33.3% vs 40.6%.

Benchmarks gegenereerd uit AI BENCHY-testsuites op: 2026-10-03

Vergeleken modellen

Rang
#272
Totaal aantal uitvoer-tokens
85,777
Responstijd (gem.)
15.75s
Totale kosten
$0.000
Rang
#274
Totaal aantal uitvoer-tokens
6,855
Responstijd (gem.)
20.48s
Totale kosten
$0.026
Aanbevolen model Ling 3.1 Flash

Het heeft de sterkste score in deze vergelijking (5.5) en de beste balans tussen kosten en responstijd over alle 2 modellen.

Gedetailleerde vergelijking

Metriek Ling 3.1 Flash Ling 3.1 Flash none Releasedatum: 2026-10-03 GPT-6 Luna GPT-6 Luna none Releasedatum: 2026-09-23
Score 5.5 5.5
Rang #272 #274
Betrouwbaarheid 9.8 9.9
Consistentie 8.4 8.2
Pogingen 69/69 69/69
Correcte tests
Slaagpercentage per poging 33.3% 40.6%
Instabiele tests 5 5
Totaal runs 69 69
Kosten per resultaat 0.000 0.367
Totale kosten $0.000 $0.026
Invoerprijs $0.000 / 1M $0.100 / 1M
Uitvoerprijs $0.000 / 1M $0.500 / 1M
Prijs voor cachelezen n.v.t. $0.010 / 1M
Prijs voor cacheschrijven n.v.t. $0.125 / 1M
Totaal aantal invoer-tokens 286,758 222,357
Uitvoer-tokens 85,777 6,855
Redeneer-tokens 0 0
Responstijd (gem.) 15.75s 20.48s
Responstijd (max) 90.95s 98.62s
Responstijd (totaal) 362.23s 470.96s
Parameters 560B totaal (25B actief) ~400B totaal (~17B actief)
Beschikbaarheid Gesloten broncode Gesloten broncode

Cacheprijzen gelden voor invoertokens. Lezen hergebruikt opgeslagen prompts; schrijven slaat ze op en kan extra kosten. Voor uitvoertokens geldt de uitvoerprijs.

Model generatie-showcase

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#272 Ling 3.1 Flash

none
Kosten
$0.000
Tijd
171.4s
Tokens
20,178 tok

#274 GPT-6 Luna

none
Kosten
$0.002
Tijd
26.0s
Tokens
3,235 tok

Topmodellen op score

Score vs totale kosten

Responstijd (gem.)

Score vs Responstijd (gem.)

Totaal aantal uitvoer-tokens

Score vs Totaal aantal uitvoer-tokens

Categorie-uitsplitsing

Programmeren Score Consistentie Slaagpercentage per poging Instabiele tests Correcte tests Responstijd (gem.) Invoer-tokens Uitvoer-tokens Redeneer-tokens
Ling 3.1 Flash 4.5 7.5 22.2% 1 31.85s 8,307 27,810 0
GPT-6 Luna 5.5 10.0 33.3% 0 8.04s 7,302 376 0

Snelle vergelijking

Vergelijkingspaar wisselen