Navigation
AI BENCHY
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

Seed 2.1 Turbo vs Ling 3.0 Flash

Seed 2.1 Turbo führt beim Durchschnittsscore mit 5.7 vs 5.7. Ling 3.0 Flash hat die niedrigeren Benchmark-Kosten mit $0.004 vs $0.092. Ling 3.0 Flash ist schneller mit 3.46s vs 6.85s, mit Erfolgsraten von 50.0% vs 27.3%.

Benchmarks aus AI BENCHY-Test-Suites generiert am: 2026-08-12

Rang
#187
Gesamte Ausgabe-Token
10,640
Antwortzeit (Durchschnitt)
6.85s
Gesamtkosten
$0.092
Rang
#191
Gesamte Ausgabe-Token
12,783
Antwortzeit (Durchschnitt)
3.46s
Gesamtkosten
$0.004
Empfohlenes Modell Ling 3.0 Flash

Die Punktzahl bleibt nah an der besten hier (5.7 vs 5.7) und es kostet etwa 26.7x weniger als Seed 2.1 Turbo.

Detaillierter Vergleich

Metrik Seed 2.1 Turbo Seed 2.1 Turbo none Veröffentlichung: 2026-08-12 Ling 3.0 Flash Ling 3.0 Flash none Veröffentlichung: 2026-07-24 Kostenlos verfügbar
Punktzahl 5.7 5.7
Rang #187 #191
Zuverlässigkeit 10.0 9.9
Konsistenz 8.9 10.0
Versuche 66/66 66/66
Korrekte Tests
Erfolgsquote pro Versuch 50.0% 27.3%
Instabile Tests 3 0
Gesamtläufe 66 66
Kosten pro Ergebnis 1.014 0.000
Gesamtkosten $0.092 $0.004
Eingabepreis $0.500 / 1M $0.021 / 1M
Ausgabepreis $2.500 / 1M $0.063 / 1M
Gesamte Eingabe-Token 129,141 124,176
Ausgabe-Token 10,640 12,783
Denk-Token 0 0
Antwortzeit (Durchschnitt) 6.85s 3.46s
Antwortzeit (Maximum) 55.92s 17.51s
Antwortzeit (Gesamt) 150.66s 76.06s
Parameter ~200B insgesamt (~20B aktiv) 124B insgesamt (5.1B aktiv)
Verfügbarkeit Geschlossen Open Source

Modell-Generierungs-Showcase

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#187 Seed 2.1 Turbo

none
Kosten
$0.093
Zeit
517.1s
Token
37,102 tok

#191 Ling 3.0 Flash

none
Kosten
$0.000
Zeit
11.6s
Token
2,781 tok

Top-Modelle nach Score

Score vs. Gesamtkosten

Antwortzeit (Durchschnitt)

Punktzahl vs Antwortzeit (Durchschnitt)

Gesamte Ausgabe-Token

Punktzahl vs Gesamte Ausgabe-Token

Kategorieaufschlüsselung

Programmierung Punktzahl Konsistenz Erfolgsquote pro Versuch Instabile Tests Korrekte Tests Antwortzeit (Durchschnitt) Eingabe-Token Ausgabe-Token Denk-Token
Seed 2.1 Turbo 4.5 7.9 22.2% 1 2.35s 8,211 608 0
Ling 3.0 Flash 5.5 10.0 33.3% 0 6.39s 8,307 639 0

Schnellvergleich

Vergleichspaar wechseln