- Rang
- #33
- Gesamte Ausgabe-Token
- 597,236
- Antwortzeit (Durchschnitt)
- 163.90s
- Gesamtkosten
- $1.546
Seed 2.1 Turbo (low) vs Gemini 3.1 Pro Preview (medium)
Gemini 3.1 Pro Preview (medium) führt beim Durchschnittsscore mit 9.2 vs 9.1. Gemini 3.1 Pro Preview (medium) hat die niedrigeren Benchmark-Kosten mit $1.352 vs $1.546. Gemini 3.1 Pro Preview (medium) ist schneller mit 20.62s vs 163.90s, mit Erfolgsraten von 80.3% vs 90.9%.
Verglichene Modelle
- Rang
- #27
- Gesamte Ausgabe-Token
- 97,238
- Antwortzeit (Durchschnitt)
- 20.62s
- Gesamtkosten
- $1.352
Empfohlenes Modell
Gemini 3.1 Pro Preview (medium)
Es hat hier die beste Punktzahl (9.2) und antwortet etwa 7.9x schneller als Seed 2.1 Turbo (low).
Detaillierter Vergleich
| Metrik | Seed 2.1 Turbo Seed 2.1 Turbo low | Gemini 3.1 Pro Preview Gemini 3.1 Pro Preview medium |
|---|---|---|
| Punktzahl | 9.1 | 9.2 |
| Rang | #33 | #27 |
| Zuverlässigkeit | 10.0 | 10.0 |
| Konsistenz | 9.2 | 10.0 |
| Versuche | 66/66 | 66/66 |
| Korrekte Tests | ||
| Erfolgsquote pro Versuch | 80.3% | 90.9% |
| Instabile Tests | 2 | 0 |
| Gesamtläufe | 66 | 66 |
| Kosten pro Ergebnis | 9.091 | 6.758 |
| Gesamtkosten | $1.546 | $1.352 |
| Eingabepreis | $0.500 / 1M | $2.000 / 1M |
| Ausgabepreis | $2.500 / 1M | $12.000 / 1M |
| Gesamte Eingabe-Token | 104,464 | 92,296 |
| Ausgabe-Token | 6,844 | 5,232 |
| Denk-Token | 590,392 | 92,006 |
| Antwortzeit (Durchschnitt) | 163.90s | 20.62s |
| Antwortzeit (Maximum) | 739.98s | 88.68s |
| Antwortzeit (Gesamt) | 3605.87s | 329.94s |
| Parameter | ~200B insgesamt (~20B aktiv) | ~1.2T insgesamt (~20B aktiv) |
| Verfügbarkeit | Geschlossen | Geschlossen |
Modell-Generierungs-Showcase
Hamster playing table tennis
Prompt: Create a detailed SVG illustration of a hamster playing table tennis.
#33 Seed 2.1 Turbo
low- Kosten
- $0.049
- Zeit
- 298.8s
- Token
- 19,730 tok
#27 Gemini 3.1 Pro Preview
medium- Kosten
- $0.115
- Zeit
- 87.2s
- Token
- 9,629 tok
Top-Modelle nach Score
Score vs. Gesamtkosten
Antwortzeit (Durchschnitt)
Punktzahl vs Antwortzeit (Durchschnitt)
Gesamte Ausgabe-Token
Punktzahl vs Gesamte Ausgabe-Token
Kategorieaufschlüsselung
| Anti-KI-Tricks | Punktzahl | Konsistenz | Erfolgsquote pro Versuch | Instabile Tests | Korrekte Tests | Antwortzeit (Durchschnitt) | Eingabe-Token | Ausgabe-Token | Denk-Token |
|---|---|---|---|---|---|---|---|---|---|
| Seed 2.1 Turbo | 8.2 | 7.9 | 83.3% | 1 | 34.78s | 906 | 624 | 22,595 | |
| Gemini 3.1 Pro Preview | 10.0 | 10.0 | 100.0% | 0 | 7.90s | 498 | 112 | 3,218 |
| Programmierung | Punktzahl | Konsistenz | Erfolgsquote pro Versuch | Instabile Tests | Korrekte Tests | Antwortzeit (Durchschnitt) | Eingabe-Token | Ausgabe-Token | Denk-Token |
|---|---|---|---|---|---|---|---|---|---|
| Seed 2.1 Turbo | 10.0 | 10.0 | 100.0% | 0 | 360.85s | 8,220 | 385 | 207,368 | |
| Gemini 3.1 Pro Preview | 7.9 | 9.9 | 66.7% | 0 | 40.17s | 8,124 | 435 | 41,247 |
| Kombiniert | Punktzahl | Konsistenz | Erfolgsquote pro Versuch | Instabile Tests | Korrekte Tests | Antwortzeit (Durchschnitt) | Eingabe-Token | Ausgabe-Token | Denk-Token |
|---|---|---|---|---|---|---|---|---|---|
| Seed 2.1 Turbo | 10.0 | 10.0 | 100.0% | 0 | 359.97s | 74,199 | 4,604 | 132,545 | |
| Gemini 3.1 Pro Preview | 9.8 | 10.0 | 100.0% | 0 | 40.39s | 67,910 | 3,687 | 23,111 |
| Datenanalyse und -extraktion | Punktzahl | Konsistenz | Erfolgsquote pro Versuch | Instabile Tests | Korrekte Tests | Antwortzeit (Durchschnitt) | Eingabe-Token | Ausgabe-Token | Denk-Token |
|---|---|---|---|---|---|---|---|---|---|
| Seed 2.1 Turbo | 10.0 | 10.0 | 100.0% | 0 | 34.55s | 8,544 | 246 | 12,576 | |
| Gemini 3.1 Pro Preview | 10.0 | 10.0 | 100.0% | 0 | 7.72s | 7,265 | 279 | 3,904 |
| Domänenspezifisch | Punktzahl | Konsistenz | Erfolgsquote pro Versuch | Instabile Tests | Korrekte Tests | Antwortzeit (Durchschnitt) | Eingabe-Token | Ausgabe-Token | Denk-Token |
|---|---|---|---|---|---|---|---|---|---|
| Seed 2.1 Turbo | 2.9 | 7.2 | 11.1% | 1 | 424.53s | 775 | 8 | 166,776 | |
| Gemini 3.1 Pro Preview | 7.7 | 10.0 | 66.7% | 0 | 20.29s | 644 | 18 | 11,704 |
| Allgemeine Intelligenz | Punktzahl | Konsistenz | Erfolgsquote pro Versuch | Instabile Tests | Korrekte Tests | Antwortzeit (Durchschnitt) | Eingabe-Token | Ausgabe-Token | Denk-Token |
|---|---|---|---|---|---|---|---|---|---|
| Seed 2.1 Turbo | 10.0 | 10.0 | 100.0% | 0 | 41.83s | 573 | 235 | 6,851 | |
| Gemini 3.1 Pro Preview | 10.0 | 10.0 | 100.0% | 0 | 11.77s | 490 | 108 | 1,179 |
| Befolgung von Anweisungen | Punktzahl | Konsistenz | Erfolgsquote pro Versuch | Instabile Tests | Korrekte Tests | Antwortzeit (Durchschnitt) | Eingabe-Token | Ausgabe-Token | Denk-Token |
|---|---|---|---|---|---|---|---|---|---|
| Seed 2.1 Turbo | 9.8 | 10.0 | 100.0% | 0 | 5.05s | 816 | 72 | 1,271 | |
| Gemini 3.1 Pro Preview | 10.0 | 10.0 | 100.0% | 0 | 9.56s | 621 | 72 | 2,236 |
| Rätsellösen | Punktzahl | Konsistenz | Erfolgsquote pro Versuch | Instabile Tests | Korrekte Tests | Antwortzeit (Durchschnitt) | Eingabe-Token | Ausgabe-Token | Denk-Token |
|---|---|---|---|---|---|---|---|---|---|
| Seed 2.1 Turbo | 10.0 | 10.0 | 100.0% | 0 | 23.45s | 867 | 430 | 12,087 | |
| Gemini 3.1 Pro Preview | 10.0 | 10.0 | 100.0% | 0 | 6.90s | 570 | 235 | 3,128 |
| Werkzeugaufrufe | Punktzahl | Konsistenz | Erfolgsquote pro Versuch | Instabile Tests | Korrekte Tests | Antwortzeit (Durchschnitt) | Eingabe-Token | Ausgabe-Token | Denk-Token |
|---|---|---|---|---|---|---|---|---|---|
| Seed 2.1 Turbo | 10.0 | 10.0 | 100.0% | 0 | 27.40s | 9,297 | 228 | 1,452 | |
| Gemini 3.1 Pro Preview | 10.0 | 10.0 | 100.0% | 0 | 23.15s | 6,018 | 274 | 982 |
| Allgemeinwissen | Punktzahl | Konsistenz | Erfolgsquote pro Versuch | Instabile Tests | Korrekte Tests | Antwortzeit (Durchschnitt) | Eingabe-Token | Ausgabe-Token | Denk-Token |
|---|---|---|---|---|---|---|---|---|---|
| Seed 2.1 Turbo | 3.0 | 10.0 | 0.0% | 0 | 171.92s | 267 | 12 | 26,871 | |
| Gemini 3.1 Pro Preview | 10.0 | 10.0 | 100.0% | 0 | 6.27s | 156 | 12 | 1,297 |
Schnellvergleich
Vergleichspaar wechseln
Claude Opus 5.5highvsGemini 3.1 Pro PreviewmediumSeed 2.1 TurbolowvsGemini 3.8 FlashmediumClaude Opus 5highvsGemini 3.1 Pro PreviewmediumSeed 2.1 TurbolowvsQwen3.7 MaxmediumClaude Opus 5.5lowvsGemini 3.1 Pro PreviewmediumClaude Opus 5.5mediumvsSeed 2.1 TurbolowClaude Fable 5.1highvsSeed 2.1 TurbolowGemini 3.1 Pro PreviewmediumvsGrok 4.6highGemini 3.1 Pro PreviewmediumvsGPT-5.5lowSeed 2.1 TurbolowvsGemini 3.5 FlashmediumSeed 2.1 TurbolowvsGPT-5.5mediumClaude Sonnet 5.5maxvsSeed 2.1 Turbolow