- Rang
- #57
- Gesamte Ausgabe-Token
- 769,582
- Antwortzeit (Durchschnitt)
- 189.13s
- Gesamtkosten
- $2.042
Seed 2.1 Turbo (medium) vs Qwen3.8 Max (0902) (low)
Seed 2.1 Turbo (medium) führt beim Durchschnittsscore mit 8.7 vs 8.6. Qwen3.8 Max (0902) (low) hat die niedrigeren Benchmark-Kosten mit $1.131 vs $2.042. Qwen3.8 Max (0902) (low) ist schneller mit 29.07s vs 189.13s, mit Erfolgsraten von 79.7% vs 85.5%.
Verglichene Modelle
- Rang
- #63
- Gesamte Ausgabe-Token
- 88,923
- Antwortzeit (Durchschnitt)
- 29.07s
- Gesamtkosten
- $1.131
Empfohlenes Modell
Qwen3.8 Max (0902) (low)
Die Punktzahl bleibt nah an der besten hier (8.6 vs 8.7) und es kostet etwa 1.8x weniger als Seed 2.1 Turbo (medium).
Detaillierter Vergleich
| Metrik | Seed 2.1 Turbo Seed 2.1 Turbo medium | Qwen3.8 Max (0902) Qwen3.8 Max (0902) low |
|---|---|---|
| Punktzahl | 8.7 | 8.6 |
| Rang | #57 | #63 |
| Zuverlässigkeit | 10.0 | 10.0 |
| Konsistenz | 8.2 | 9.0 |
| Versuche | 69/69 | 69/69 |
| Korrekte Tests | ||
| Erfolgsquote pro Versuch | 79.7% | 85.5% |
| Instabile Tests | 5 | 3 |
| Gesamtläufe | 69 | 69 |
| Kosten pro Ergebnis | 12.758 | 6.283 |
| Gesamtkosten | $2.042 | $1.131 |
| Eingabepreis | $0.500 / 1M | $2.000 / 1M |
| Ausgabepreis | $2.500 / 1M | $6.000 / 1M |
| Gesamte Eingabe-Token | 234,572 | 298,682 |
| Ausgabe-Token | 8,019 | 8,374 |
| Denk-Token | 761,563 | 80,549 |
| Antwortzeit (Durchschnitt) | 189.13s | 29.07s |
| Antwortzeit (Maximum) | 885.33s | 207.79s |
| Antwortzeit (Gesamt) | 4349.92s | 668.66s |
| Parameter | ~200B insgesamt (~20B aktiv) | 2.4T insgesamt (~100B aktiv) |
| Verfügbarkeit | Geschlossen | Geschlossen |
Modell-Generierungs-Showcase
Hamster playing table tennis
Prompt: Create a detailed SVG illustration of a hamster playing table tennis.
#57 Seed 2.1 Turbo
medium- Kosten
- $0.099
- Zeit
- 583.9s
- Token
- 39,514 tok
#63 Qwen3.8 Max (0902)
low- Kosten
- $0.014
- Zeit
- 41.2s
- Token
- 2,421 tok
Top-Modelle nach Score
Score vs. Gesamtkosten
Antwortzeit (Durchschnitt)
Punktzahl vs Antwortzeit (Durchschnitt)
Gesamte Ausgabe-Token
Punktzahl vs Gesamte Ausgabe-Token
Kategorieaufschlüsselung
| Agentenaufgaben | Punktzahl | Konsistenz | Erfolgsquote pro Versuch | Instabile Tests | Korrekte Tests | Antwortzeit (Durchschnitt) | Eingabe-Token | Ausgabe-Token | Denk-Token |
|---|---|---|---|---|---|---|---|---|---|
| Seed 2.1 Turbo | 10.0 | 10.0 | 100.0% | 0 | 90.94s | 130,139 | 1,508 | 8,883 | |
| Qwen3.8 Max (0902) | 6.1 | 3.1 | 66.7% | 1 | 136.04s | 194,728 | 2,052 | 11,006 |
| Anti-KI-Tricks | Punktzahl | Konsistenz | Erfolgsquote pro Versuch | Instabile Tests | Korrekte Tests | Antwortzeit (Durchschnitt) | Eingabe-Token | Ausgabe-Token | Denk-Token |
|---|---|---|---|---|---|---|---|---|---|
| Seed 2.1 Turbo | 8.2 | 7.9 | 83.3% | 1 | 28.25s | 906 | 386 | 18,834 | |
| Qwen3.8 Max (0902) | 10.0 | 10.0 | 100.0% | 0 | 4.72s | 984 | 212 | 1,854 |
| Programmierung | Punktzahl | Konsistenz | Erfolgsquote pro Versuch | Instabile Tests | Korrekte Tests | Antwortzeit (Durchschnitt) | Eingabe-Token | Ausgabe-Token | Denk-Token |
|---|---|---|---|---|---|---|---|---|---|
| Seed 2.1 Turbo | 8.2 | 7.2 | 88.9% | 1 | 354.87s | 8,220 | 384 | 205,892 | |
| Qwen3.8 Max (0902) | 10.0 | 10.0 | 100.0% | 0 | 37.42s | 8,127 | 485 | 17,404 |
| Kombiniert | Punktzahl | Konsistenz | Erfolgsquote pro Versuch | Instabile Tests | Korrekte Tests | Antwortzeit (Durchschnitt) | Eingabe-Token | Ausgabe-Token | Denk-Token |
|---|---|---|---|---|---|---|---|---|---|
| Seed 2.1 Turbo | 10.0 | 10.0 | 100.0% | 0 | 400.28s | 74,115 | 4,563 | 146,571 | |
| Qwen3.8 Max (0902) | 10.0 | 10.0 | 100.0% | 0 | 113.88s | 74,767 | 4,562 | 29,335 |
| Datenanalyse und -extraktion | Punktzahl | Konsistenz | Erfolgsquote pro Versuch | Instabile Tests | Korrekte Tests | Antwortzeit (Durchschnitt) | Eingabe-Token | Ausgabe-Token | Denk-Token |
|---|---|---|---|---|---|---|---|---|---|
| Seed 2.1 Turbo | 10.0 | 10.0 | 100.0% | 0 | 37.82s | 8,544 | 246 | 14,215 | |
| Qwen3.8 Max (0902) | 10.0 | 10.0 | 100.0% | 0 | 9.94s | 7,938 | 261 | 2,254 |
| Domänenspezifisch | Punktzahl | Konsistenz | Erfolgsquote pro Versuch | Instabile Tests | Korrekte Tests | Antwortzeit (Durchschnitt) | Eingabe-Token | Ausgabe-Token | Denk-Token |
|---|---|---|---|---|---|---|---|---|---|
| Seed 2.1 Turbo | 2.9 | 4.4 | 22.2% | 2 | 656.04s | 828 | 13 | 333,977 | |
| Qwen3.8 Max (0902) | 5.3 | 7.2 | 44.4% | 1 | 34.93s | 1,014 | 45 | 13,881 |
| Allgemeine Intelligenz | Punktzahl | Konsistenz | Erfolgsquote pro Versuch | Instabile Tests | Korrekte Tests | Antwortzeit (Durchschnitt) | Eingabe-Token | Ausgabe-Token | Denk-Token |
|---|---|---|---|---|---|---|---|---|---|
| Seed 2.1 Turbo | 6.1 | 3.1 | 66.7% | 1 | 40.59s | 573 | 204 | 6,294 | |
| Qwen3.8 Max (0902) | 6.1 | 3.1 | 66.7% | 1 | 8.91s | 594 | 120 | 820 |
| Befolgung von Anweisungen | Punktzahl | Konsistenz | Erfolgsquote pro Versuch | Instabile Tests | Korrekte Tests | Antwortzeit (Durchschnitt) | Eingabe-Token | Ausgabe-Token | Denk-Token |
|---|---|---|---|---|---|---|---|---|---|
| Seed 2.1 Turbo | 9.8 | 10.0 | 100.0% | 0 | 7.48s | 816 | 72 | 1,875 | |
| Qwen3.8 Max (0902) | 10.0 | 10.0 | 100.0% | 0 | 4.32s | 855 | 90 | 866 |
| Rätsellösen | Punktzahl | Konsistenz | Erfolgsquote pro Versuch | Instabile Tests | Korrekte Tests | Antwortzeit (Durchschnitt) | Eingabe-Token | Ausgabe-Token | Denk-Token |
|---|---|---|---|---|---|---|---|---|---|
| Seed 2.1 Turbo | 9.9 | 10.0 | 100.0% | 0 | 21.01s | 867 | 405 | 10,438 | |
| Qwen3.8 Max (0902) | 10.0 | 10.0 | 100.0% | 0 | 4.49s | 930 | 275 | 1,248 |
| Werkzeugaufrufe | Punktzahl | Konsistenz | Erfolgsquote pro Versuch | Instabile Tests | Korrekte Tests | Antwortzeit (Durchschnitt) | Eingabe-Token | Ausgabe-Token | Denk-Token |
|---|---|---|---|---|---|---|---|---|---|
| Seed 2.1 Turbo | 10.0 | 10.0 | 100.0% | 0 | 27.46s | 9,297 | 228 | 1,482 | |
| Qwen3.8 Max (0902) | 10.0 | 10.0 | 100.0% | 0 | 4.73s | 8,463 | 249 | 126 |
| Allgemeinwissen | Punktzahl | Konsistenz | Erfolgsquote pro Versuch | Instabile Tests | Korrekte Tests | Antwortzeit (Durchschnitt) | Eingabe-Token | Ausgabe-Token | Denk-Token |
|---|---|---|---|---|---|---|---|---|---|
| Seed 2.1 Turbo | 3.0 | 10.0 | 0.0% | 0 | 91.00s | 267 | 10 | 13,102 | |
| Qwen3.8 Max (0902) | 3.0 | 10.0 | 0.0% | 0 | 13.28s | 282 | 23 | 1,755 |
Schnellvergleich
Vergleichspaar wechseln
Seed 2.1 TurbomediumvsQwen3.8 27BhighKostenlos verfügbarSeed 2.1 TurbomediumvsGPT-6 SollowQwen3.8 Max (0902)lowvsGrok 4.6highClaude Sonnet 5.5highvsQwen3.8 Max (0902)lowClaude Sonnet 5.5xhighvsQwen3.8 Max (0902)lowSeed 2.1 TurbomediumvsDeepSeek V4.1 FlashmaxClaude Sonnet 5mediumvsQwen3.8 Max (0902)lowDeepSeek V4.1 FlashmaxvsQwen3.8 Max (0902)lowSeed 2.1 TurbomediumvsMuse Spark 1.2lowSeed 2.1 TurbomediumvsMuse Spark 1.1lowClaude Sonnet 5.5xhighvsSeed 2.1 TurbomediumClaude Sonnet 5.5highvsSeed 2.1 Turbomedium