Advertise here
#106

Seed-2.0-Code

Bytedance Seed Veröffentlichung: 2026-08-12 Getestet am: 2026-08-14 04:25 bytedance-seed/seed-2.0-code::low
~200B insgesamt (~20B aktiv)MoEGeschlossenGeschätzt

Zusammenfassung

Seed-2.0-Code erreicht 7.7 bei AI BENCHY und liegt auf #106. Das Modell hat 8.5 Zuverlässigkeit, 77.3% Erfolgsrate, $0.767 Gesamtkosten und 72.24s durchschnittliche Antwortzeit.

Modelldaten

Recherchiert am 2026-08-12

Geschätzt
Parameter
~200B insgesamt (~20B aktiv)
Architektur
MoE
Verfügbarkeit
Geschlossen
Lizenz
-

Beste Schätzung auf Grundlage öffentlicher Informationen; der Anbieter hat nicht alle Werte offengelegt.

Punktzahl

7.7

Konsistenz

7.8

Gesamte Ausgabe-Token

241,309

Gesamte Eingabe-Token

85,657

Eingabepreis

$0.500 / 1M

Ausgabepreis

$3.000 / 1M

Korrekte Tests

Falsche Tests: 9

Erfolgsquote pro Versuch: 77.3%

Instabile Tests

6

Instabile Tests hatten gemischte Ergebnisse über Läufe hinweg (mindestens ein Erfolg und ein Fehlschlag).

Antwortzeit (Durchschnitt)

72.24s

Antwortzeit (Maximum): 485.92s

Antwortzeit (Gesamt): 1589.31s

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#106 Seed-2.0-Code

low
Provider returned error
Kosten
$0.000
Zeit
0.3s
Token
0 tok

Testverlauf

Getestet am Punktzahl Zuverlässigkeit Korrekte Tests Gesamtkosten Vergleichen
2026-08-14 04:25 Erneuter Test 7.7 8.5 $0.767 Aktueller Lauf
2026-08-12 22:39 Erster Lauf 7.7 5.7 $0.681 Vergleichen

Dieser Lauf nutzte eine andere Benchmark-Suite. Berücksichtige Suite-Änderungen bei der historischen Einordnung.

Preisverlauf

Historische Preisdaten für dieses Modell von OpenRouter.

Datum Eingabepreis Ausgabepreis
2026-08-14 12:51 $0.500 / 1M $3.000 / 1M

Diagramme

Wähle zuerst das erste Modell und klicke dann ein zweites Modell, um eine Seite im direkten Vergleich zu öffnen.

Gesamte Ausgabe-Token

Punktzahl vs Gesamte Ausgabe-Token

Schnellvergleich

Kategorieaufschlüsselung

Kategorie Punktzahl Konsistenz Korrekte Tests
Anti-KI-Tricks 8.7 7.9
Programmierung 7.0 7.1
Kombiniert 7.3 5.8
Datenanalyse und -extraktion 10.0 10.0
Domänenspezifisch 4.1 4.4
Allgemeine Intelligenz 6.5 3.4
Befolgung von Anweisungen 9.8 10.0
Rätsellösen 9.9 10.0
Werkzeugaufrufe 10.0 10.0
Allgemeinwissen 3.0 10.0

Verglichene Modelle