AI BENCHY
Advertise here
#66

Seed-2.0-Code

Bytedance Seed Veröffentlichung: 2026-08-12 Getestet am: 2026-08-12 22:39 bytedance-seed/seed-2.0-code::low
~200B insgesamt (~20B aktiv)MoEGeschlossenGeschätzt

Zusammenfassung

Seed-2.0-Code erreicht 7.7 bei AI BENCHY und liegt auf #66. Das Modell hat 5.7 Zuverlässigkeit, 80.3% Erfolgsrate, $0.681 Gesamtkosten und 65.89s durchschnittliche Antwortzeit.

Was Seed-2.0-Code besonders macht: Am stärksten ist es in Datenanalyse und -extraktion, wo es #1 erreicht; am schwächsten ist Befolgung von Anweisungen mit #13.

Modelldaten

Recherchiert am 2026-08-12

Geschätzt
Parameter
~200B insgesamt (~20B aktiv)
Architektur
MoE
Verfügbarkeit
Geschlossen
Lizenz
-

Beste Schätzung auf Grundlage öffentlicher Informationen; der Anbieter hat nicht alle Werte offengelegt.

Punktzahl

7.7

Konsistenz

7.5

Gesamte Ausgabe-Token

212,558

Gesamte Eingabe-Token

85,648

Eingabepreis

$0.500 / 1M

Ausgabepreis

$3.000 / 1M

Korrekte Tests

Falsche Tests: 9

Erfolgsquote pro Versuch: 80.3%

Instabile Tests

7

Instabile Tests hatten gemischte Ergebnisse über Läufe hinweg (mindestens ein Erfolg und ein Fehlschlag).

Antwortzeit (Durchschnitt)

65.89s

Antwortzeit (Maximum): 485.92s

Antwortzeit (Gesamt): 1449.53s

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#66 Seed-2.0-Code

low
Provider returned error
Kosten
$0.000
Zeit
0.3s
Token
0 tok

Preisverlauf

Historische Preisdaten für dieses Modell von OpenRouter.

Datum Eingabepreis Ausgabepreis
2026-08-12 23:12 $0.500 / 1M $3.000 / 1M

Diagramme

Wähle zuerst das erste Modell und klicke dann ein zweites Modell, um eine Seite im direkten Vergleich zu öffnen.

Gesamte Ausgabe-Token

Punktzahl vs Gesamte Ausgabe-Token

Schnellvergleich

Kategorieaufschlüsselung

Kategorie Punktzahl Konsistenz Korrekte Tests
Anti-KI-Tricks 8.7 7.9
Programmierung 7.0 5.0
Kombiniert 7.3 5.8
Datenanalyse und -extraktion 10.0 10.0
Domänenspezifisch 4.1 4.4
Allgemeine Intelligenz 6.5 3.4
Befolgung von Anweisungen 9.8 10.0
Rätsellösen 9.9 10.0
Werkzeugaufrufe 10.0 10.0
Allgemeinwissen 3.0 10.0

Verglichene Modelle