Zusammenfassung
Claude Opus 5.5 erreicht 1.8 bei AI BENCHY und liegt auf #359. Das Modell hat 10.0 Zuverlässigkeit, 4.6% Erfolgsrate, $0.015 Gesamtkosten und 13.58s durchschnittliche Antwortzeit.
Was Claude Opus 5.5 besonders macht: Die Benchmark-Gesamtkosten sind für diese Leistungsklasse ungewöhnlich niedrig.
Archiviertes Modell: Dieses Modell wird nicht mehr aktualisiert und nicht mehr in neuen Tests getestet.
Modelldaten
Recherchiert am 2026-09-23
- Parameter
- ~5T insgesamt (~500B aktiv)
- Architektur
- MoE
- Verfügbarkeit
- Geschlossen
- Lizenz
- -
Beste Schätzung auf Grundlage öffentlicher Informationen; der Anbieter hat nicht alle Werte offengelegt.
1.8
Konsistenz
5.0
10.0
Gesamte Ausgabe-Token
735
Gesamte Eingabe-Token
73
Eingabepreis
$4.000 / 1M
Ausgabepreis
$20.000 / 1M
Instabile Tests
0
Instabile Tests hatten gemischte Ergebnisse über Läufe hinweg (mindestens ein Erfolg und ein Fehlschlag).
Diagramme
Wähle zuerst das erste Modell und klicke dann ein zweites Modell, um eine Seite im direkten Vergleich zu öffnen.
Punktzahl vs Gesamtkosten
Antwortzeit (Durchschnitt)
Punktzahl vs Antwortzeit (Durchschnitt)
Gesamte Ausgabe-Token
Punktzahl vs Gesamte Ausgabe-Token
Kategorieaufschlüsselung
| Kategorie | Punktzahl | Konsistenz | Korrekte Tests |
|---|---|---|---|
| Anti-KI-Tricks | 0.0 | 0.0 | |
| Programmierung | 0.0 | 0.0 | |
| Kombiniert | 0.0 | 0.0 | |
| Datenanalyse und -extraktion | 0.0 | 0.0 | |
| Domänenspezifisch | 3.3 | 3.3 | |
| Allgemeine Intelligenz | 0.0 | 0.0 | |
| Befolgung von Anweisungen | 0.0 | 0.0 | |
| Rätsellösen | 0.0 | 0.0 | |
| Werkzeugaufrufe | 0.0 | 0.0 | |
| Allgemeinwissen | 0.0 | 0.0 |