- Punktzahl
- 7.5 (+1.81 Punkte)
- Gesamtkosten (aktueller Preis)
- $0.000 · 100.0% günstiger
- Antwortzeit (Durchschnitt)
- 29.38s · 48.0% schneller
Zusammenfassung
GPT-5 Nano erreicht 5.7 bei AI BENCHY und liegt auf #260. Das Modell hat 10.0 Zuverlässigkeit, 53.6% Erfolgsrate, $0.159 Gesamtkosten und 56.55s durchschnittliche Antwortzeit.
Was GPT-5 Nano besonders macht: Am stärksten ist es in Programmierung, wo es #1 erreicht; am schwächsten ist Datenanalyse und -extraktion mit #17.
Empfohlene Alternativen
Wir empfehlen stattdessen eines dieser Modelle:
- Punktzahl
- 8.1 (+2.33 Punkte)
- Gesamtkosten (aktueller Preis)
- $0.020 · 87.5% günstiger
- Antwortzeit (Durchschnitt)
- 55.99s · 1.0% schneller
- Punktzahl
- 8.3 (+2.53 Punkte)
- Gesamtkosten (aktueller Preis)
- $0.047 · 70.4% günstiger
- Antwortzeit (Durchschnitt)
- 18.07s · 68.1% schneller
Modelldaten
Recherchiert am 2026-08-12
- Parameter
- ~120B insgesamt (~5B aktiv)
- Architektur
- MoE
- Verfügbarkeit
- Geschlossen
- Lizenz
- -
Beste Schätzung auf Grundlage öffentlicher Informationen; der Anbieter hat nicht alle Werte offengelegt.
5.7
Konsistenz
6.5
10.0
Gesamte Ausgabe-Token
307,921
Gesamte Eingabe-Token
314,436
Eingabepreis
$0.050 / 1M
Ausgabepreis
$0.400 / 1M
Preis für Cache-Lesen
$0.005 / 1M
Preis für Cache-Schreiben
k. A.
Cache-Preise gelten für Eingabetokens. Lesen nutzt gespeicherte Prompts erneut; Schreiben speichert sie und kann mehr kosten. Für Ausgabetokens gilt der Ausgabepreis.
Instabile Tests
10
Instabile Tests hatten gemischte Ergebnisse über Läufe hinweg (mindestens ein Erfolg und ein Fehlschlag).
Hamster playing table tennis
Prompt: Create a detailed SVG illustration of a hamster playing table tennis.
#260 GPT-5 Nano
medium- Kosten
- $0.006
- Zeit
- 108.5s
- Token
- 13,209 tok
Testverlauf
| Getestet am | Punktzahl | Zuverlässigkeit | Korrekte Tests | Gesamtkosten | Vergleichen |
|---|---|---|---|---|---|
| 2026-10-01 01:31 Erneuter Test | 5.7 | 10.0 | $0.159 ↑ | Aktueller Lauf | |
| 2026-07-16 22:32 Neuer Test hinzugefügt | 6.1 | 10.0 | $0.114 | Vergleichen | |
| 2026-06-04 13:44 Neuer Test hinzugefügt | 6.3 | 10.0 | $0.081 | Vergleichen | |
| 2026-05-22 00:17 Suite geändert | 6.1 | 10.0 | $0.076 | Vergleichen | |
| 2026-04-11 01:44 Erster erfasster Lauf | 6.3 | k. A. | $0.066 | Vergleichen |
Dieser Lauf nutzte eine andere Benchmark-Suite. Berücksichtige Suite-Änderungen bei der historischen Einordnung.
Laufvergleich
| Lauf | Benchmark-Abdeckung | Punktzahl | Konsistenz | Zuverlässigkeit | Korrekte Tests | Instabile Tests | Gesamte Ausgabe-Token | Gesamte Eingabe-Token | Gesamtkosten | Antwortzeit (Durchschnitt) |
|---|---|---|---|---|---|---|---|---|---|---|
| 2026-10-01 01:31 · Aktueller Lauf | 69/69 Versuche | 5.7 | 6.5 | 10.0 | 8/23 | 10 | 307,921 | 314,436 | $0.159 | 56.55s |
| 2026-04-11 01:44 · Erster erfasster Lauf | 54/54 Versuche | 6.3 | 6.5 | k. A. | 7/18 | 8 | 161,268 | 0 | $0.066 | 44.13s |
| Differenz | — | -0.5 | 0.0 | +1 | +2 | +146653 | +314436 | +$0.093 | +12415ms |
Die Benchmark-Abdeckung unterscheidet sich: 69/69 Versuche (Ziel: 3 Wiederholungen pro Test) gegenüber 54/54 Versuche (Ziel: 3 Wiederholungen pro Test). Summen und wiederholungsabhängige Metriken sind nicht direkt vergleichbar.
Diese beiden Läufe nutzten unterschiedliche Benchmark-Suiten, daher spiegeln die Deltas sowohl Modell- als auch Suite-Änderungen wider.
Preisverlauf
Historische Preisdaten für dieses Modell von OpenRouter.
| Datum | Eingabepreis | Ausgabepreis | Preis für Cache-Lesen | Preis für Cache-Schreiben |
|---|---|---|---|---|
| 2026-08-14 12:51 | $0.050 / 1M | $0.400 / 1M | k. A. | k. A. |
| 2026-10-01 18:33 | $0.050 / 1M | $0.400 / 1M | $0.005 / 1M | k. A. |
Diagramme
Wähle zuerst das erste Modell und klicke dann ein zweites Modell, um eine Seite im direkten Vergleich zu öffnen.
Top-Modelle nach Score
Punktzahl vs Gesamtkosten
Antwortzeit (Durchschnitt)
Punktzahl vs Antwortzeit (Durchschnitt)
Gesamte Ausgabe-Token
Punktzahl vs Gesamte Ausgabe-Token
Schnellvergleich
Kategorieaufschlüsselung
| Kategorie | Punktzahl | Konsistenz | Korrekte Tests |
|---|---|---|---|
| Agentenaufgaben | 4.7 | 3.1 | |
| Anti-KI-Tricks | 6.5 | 7.9 | |
| Programmierung | 7.0 | 7.7 | |
| Kombiniert | 6.4 | 5.8 | |
| Datenanalyse und -extraktion | 3.7 | 1.7 | |
| Domänenspezifisch | 3.4 | 1.6 | |
| Allgemeine Intelligenz | 4.1 | 10.0 | |
| Befolgung von Anweisungen | 9.8 | 10.0 | |
| Rätsellösen | 5.3 | 7.2 | |
| Werkzeugaufrufe | 10.0 | 10.0 | |
| Allgemeinwissen | 3.0 | 10.0 |