- Rang
- #90
- Gesamte Ausgabe-Token
- 57,778
- Antwortzeit (Durchschnitt)
- 4.59s
- Gesamtkosten
- $0.117
Gemini 3.1 Flash Lite Preview (medium) vs Kimi K2.7 Code (medium)
Der Durchschnittsscore ist mit 7.4 vs 7.4 praktisch gleichauf. Gemini 3.1 Flash Lite Preview (medium) hat die niedrigeren Benchmark-Kosten mit $0.117 vs $0.709. Gemini 3.1 Flash Lite Preview (medium) ist schneller mit 4.59s vs 80.09s, mit Erfolgsraten von 63.6% vs 63.6%.
- Rang
- #92
- Gesamte Ausgabe-Token
- 239,546
- Antwortzeit (Durchschnitt)
- 80.09s
- Gesamtkosten
- $0.709
Empfohlenes Modell
Gemini 3.1 Flash Lite Preview (medium)
Es hat hier die beste Punktzahl (7.4) und kostet etwa 6.1x weniger als Kimi K2.7 Code (medium).
Detaillierter Vergleich
| Metrik | Gemini 3.1 Flash Lite Preview Gemini 3.1 Flash Lite Preview medium | Kimi K2.7 Code Kimi K2.7 Code medium |
|---|---|---|
| Punktzahl | 7.4 | 7.4 |
| Rang | #90 | #92 |
| Zuverlässigkeit | 10.0 | 10.0 |
| Konsistenz | 9.9 | 8.0 |
| Versuche | 66/66 | 66/66 |
| Korrekte Tests | ||
| Erfolgsquote pro Versuch | 63.6% | 63.6% |
| Instabile Tests | 0 | 5 |
| Gesamtläufe | 66 | 66 |
| Kosten pro Ergebnis | 0.829 | 7.096 |
| Gesamtkosten | $0.117 | $0.709 |
| Eingabepreis | $0.250 / 1M | $0.710 / 1M |
| Ausgabepreis | $1.500 / 1M | $3.500 / 1M |
| Gesamte Eingabe-Token | 117,493 | 72,085 |
| Ausgabe-Token | 10,589 | 57,453 |
| Denk-Token | 47,189 | 182,093 |
| Antwortzeit (Durchschnitt) | 4.59s | 80.09s |
| Antwortzeit (Maximum) | 18.34s | 365.80s |
| Antwortzeit (Gesamt) | 101.04s | 1681.85s |
| Parameter | ~150B insgesamt (~10B aktiv) | 1T insgesamt (32B aktiv) |
| Verfügbarkeit | Geschlossen | Gewichte verfügbar |
Modell-Generierungs-Showcase
Hamster playing table tennis
Prompt: Create a detailed SVG illustration of a hamster playing table tennis.
#90 Gemini 3.1 Flash Lite Preview
medium- Kosten
- $0.003
- Zeit
- 5.2s
- Token
- 1,944 tok
#92 MoonshotAI: Kimi K2.7 Code
medium- Kosten
- $0.025
- Zeit
- 138.0s
- Token
- 6,093 tok
Top-Modelle nach Score
Score vs. Gesamtkosten
Antwortzeit (Durchschnitt)
Punktzahl vs Antwortzeit (Durchschnitt)
Gesamte Ausgabe-Token
Punktzahl vs Gesamte Ausgabe-Token
Kategorieaufschlüsselung
| Anti-KI-Tricks | Punktzahl | Konsistenz | Erfolgsquote pro Versuch | Instabile Tests | Korrekte Tests | Antwortzeit (Durchschnitt) | Eingabe-Token | Ausgabe-Token | Denk-Token |
|---|---|---|---|---|---|---|---|---|---|
| Gemini 3.1 Flash Lite Preview | 9.1 | 10.0 | 75.0% | 0 | 2.33s | 512 | 570 | 4,305 | |
| Kimi K2.7 Code | 7.3 | 5.8 | 83.3% | 2 | 11.56s | 618 | 3,048 | 5,041 |
| Programmierung | Punktzahl | Konsistenz | Erfolgsquote pro Versuch | Instabile Tests | Korrekte Tests | Antwortzeit (Durchschnitt) | Eingabe-Token | Ausgabe-Token | Denk-Token |
|---|---|---|---|---|---|---|---|---|---|
| Gemini 3.1 Flash Lite Preview | 5.5 | 10.0 | 33.3% | 0 | 4.09s | 8,126 | 461 | 8,597 | |
| Kimi K2.7 Code | 7.8 | 9.3 | 66.7% | 0 | 146.73s | 4,650 | 1,864 | 25,635 |
| Kombiniert | Punktzahl | Konsistenz | Erfolgsquote pro Versuch | Instabile Tests | Korrekte Tests | Antwortzeit (Durchschnitt) | Eingabe-Token | Ausgabe-Token | Denk-Token |
|---|---|---|---|---|---|---|---|---|---|
| Gemini 3.1 Flash Lite Preview | 7.2 | 9.1 | 50.0% | 0 | 16.63s | 93,097 | 8,706 | 16,997 | |
| Kimi K2.7 Code | 7.3 | 5.8 | 83.3% | 1 | 66.03s | 57,353 | 3,642 | 21,308 |
| Datenanalyse und -extraktion | Punktzahl | Konsistenz | Erfolgsquote pro Versuch | Instabile Tests | Korrekte Tests | Antwortzeit (Durchschnitt) | Eingabe-Token | Ausgabe-Token | Denk-Token |
|---|---|---|---|---|---|---|---|---|---|
| Gemini 3.1 Flash Lite Preview | 10.0 | 10.0 | 100.0% | 0 | 2.29s | 7,362 | 279 | 2,952 | |
| Kimi K2.7 Code | 10.0 | 10.0 | 100.0% | 0 | 12.27s | 7,014 | 248 | 2,569 |
| Domänenspezifisch | Punktzahl | Konsistenz | Erfolgsquote pro Versuch | Instabile Tests | Korrekte Tests | Antwortzeit (Durchschnitt) | Eingabe-Token | Ausgabe-Token | Denk-Token |
|---|---|---|---|---|---|---|---|---|---|
| Gemini 3.1 Flash Lite Preview | 5.3 | 10.0 | 33.3% | 0 | 4.09s | 652 | 18 | 6,120 | |
| Kimi K2.7 Code | 3.7 | 6.5 | 22.2% | 1 | 184.17s | 443 | 29,311 | 66,939 |
| Allgemeine Intelligenz | Punktzahl | Konsistenz | Erfolgsquote pro Versuch | Instabile Tests | Korrekte Tests | Antwortzeit (Durchschnitt) | Eingabe-Token | Ausgabe-Token | Denk-Token |
|---|---|---|---|---|---|---|---|---|---|
| Gemini 3.1 Flash Lite Preview | 10.0 | 10.0 | 100.0% | 0 | 3.16s | 488 | 96 | 1,488 | |
| Kimi K2.7 Code | 10.0 | 10.0 | 100.0% | 0 | 10.78s | 477 | 1,024 | 1,071 |
| Befolgung von Anweisungen | Punktzahl | Konsistenz | Erfolgsquote pro Versuch | Instabile Tests | Korrekte Tests | Antwortzeit (Durchschnitt) | Eingabe-Token | Ausgabe-Token | Denk-Token |
|---|---|---|---|---|---|---|---|---|---|
| Gemini 3.1 Flash Lite Preview | 10.0 | 10.0 | 100.0% | 0 | 1.91s | 621 | 72 | 2,121 | |
| Kimi K2.7 Code | 9.9 | 10.0 | 100.0% | 0 | 5.39s | 669 | 725 | 1,232 |
| Rätsellösen | Punktzahl | Konsistenz | Erfolgsquote pro Versuch | Instabile Tests | Korrekte Tests | Antwortzeit (Durchschnitt) | Eingabe-Token | Ausgabe-Token | Denk-Token |
|---|---|---|---|---|---|---|---|---|---|
| Gemini 3.1 Flash Lite Preview | 7.7 | 10.0 | 66.7% | 0 | 5.30s | 566 | 141 | 1,896 | |
| Kimi K2.7 Code | 5.9 | 7.7 | 44.4% | 1 | 41.00s | 651 | 15,438 | 17,368 |
| Werkzeugaufrufe | Punktzahl | Konsistenz | Erfolgsquote pro Versuch | Instabile Tests | Korrekte Tests | Antwortzeit (Durchschnitt) | Eingabe-Token | Ausgabe-Token | Denk-Token |
|---|---|---|---|---|---|---|---|---|---|
| Gemini 3.1 Flash Lite Preview | 10.0 | 10.0 | 100.0% | 0 | 3.80s | 5,909 | 234 | 912 | |
| Kimi K2.7 Code | 3.0 | 10.0 | 0.0% | 0 | 0ms | 0 | 0 | 0 |
| Allgemeinwissen | Punktzahl | Konsistenz | Erfolgsquote pro Versuch | Instabile Tests | Korrekte Tests | Antwortzeit (Durchschnitt) | Eingabe-Token | Ausgabe-Token | Denk-Token |
|---|---|---|---|---|---|---|---|---|---|
| Gemini 3.1 Flash Lite Preview | 3.0 | 10.0 | 0.0% | 0 | 2.68s | 160 | 12 | 1,801 | |
| Kimi K2.7 Code | 3.0 | 10.0 | 0.0% | 0 | 341.76s | 210 | 2,153 | 40,930 |
Schnellvergleich
Vergleichspaar wechseln
Kimi K2.7 CodemediumvsQwen3.7 MaxnoneGemini 3.1 Flash Lite PreviewmediumvsQwen3.7 MaxnoneGemini 3.1 Flash Lite PreviewmediumvsGPT 5.3 ChatnoneKimi K2.7 CodemediumvsGPT 5.3 ChatnoneKimi K2.7 CodemediumvsQwen3.8 2.4T A95BhighGemini 3.1 Flash Lite PreviewmediumvsGPT-5.6 TerralowGemini 3.1 Flash Lite PreviewmediumvsQwen3.8 2.4T A95BhighKimi K2.7 CodemediumvsGPT-5.6 TerralowKimi K2.7 CodemediumvsGrok 4.6lowGemini 3 Flash PreviewlowvsKimi K2.7 CodemediumGemini 3.1 Flash Lite PreviewmediumvsGrok 4.6lowClaude Sonnet 4.6nonevsKimi K2.7 Codemedium