- Rango
- #160
- Total de tokens de salida
- 42,400
- Tiempo de respuesta (promedio)
- 8.51s
- Costo total
- $0.254
Gemini 3 Flash Preview (low) vs Qwen3.5-122B-A10B (medium)
La puntuación media está prácticamente empatada en 6.9 vs 7.0. Gemini 3 Flash Preview (low) tiene menor coste de benchmark con $0.254 vs $1.152. Gemini 3 Flash Preview (low) es más rápido con 8.51s vs 66.96s, con tasas de acierto de 72.5% vs 71.0%.
Modelos comparados
- Rango
- #158
- Total de tokens de salida
- 522,190
- Tiempo de respuesta (promedio)
- 66.96s
- Costo total
- $1.152
Modelo recomendado
Gemini 3 Flash Preview (low)
Tiene la mejor puntuación aquí (6.9) y cuesta aproximadamente 4.6x menos que Qwen3.5-122B-A10B (medium).
Comparación detallada
| Métrica | Gemini 3 Flash Preview Gemini 3 Flash Preview low | Qwen3.5-122B-A10B Qwen3.5-122B-A10B medium |
|---|---|---|
| Puntuación | 6.9 | 7.0 |
| Rango | #160 | #158 |
| Fiabilidad | 10.0 | 10.0 |
| Consistencia | 9.3 | 8.3 |
| Intentos | 69/69 | 69/69 |
| Pruebas correctas | ||
| Tasa de aciertos por intento | 72.5% | 71.0% |
| Pruebas inestables | 2 | 5 |
| Ejecuciones totales | 69 | 69 |
| Costo por resultado | 1.582 | 9.196 |
| Costo total | $0.254 | $1.152 |
| Precio de entrada | $0.500 / 1M | $0.260 / 1M |
| Precio de salida | $3.000 / 1M | $2.080 / 1M |
| Total de tokens de entrada | 251,677 | 251,695 |
| Tokens de salida | 11,196 | 49,415 |
| Tokens de razonamiento | 31,204 | 472,775 |
| Tiempo de respuesta (promedio) | 8.51s | 66.96s |
| Tiempo de respuesta (máximo) | 52.64s | 519.30s |
| Tiempo de respuesta (total) | 195.76s | 1539.99s |
| Parámetros | ~500B en total (~20B activos) | 122B en total (10B activos) |
| Disponibilidad | Código cerrado | Código abierto |
Generación showcase de modelos
Hamster playing table tennis
Prompt: Create a detailed SVG illustration of a hamster playing table tennis.
#160 Gemini 3 Flash Preview
low- Coste
- $0.007
- Tiempo
- 12.1s
- Tokens
- 2,289 tok
#158 Qwen3.5-122B-A10B
medium- Coste
- $0.019
- Tiempo
- 48.7s
- Tokens
- 6,034 tok
Mejores modelos por puntuación
Puntuación vs costo total
Tiempo de respuesta (promedio)
Puntuación vs Tiempo de respuesta (promedio)
Total de tokens de salida
Puntuación vs Total de tokens de salida
Desglose por categoría
| Tareas de agentes | Puntuación | Consistencia | Tasa de aciertos por intento | Pruebas inestables | Pruebas correctas | Tiempo de respuesta (promedio) | Tokens de entrada | Tokens de salida | Tokens de razonamiento |
|---|---|---|---|---|---|---|---|---|---|
| Gemini 3 Flash Preview | 5.0 | 10.0 | 0.0% | 0 | 52.64s | 127,990 | 1,624 | 0 | |
| Qwen3.5-122B-A10B | 6.1 | 3.1 | 66.7% | 1 | 95.31s | 126,915 | 1,721 | 32,950 |
| Trucos anti-IA | Puntuación | Consistencia | Tasa de aciertos por intento | Pruebas inestables | Pruebas correctas | Tiempo de respuesta (promedio) | Tokens de entrada | Tokens de salida | Tokens de razonamiento |
|---|---|---|---|---|---|---|---|---|---|
| Gemini 3 Flash Preview | 10.0 | 10.0 | 100.0% | 0 | 3.48s | 500 | 281 | 3,082 | |
| Qwen3.5-122B-A10B | 10.0 | 10.0 | 100.0% | 0 | 9.75s | 672 | 269 | 16,835 |
| Programación | Puntuación | Consistencia | Tasa de aciertos por intento | Pruebas inestables | Pruebas correctas | Tiempo de respuesta (promedio) | Tokens de entrada | Tokens de salida | Tokens de razonamiento |
|---|---|---|---|---|---|---|---|---|---|
| Gemini 3 Flash Preview | 5.8 | 7.2 | 44.4% | 1 | 6.00s | 8,122 | 456 | 7,421 | |
| Qwen3.5-122B-A10B | 6.0 | 7.2 | 55.6% | 1 | 114.48s | 7,630 | 8,057 | 82,578 |
| Combinado | Puntuación | Consistencia | Tasa de aciertos por intento | Pruebas inestables | Pruebas correctas | Tiempo de respuesta (promedio) | Tokens de entrada | Tokens de salida | Tokens de razonamiento |
|---|---|---|---|---|---|---|---|---|---|
| Gemini 3 Flash Preview | 3.0 | 10.0 | 0.0% | 0 | 10.20s | 99,775 | 7,822 | 0 | |
| Qwen3.5-122B-A10B | 6.4 | 5.8 | 66.7% | 1 | 313.55s | 97,886 | 18,373 | 203,450 |
| Análisis y extracción de datos | Puntuación | Consistencia | Tasa de aciertos por intento | Pruebas inestables | Pruebas correctas | Tiempo de respuesta (promedio) | Tokens de entrada | Tokens de salida | Tokens de razonamiento |
|---|---|---|---|---|---|---|---|---|---|
| Gemini 3 Flash Preview | 10.0 | 10.0 | 100.0% | 0 | 9.40s | 7,261 | 279 | 3,656 | |
| Qwen3.5-122B-A10B | 10.0 | 10.0 | 100.0% | 0 | 23.41s | 7,782 | 270 | 16,558 |
| Específico del dominio | Puntuación | Consistencia | Tasa de aciertos por intento | Pruebas inestables | Pruebas correctas | Tiempo de respuesta (promedio) | Tokens de entrada | Tokens de salida | Tokens de razonamiento |
|---|---|---|---|---|---|---|---|---|---|
| Gemini 3 Flash Preview | 5.3 | 7.2 | 44.4% | 1 | 9.74s | 648 | 12 | 9,096 | |
| Qwen3.5-122B-A10B | 2.9 | 7.2 | 11.1% | 1 | 74.43s | 780 | 19,154 | 61,573 |
| Inteligencia general | Puntuación | Consistencia | Tasa de aciertos por intento | Pruebas inestables | Pruebas correctas | Tiempo de respuesta (promedio) | Tokens de entrada | Tokens de salida | Tokens de razonamiento |
|---|---|---|---|---|---|---|---|---|---|
| Gemini 3 Flash Preview | 10.0 | 10.0 | 100.0% | 0 | 3.68s | 492 | 120 | 981 | |
| Qwen3.5-122B-A10B | 3.4 | 2.2 | 33.3% | 1 | 34.11s | 344 | 66 | 7,592 |
| Seguimiento de instrucciones | Puntuación | Consistencia | Tasa de aciertos por intento | Pruebas inestables | Pruebas correctas | Tiempo de respuesta (promedio) | Tokens de entrada | Tokens de salida | Tokens de razonamiento |
|---|---|---|---|---|---|---|---|---|---|
| Gemini 3 Flash Preview | 9.9 | 10.0 | 100.0% | 0 | 7.02s | 621 | 71 | 2,752 | |
| Qwen3.5-122B-A10B | 10.0 | 10.0 | 100.0% | 0 | 9.88s | 593 | 77 | 7,372 |
| Resolución de acertijos | Puntuación | Consistencia | Tasa de aciertos por intento | Pruebas inestables | Pruebas correctas | Tiempo de respuesta (promedio) | Tokens de entrada | Tokens de salida | Tokens de razonamiento |
|---|---|---|---|---|---|---|---|---|---|
| Gemini 3 Flash Preview | 10.0 | 10.0 | 100.0% | 0 | 5.77s | 562 | 288 | 3,168 | |
| Qwen3.5-122B-A10B | 10.0 | 10.0 | 100.0% | 0 | 17.89s | 696 | 284 | 27,575 |
| Llamada de herramientas | Puntuación | Consistencia | Tasa de aciertos por intento | Pruebas inestables | Pruebas correctas | Tiempo de respuesta (promedio) | Tokens de entrada | Tokens de salida | Tokens de razonamiento |
|---|---|---|---|---|---|---|---|---|---|
| Gemini 3 Flash Preview | 10.0 | 10.0 | 100.0% | 0 | 4.99s | 5,550 | 234 | 415 | |
| Qwen3.5-122B-A10B | 10.0 | 10.0 | 100.0% | 0 | 4.60s | 8,193 | 322 | 1,226 |
| Cultura general | Puntuación | Consistencia | Tasa de aciertos por intento | Pruebas inestables | Pruebas correctas | Tiempo de respuesta (promedio) | Tokens de entrada | Tokens de salida | Tokens de razonamiento |
|---|---|---|---|---|---|---|---|---|---|
| Gemini 3 Flash Preview | 10.0 | 10.0 | 100.0% | 0 | 2.75s | 156 | 9 | 633 | |
| Qwen3.5-122B-A10B | 3.0 | 10.0 | 0.0% | 0 | 52.87s | 204 | 822 | 15,066 |
Comparación rápida
Cambiar par de comparación
Qwen3.5-122B-A10BmediumvsGrok 4.6lowMuse Glimmer 30BlowvsQwen3.5-122B-A10BmediumEmber-1lowvsQwen3.5-122B-A10BmediumGemini 3 Flash PreviewlowvsKimi K2.7 CodemediumGPT-5.2 ChatnonevsQwen3.5-122B-A10BmediumEmber-1highvsGemini 3 Flash PreviewlowGemini 3 Flash PreviewlowvsGPT-5.2 ChatnoneEmber-1highvsQwen3.5-122B-A10BmediumClaude Opus 4.8nonevsGemini 3 Flash PreviewlowGPT-5.6 LunalowvsQwen3.5-122B-A10BmediumClaude Sonnet 5.5lowvsQwen3.5-122B-A10BmediumClaude Opus 4.8nonevsQwen3.5-122B-A10Bmedium