Navegación
AI BENCHY
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

AI BENCHY Compare

ByteDance Seed: Seed-2.0-Mini vs Google: Gemma 4 31B

Benchmarks generados a partir de los suites de prueba de AI BENCHY en: 2026-04-02

Métrica Seed-2.0-Mini Seed-2.0-Mini medium Lanzamiento: 2026-02-14 Gemma 4 31B Gemma 4 31B none Lanzamiento: 2026-04-02
Puntuación 7.3 6.7
Rango #35 #47
Consistencia 9.1 10.0
Pruebas correctas
Tasa de aciertos por intento 64.7% 52.9%
Pruebas inestables 2 0
Ejecuciones totales 51 51
Costo por resultado 0.281 0.023
Costo total $0.029 $0.002
Precio de entrada $0.100 / 1M $0.140 / 1M
Precio de salida $0.400 / 1M $0.400 / 1M
Tokens de salida 1,971 660
Tokens de razonamiento 58,624 0
Tiempo de respuesta (promedio) 60.58s 2.55s
Tiempo de respuesta (máximo) 262.83s 4.68s
Tiempo de respuesta (total) 848.16s 38.20s

Mejores modelos por puntuación

Puntuación vs costo total

Tiempo de respuesta (promedio)

Puntuación vs Tiempo de respuesta (promedio)

Total de tokens de salida

Puntuación vs Total de tokens de salida

Desglose por categoría

Trucos anti-IA Puntuación Consistencia Tasa de aciertos por intento Pruebas inestables Pruebas correctas Tiempo de respuesta (promedio) Tokens de salida Tokens de razonamiento
Seed-2.0-Mini 6.6 10.0 50.0% 0 74.75s 360 9,520
Gemma 4 31B 6.5 10.0 50.0% 0 1.85s 45 0
Combinado Puntuación Consistencia Tasa de aciertos por intento Pruebas inestables Pruebas correctas Tiempo de respuesta (promedio) Tokens de salida Tokens de razonamiento
Seed-2.0-Mini 10.0 10.0 100.0% 0 262.83s 404 29,806
Gemma 4 31B 3.0 10.0 0.0% 0 0ms 0 0
Análisis y extracción de datos Puntuación Consistencia Tasa de aciertos por intento Pruebas inestables Pruebas correctas Tiempo de respuesta (promedio) Tokens de salida Tokens de razonamiento
Seed-2.0-Mini 10.0 10.0 100.0% 0 24.27s 246 2,743
Gemma 4 31B 10.0 10.0 100.0% 0 2.25s 285 0
Específico del dominio Puntuación Consistencia Tasa de aciertos por intento Pruebas inestables Pruebas correctas Tiempo de respuesta (promedio) Tokens de salida Tokens de razonamiento
Seed-2.0-Mini 3.0 10.0 0.0% 0 0ms 0 0
Gemma 4 31B 7.7 10.0 66.7% 0 3.22s 27 0
Inteligencia general Puntuación Consistencia Tasa de aciertos por intento Pruebas inestables Pruebas correctas Tiempo de respuesta (promedio) Tokens de salida Tokens de razonamiento
Seed-2.0-Mini 5.1 3.4 33.3% 1 36.65s 213 4,210
Gemma 4 31B 10.0 10.0 100.0% 0 2.09s 117 0
Seguimiento de instrucciones Puntuación Consistencia Tasa de aciertos por intento Pruebas inestables Pruebas correctas Tiempo de respuesta (promedio) Tokens de salida Tokens de razonamiento
Seed-2.0-Mini 10.0 10.0 100.0% 0 17.47s 69 2,050
Gemma 4 31B 6.5 10.0 50.0% 0 2.84s 78 0
Puzzle Solving Puntuación Consistencia Tasa de aciertos por intento Pruebas inestables Pruebas correctas Tiempo de respuesta (promedio) Tokens de salida Tokens de razonamiento
Seed-2.0-Mini 8.2 7.2 88.9% 1 25.85s 457 5,060
Gemma 4 31B 5.5 10.0 33.3% 0 2.95s 108 0
Llamada de herramientas Puntuación Consistencia Tasa de aciertos por intento Pruebas inestables Pruebas correctas Tiempo de respuesta (promedio) Tokens de salida Tokens de razonamiento
Seed-2.0-Mini 10.0 10.0 100.0% 0 88.68s 222 5,235
Gemma 4 31B 3.0 10.0 0.0% 0 0ms 0 0

Comparación rápida

Cambiar par de comparación