Navegación
AI BENCHY
Your ad here

AI BENCHY Compare

ByteDance Seed: Seed-2.0-Lite vs DeepSeek: DeepSeek V3.2

Benchmarks generados a partir de los suites de prueba de AI BENCHY en: 2026-03-12

Métrica Seed-2.0-Lite Seed-2.0-Lite medium Lanzamiento: 2026-02-14 DeepSeek V3.2 DeepSeek V3.2 none Lanzamiento: 2025-12-01
Rango #3 #37
Puntaje prom. 8.5 5.5
Consistencia 8.7 8.4
Costo por resultado 0.870 0.220
Costo total $0.105 $0.016
Pruebas correctas
Tasa de aciertos por intento 87.5% 54.2%
Pruebas inestables 3 3
Ejecuciones totales 48 48
Tokens de salida 2,815 7,823
Tokens de razonamiento 44,618 0
Tiempo de respuesta (promedio) 29.39s 12.86s
Tiempo de respuesta (máximo) 168.71s 115.89s
Tiempo de respuesta (total) 470.29s 205.78s

Mejores modelos por puntuación

Puntuación vs costo total

Tiempo de respuesta (promedio)

Puntaje prom. vs Tiempo de respuesta (promedio)

Total de tokens de salida

Puntaje prom. vs Total de tokens de salida

Desglose por categoría

Trucos anti-IA Puntuación Consistencia Tasa de aciertos por intento Pruebas inestables Pruebas correctas Tiempo de respuesta (promedio) Tokens de salida Tokens de razonamiento
Seed-2.0-Lite 10.0 10.0 100.0% 0 23.34s 990 7,037
DeepSeek V3.2 10.0 9.7 0.0% 0 8.79s 1,411 0
Combinado Puntuación Consistencia Tasa de aciertos por intento Pruebas inestables Pruebas correctas Tiempo de respuesta (promedio) Tokens de salida Tokens de razonamiento
Seed-2.0-Lite 10.0 10.0 100.0% 0 37.67s 506 4,299
DeepSeek V3.2 8.0 10.0 0.0% 0 115.89s 2,887 0
Análisis y extracción de datos Puntuación Consistencia Tasa de aciertos por intento Pruebas inestables Pruebas correctas Tiempo de respuesta (promedio) Tokens de salida Tokens de razonamiento
Seed-2.0-Lite 9.9 10.0 100.0% 0 9.07s 246 1,742
DeepSeek V3.2 5.4 5.8 66.7% 1 9.42s 1,710 0
Específico del dominio Puntuación Consistencia Tasa de aciertos por intento Pruebas inestables Pruebas correctas Tiempo de respuesta (promedio) Tokens de salida Tokens de razonamiento
Seed-2.0-Lite 4.0 7.2 55.6% 1 88.74s 15 23,897
DeepSeek V3.2 10.0 7.2 22.2% 1 1.61s 24 0
Inteligencia general Puntuación Consistencia Tasa de aciertos por intento Pruebas inestables Pruebas correctas Tiempo de respuesta (promedio) Tokens de salida Tokens de razonamiento
Seed-2.0-Lite 7.0 3.6 66.7% 1 18.25s 304 1,620
DeepSeek V3.2 10.0 10.0 100.0% 0 2.86s 67 0
Seguimiento de instrucciones Puntuación Consistencia Tasa de aciertos por intento Pruebas inestables Pruebas correctas Tiempo de respuesta (promedio) Tokens de salida Tokens de razonamiento
Seed-2.0-Lite 10.0 10.0 100.0% 0 7.26s 71 1,480
DeepSeek V3.2 10.0 10.0 100.0% 0 1.52s 66 0
Puzzle Solving Puntuación Consistencia Tasa de aciertos por intento Pruebas inestables Pruebas correctas Tiempo de respuesta (promedio) Tokens de salida Tokens de razonamiento
Seed-2.0-Lite 9.3 7.9 88.9% 1 11.03s 461 3,532
DeepSeek V3.2 7.7 7.5 88.9% 1 7.37s 1,136 0
Llamada de herramientas Puntuación Consistencia Tasa de aciertos por intento Pruebas inestables Pruebas correctas Tiempo de respuesta (promedio) Tokens de salida Tokens de razonamiento
Seed-2.0-Lite 10.0 10.0 100.0% 0 12.38s 222 1,011
DeepSeek V3.2 10.0 10.0 100.0% 0 11.85s 522 0

Comparación rápida

Cambiar par de comparación