- Rango
- #88
- Total de tokens de salida
- 57,978
- Tiempo de respuesta (promedio)
- 14.12s
- Costo total
- $3.636
Claude Opus 4.7 (medium) vs DeepSeek V4 Pro 0423 (high)
La puntuación media está prácticamente empatada en 8.1 vs 8.1. DeepSeek V4 Pro 0423 (high) tiene menor coste de benchmark con $0.556 vs $3.636. Claude Opus 4.7 (medium) es más rápido con 14.12s vs 91.29s, con tasas de acierto de 81.2% vs 65.2%.
Modelos comparados
- Rango
- #87
- Total de tokens de salida
- 228,663
- Tiempo de respuesta (promedio)
- 91.29s
- Costo total
- $0.556
Modelo recomendado
Claude Opus 4.7 (medium)
Tiene la mejor puntuación aquí (8.1) y responde aproximadamente 6.5x más rápido que DeepSeek V4 Pro 0423 (high).
Comparación detallada
| Métrica | Claude Opus 4.7 Claude Opus 4.7 medium | DeepSeek V4 Pro 0423 DeepSeek V4 Pro 0423 high |
|---|---|---|
| Puntuación | 8.1 | 8.1 |
| Rango | #88 | #87 |
| Fiabilidad | 10.0 | 10.0 |
| Consistencia | 9.3 | 7.8 |
| Intentos | 69/69 | 69/69 |
| Pruebas correctas | ||
| Tasa de aciertos por intento | 81.2% | 65.2% |
| Pruebas inestables | 2 | 6 |
| Ejecuciones totales | 69 | 69 |
| Costo por resultado | 20.200 | 3.717 |
| Costo total | $3.636 | $0.556 |
| Precio de entrada | $5.000 / 1M | $0.783 / 1M |
| Precio de salida | $25.000 / 1M | $1.566 / 1M |
| Total de tokens de entrada | 437,293 | 287,061 |
| Tokens de salida | 29,102 | 32,056 |
| Tokens de razonamiento | 28,876 | 196,607 |
| Tiempo de respuesta (promedio) | 14.12s | 91.29s |
| Tiempo de respuesta (máximo) | 150.60s | 416.76s |
| Tiempo de respuesta (total) | 310.55s | 2099.56s |
| Parámetros | ~5T en total (~500B activos) | 1.6T en total (49B activos) |
| Disponibilidad | Código cerrado | Código abierto |
Generación showcase de modelos
Hamster playing table tennis
Prompt: Create a detailed SVG illustration of a hamster playing table tennis.
#88 Claude Opus 4.7
medium- Coste
- $0.059
- Tiempo
- 26.8s
- Tokens
- 2,475 tok
#87 DeepSeek V4 Pro 0423
high- Coste
- $0.023
- Tiempo
- 257.6s
- Tokens
- 14,870 tok
Mejores modelos por puntuación
Puntuación vs costo total
Tiempo de respuesta (promedio)
Puntuación vs Tiempo de respuesta (promedio)
Total de tokens de salida
Puntuación vs Total de tokens de salida
Desglose por categoría
| Tareas de agentes | Puntuación | Consistencia | Tasa de aciertos por intento | Pruebas inestables | Pruebas correctas | Tiempo de respuesta (promedio) | Tokens de entrada | Tokens de salida | Tokens de razonamiento |
|---|---|---|---|---|---|---|---|---|---|
| Claude Opus 4.7 | 5.2 | 3.2 | 33.3% | 1 | 150.60s | 292,044 | 4,154 | 23,834 | |
| DeepSeek V4 Pro 0423 | 10.0 | 10.0 | 100.0% | 0 | 64.54s | 196,304 | 9,128 | 10,091 |
| Trucos anti-IA | Puntuación | Consistencia | Tasa de aciertos por intento | Pruebas inestables | Pruebas correctas | Tiempo de respuesta (promedio) | Tokens de entrada | Tokens de salida | Tokens de razonamiento |
|---|---|---|---|---|---|---|---|---|---|
| Claude Opus 4.7 | 8.3 | 10.0 | 75.0% | 0 | 1.85s | 894 | 348 | 0 | |
| DeepSeek V4 Pro 0423 | 5.7 | 5.9 | 58.3% | 2 | 25.70s | 536 | 149 | 3,214 |
| Programación | Puntuación | Consistencia | Tasa de aciertos por intento | Pruebas inestables | Pruebas correctas | Tiempo de respuesta (promedio) | Tokens de entrada | Tokens de salida | Tokens de razonamiento |
|---|---|---|---|---|---|---|---|---|---|
| Claude Opus 4.7 | 7.6 | 7.2 | 77.8% | 1 | 12.96s | 10,635 | 7,629 | 1,114 | |
| DeepSeek V4 Pro 0423 | 6.3 | 8.7 | 33.3% | 0 | 243.00s | 5,090 | 383 | 84,580 |
| Combinado | Puntuación | Consistencia | Tasa de aciertos por intento | Pruebas inestables | Pruebas correctas | Tiempo de respuesta (promedio) | Tokens de entrada | Tokens de salida | Tokens de razonamiento |
|---|---|---|---|---|---|---|---|---|---|
| Claude Opus 4.7 | 10.0 | 10.0 | 100.0% | 0 | 43.42s | 104,347 | 15,459 | 3,928 | |
| DeepSeek V4 Pro 0423 | 10.0 | 10.0 | 100.0% | 0 | 78.99s | 66,082 | 4,582 | 25,404 |
| Análisis y extracción de datos | Puntuación | Consistencia | Tasa de aciertos por intento | Pruebas inestables | Pruebas correctas | Tiempo de respuesta (promedio) | Tokens de entrada | Tokens de salida | Tokens de razonamiento |
|---|---|---|---|---|---|---|---|---|---|
| Claude Opus 4.7 | 10.0 | 10.0 | 100.0% | 0 | 2.37s | 10,533 | 324 | 0 | |
| DeepSeek V4 Pro 0423 | 10.0 | 10.0 | 100.0% | 0 | 25.03s | 7,690 | 274 | 2,166 |
| Específico del dominio | Puntuación | Consistencia | Tasa de aciertos por intento | Pruebas inestables | Pruebas correctas | Tiempo de respuesta (promedio) | Tokens de entrada | Tokens de salida | Tokens de razonamiento |
|---|---|---|---|---|---|---|---|---|---|
| Claude Opus 4.7 | 7.7 | 10.0 | 66.7% | 0 | 1.19s | 627 | 51 | 0 | |
| DeepSeek V4 Pro 0423 | 3.6 | 7.2 | 22.2% | 1 | 249.47s | 578 | 16,870 | 58,188 |
| Inteligencia general | Puntuación | Consistencia | Tasa de aciertos por intento | Pruebas inestables | Pruebas correctas | Tiempo de respuesta (promedio) | Tokens de entrada | Tokens de salida | Tokens de razonamiento |
|---|---|---|---|---|---|---|---|---|---|
| Claude Opus 4.7 | 10.0 | 10.0 | 100.0% | 0 | 2.87s | 723 | 256 | 0 | |
| DeepSeek V4 Pro 0423 | 10.0 | 10.0 | 100.0% | 0 | 8.83s | 471 | 115 | 1,013 |
| Seguimiento de instrucciones | Puntuación | Consistencia | Tasa de aciertos por intento | Pruebas inestables | Pruebas correctas | Tiempo de respuesta (promedio) | Tokens de entrada | Tokens de salida | Tokens de razonamiento |
|---|---|---|---|---|---|---|---|---|---|
| Claude Opus 4.7 | 10.0 | 10.0 | 100.0% | 0 | 1.57s | 939 | 114 | 0 | |
| DeepSeek V4 Pro 0423 | 7.8 | 6.6 | 83.3% | 1 | 8.73s | 627 | 66 | 2,726 |
| Resolución de acertijos | Puntuación | Consistencia | Tasa de aciertos por intento | Pruebas inestables | Pruebas correctas | Tiempo de respuesta (promedio) | Tokens de entrada | Tokens de salida | Tokens de razonamiento |
|---|---|---|---|---|---|---|---|---|---|
| Claude Opus 4.7 | 10.0 | 10.0 | 100.0% | 0 | 2.43s | 939 | 370 | 0 | |
| DeepSeek V4 Pro 0423 | 6.9 | 4.9 | 77.8% | 2 | 56.85s | 591 | 178 | 2,563 |
| Llamada de herramientas | Puntuación | Consistencia | Tasa de aciertos por intento | Pruebas inestables | Pruebas correctas | Tiempo de respuesta (promedio) | Tokens de entrada | Tokens de salida | Tokens de razonamiento |
|---|---|---|---|---|---|---|---|---|---|
| Claude Opus 4.7 | 10.0 | 10.0 | 100.0% | 0 | 4.17s | 15,339 | 373 | 0 | |
| DeepSeek V4 Pro 0423 | 9.8 | 10.0 | 100.0% | 0 | 15.92s | 8,909 | 295 | 701 |
| Cultura general | Puntuación | Consistencia | Tasa de aciertos por intento | Pruebas inestables | Pruebas correctas | Tiempo de respuesta (promedio) | Tokens de entrada | Tokens de salida | Tokens de razonamiento |
|---|---|---|---|---|---|---|---|---|---|
| Claude Opus 4.7 | 3.0 | 10.0 | 0.0% | 0 | 2.25s | 273 | 24 | 0 | |
| DeepSeek V4 Pro 0423 | 3.0 | 10.0 | 0.0% | 0 | 34.01s | 183 | 16 | 5,961 |
Comparación rápida
Cambiar par de comparación
Claude Opus 4.7mediumvsDeepSeek V4 Flash 0423highClaude Opus 4.7mediumvsDeepSeek V4.1 FlashlowSeed-2.0-CodelowvsDeepSeek V4 Pro 0423highClaude Opus 4.7mediumvsGPT-5.6 LunahighClaude Opus 4.7mediumvsSeed-2.0-CodelowSeed-2.0-LitemediumvsDeepSeek V4 Pro 0423highDeepSeek V4 Pro 0423highvsNemotron 3 UltramediumDisponible gratisDeepSeek V4 Pro 0423highvsGPT-5.4 NanomediumDeepSeek V4 Pro 0423highvsGemini 3.8 FlashmediumClaude Opus 4.7mediumvsGPT-5.6 TerralowClaude Opus 4.7mediumvsGLM 5.3 FlashXmaxDeepSeek V4 Pro 0423highvsGPT-5.6 Terralow