AI BENCHY Compare

Cobuddy vs OpenAI: GPT-5.4 Mini

Resumen

Comparación benchmark de Cobuddy vs GPT-5.4 Mini: GPT-5.4 Mini lidera en puntuación media con 5.3 vs 4.9. Cobuddy tiene menor coste de benchmark con $0.000 vs $0.038. GPT-5.4 Mini es más rápido con 1.13s vs 39.90s, con tasas de acierto de 47.6% vs 30.2%.

Modelo recomendado: GPT-5.4 Mini - Tiene la mejor puntuación aquí (5.3) y responde aproximadamente 35.2x más rápido que Cobuddy.

Benchmarks generados a partir de los suites de prueba de AI BENCHY en: 2026-06-12

Métrica	Cobuddy Cobuddy medium Lanzamiento: 2026-05-06	GPT-5.4 Mini GPT-5.4 Mini none Lanzamiento: 2026-03-17

Métrica	Cobuddy Cobuddy medium Lanzamiento: 2026-05-06	GPT-5.4 Mini GPT-5.4 Mini none Lanzamiento: 2026-03-17
Puntuación	4.9	5.3
Rango	#144	#131
Fiabilidad	10.0	10.0
Consistencia	7.5	8.8
Pruebas correctas
Tasa de aciertos por intento	47.6%	30.2%
Pruebas inestables	6	3
Ejecuciones totales	63	63
Costo por resultado	0.000	0.743
Costo total	$0.000	$0.038
Precio de entrada	$0.000 / 1M	$0.750 / 1M
Precio de salida	$0.000 / 1M	$4.500 / 1M
Total de tokens de entrada	37,449	34,244
Tokens de salida	1,677	2,541
Tokens de razonamiento	116,703	0
Tiempo de respuesta (promedio)	39.90s	1.13s
Tiempo de respuesta (máximo)	309.02s	2.52s
Tiempo de respuesta (total)	797.98s	23.82s

Generation showcase

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#144 Cobuddy

medium

No showcase result has been generated for this model yet.

Cost: $0.000
Time: -
Tokens: 0 tok

#131 GPT-5.4 Mini

none

Cost: $0.010
Time: 11.7s
Tokens: 2,151 tok

Mejores modelos por puntuación

Puntuación vs costo total

Tiempo de respuesta (promedio)

Puntuación vs Tiempo de respuesta (promedio)

Total de tokens de salida

Puntuación vs Total de tokens de salida

Desglose por categoría

Trucos anti-IA	Puntuación	Consistencia	Tasa de aciertos por intento	Pruebas inestables	Pruebas correctas	Tiempo de respuesta (promedio)	Tokens de entrada	Tokens de salida	Tokens de razonamiento
Cobuddy	8.7	7.9	91.7%	1		10.00s	453	98	4,666
GPT-5.4 Mini	3.1	8.1	8.3%	1		929ms	606	654	0

Programación	Puntuación	Consistencia	Tasa de aciertos por intento	Pruebas inestables	Pruebas correctas	Tiempo de respuesta (promedio)	Tokens de entrada	Tokens de salida	Tokens de razonamiento
Cobuddy	3.7	6.7	22.2%	1		79.17s	4,726	358	30,138
GPT-5.4 Mini	5.5	10.0	33.3%	0		913ms	7,305	401	0

Combinado	Puntuación	Consistencia	Tasa de aciertos por intento	Pruebas inestables	Pruebas correctas	Tiempo de respuesta (promedio)	Tokens de entrada	Tokens de salida	Tokens de razonamiento
Cobuddy	3.0	10.0	0.0%	0		47.38s	18,324	465	7,265
GPT-5.4 Mini	3.0	10.0	0.0%	0		2.52s	11,019	298	0

Análisis y extracción de datos	Puntuación	Consistencia	Tasa de aciertos por intento	Pruebas inestables	Pruebas correctas	Tiempo de respuesta (promedio)	Tokens de entrada	Tokens de salida	Tokens de razonamiento
Cobuddy	6.3	5.8	66.7%	1		17.36s	8,181	275	5,591
GPT-5.4 Mini	10.0	10.0	100.0%	0		1.30s	7,140	222	0

Específico del dominio	Puntuación	Consistencia	Tasa de aciertos por intento	Pruebas inestables	Pruebas correctas	Tiempo de respuesta (promedio)	Tokens de entrada	Tokens de salida	Tokens de razonamiento
Cobuddy	2.9	4.4	22.2%	2		128.15s	540	10	49,454
GPT-5.4 Mini	3.5	4.4	33.3%	2		937ms	723	88	0

Inteligencia general	Puntuación	Consistencia	Tasa de aciertos por intento	Pruebas inestables	Pruebas correctas	Tiempo de respuesta (promedio)	Tokens de entrada	Tokens de salida	Tokens de razonamiento
Cobuddy	4.2	9.9	0.0%	0		23.23s	498	76	3,782
GPT-5.4 Mini	4.8	10.0	0.0%	0		1.82s	477	174	0

Seguimiento de instrucciones	Puntuación	Consistencia	Tasa de aciertos por intento	Pruebas inestables	Pruebas correctas	Tiempo de respuesta (promedio)	Tokens de entrada	Tokens de salida	Tokens de razonamiento
Cobuddy	9.8	10.0	100.0%	0		11.60s	508	64	2,842
GPT-5.4 Mini	6.3	10.0	50.0%	0		728ms	660	101	0

Resolución de acertijos	Puntuación	Consistencia	Tasa de aciertos por intento	Pruebas inestables	Pruebas correctas	Tiempo de respuesta (promedio)	Tokens de entrada	Tokens de salida	Tokens de razonamiento
Cobuddy	3.6	7.2	22.2%	1		12.83s	561	189	5,808
GPT-5.4 Mini	5.4	10.0	33.3%	0		836ms	642	305	0

Llamada de herramientas	Puntuación	Consistencia	Tasa de aciertos por intento	Pruebas inestables	Pruebas correctas	Tiempo de respuesta (promedio)	Tokens de entrada	Tokens de salida	Tokens de razonamiento
Cobuddy	10.0	10.0	100.0%	0		11.19s	3,505	133	294
GPT-5.4 Mini	3.0	10.0	0.0%	0		2.32s	5,477	255	0

Cultura general	Puntuación	Consistencia	Tasa de aciertos por intento	Pruebas inestables	Pruebas correctas	Tiempo de respuesta (promedio)	Tokens de entrada	Tokens de salida	Tokens de razonamiento
Cobuddy	3.0	10.0	0.0%	0		36.98s	153	9	6,863
GPT-5.4 Mini	3.0	10.0	0.0%	0		1.33s	195	43	0

Comparación rápida

Cambiar par de comparación

CobuddymediumvsGPT-4o-mininone CobuddymediumvsGLM 4.7 Flashnone CobuddymediumvsNemotron 3 SupernoneDisponible gratis CobuddymediumvsLing-2.6-flashnone Trinity Large PreviewnonevsCobuddymedium CobuddymediumvsRing-2.6-1Tnone MiniMax M2.7mediumvsGPT-5.4 Mininone CobuddymediumvsGPT-5.4 Nanonone Cobuddymediumvsgpt-oss-120bnoneDisponible gratis CobuddymediumvsQwen3.5-9Bnone CobuddymediumvsMiMo-V2.5none Mistral Small 4mediumvsGPT-5.4 Mininone