Urambazaji
AI BENCHY
Advertise here

AI BENCHY Compare

MoonshotAI: Kimi K2.5 vs OpenAI: GPT-5.4 Mini

Benchmark zimetengenezwa kutoka seti za majaribio za AI BENCHY tarehe: 2026-05-19

Kipimo Kimi K2.5 Kimi K2.5 medium Toleo: 2026-01-27 GPT-5.4 Mini GPT-5.4 Mini medium Toleo: 2026-03-17
Alama 6.8 7.2
Nafasi #76 #67
Uaminifu 10.0 10.0
Uthabiti 7.0 7.9
Majaribio sahihi
Kiwango cha kupita kwa kila jaribio 68.4% 68.4%
Majaribio yasiyo thabiti 7 5
Jumla ya uendeshaji 57 57
Gharama kwa matokeo 2.616 3.443
Jumla ya gharama $0.236 $0.345
Bei ya ingizo $0.400 / 1M $0.750 / 1M
Bei ya toleo $1.900 / 1M $4.500 / 1M
Tokeni za matokeo 42,188 2,163
Tokeni za hoja 92,514 69,741
Muda wa majibu (wastani) 73.39s 16.00s
Muda wa majibu (upeo) 150.77s 102.91s
Muda wa majibu (jumla) 880.65s 303.99s

Modeli bora kwa alama

Alama dhidi ya gharama ya jumla

Muda wa majibu (wastani)

Alama vs Muda wa majibu (wastani)

Jumla ya tokeni za matokeo

Alama vs Jumla ya tokeni za matokeo

Mgawanyo wa kategoria

Mbinu za kupinga AI Alama Uthabiti Kiwango cha kupita kwa kila jaribio Majaribio yasiyo thabiti Majaribio sahihi Muda wa majibu (wastani) Tokeni za matokeo Tokeni za hoja
Kimi K2.5 7.3 5.8 83.3% 2 51.38s 2,789 8,880
GPT-5.4 Mini 8.6 7.9 91.7% 1 4.05s 296 2,876
Uandishi wa msimbo Alama Uthabiti Kiwango cha kupita kwa kila jaribio Majaribio yasiyo thabiti Majaribio sahihi Muda wa majibu (wastani) Tokeni za matokeo Tokeni za hoja
Kimi K2.5 4.7 1.6 66.7% 1 150.77s 1,269 9,749
GPT-5.4 Mini 10.0 10.0 100.0% 0 7.76s 423 1,548
Mchanganyiko Alama Uthabiti Kiwango cha kupita kwa kila jaribio Majaribio yasiyo thabiti Majaribio sahihi Muda wa majibu (wastani) Tokeni za matokeo Tokeni za hoja
Kimi K2.5 10.0 10.0 100.0% 0 71.37s 703 3,713
GPT-5.4 Mini 10.0 10.0 100.0% 0 17.81s 317 4,317
Uchanganuzi na uchimbaji wa data Alama Uthabiti Kiwango cha kupita kwa kila jaribio Majaribio yasiyo thabiti Majaribio sahihi Muda wa majibu (wastani) Tokeni za matokeo Tokeni za hoja
Kimi K2.5 10.0 10.0 100.0% 0 49.78s 563 7,940
GPT-5.4 Mini 10.0 10.0 100.0% 0 2.43s 234 650
Mahususi kwa domeni Alama Uthabiti Kiwango cha kupita kwa kila jaribio Majaribio yasiyo thabiti Majaribio sahihi Muda wa majibu (wastani) Tokeni za matokeo Tokeni za hoja
Kimi K2.5 3.5 4.4 33.3% 2 137.29s 20,753 30,564
GPT-5.4 Mini 4.1 4.4 44.5% 2 65.31s 60 43,286
Akili ya jumla Alama Uthabiti Kiwango cha kupita kwa kila jaribio Majaribio yasiyo thabiti Majaribio sahihi Muda wa majibu (wastani) Tokeni za matokeo Tokeni za hoja
Kimi K2.5 6.5 3.4 66.7% 1 69.73s 3,815 4,262
GPT-5.4 Mini 4.5 10.0 0.0% 0 3.72s 150 510
Ufuataji wa maagizo Alama Uthabiti Kiwango cha kupita kwa kila jaribio Majaribio yasiyo thabiti Majaribio sahihi Muda wa majibu (wastani) Tokeni za matokeo Tokeni za hoja
Kimi K2.5 10.0 10.0 100.0% 0 92.47s 5,371 6,547
GPT-5.4 Mini 7.4 6.7 66.7% 1 2.50s 129 1,337
Utatuzi wa mafumbo Alama Uthabiti Kiwango cha kupita kwa kila jaribio Majaribio yasiyo thabiti Majaribio sahihi Muda wa majibu (wastani) Tokeni za matokeo Tokeni za hoja
Kimi K2.5 5.3 7.3 44.4% 1 45.40s 6,671 12,403
GPT-5.4 Mini 7.8 10.0 66.7% 0 4.33s 271 2,449
Mwito wa zana Alama Uthabiti Kiwango cha kupita kwa kila jaribio Majaribio yasiyo thabiti Majaribio sahihi Muda wa majibu (wastani) Tokeni za matokeo Tokeni za hoja
Kimi K2.5 10.0 10.0 100.0% 0 31.74s 242 812
GPT-5.4 Mini 4.7 1.6 66.7% 1 9.62s 251 2,594
Maarifa ya jumla Alama Uthabiti Kiwango cha kupita kwa kila jaribio Majaribio yasiyo thabiti Majaribio sahihi Muda wa majibu (wastani) Tokeni za matokeo Tokeni za hoja
Kimi K2.5 3.0 10.0 0.0% 0 83.95s 12 7,644
GPT-5.4 Mini 3.0 10.0 0.0% 0 30.10s 32 10,174

Ulinganisho wa haraka

Badilisha jozi ya ulinganisho