AI BENCHY Compare

North Mini Code vs xAI: Grok 4.20

Сводка

Сравнение benchmark North Mini Code vs Grok 4.20: North Mini Code лидирует по среднему баллу: 5.8 vs 4.4. North Mini Code имеет более низкую стоимость benchmark: $0.000 vs $0.057. Grok 4.20 быстрее: 1.11s vs 106.18s, с долей успешных попыток 50.8% vs 28.6%.

Рекомендуемая модель: North Mini Code - У него самый высокий балл в этом сравнении (5.8) и лучший общий баланс стоимости и времени ответа среди всех 2 моделей.

Бенчмарки сгенерированы из тестовых наборов AI BENCHY в: 2026-07-02

Метрика	North Mini Code North Mini Code medium Релиз: 2026-06-18 Бесплатно доступно	Grok 4.20 Grok 4.20 none Релиз: 2026-03-31

Метрика	North Mini Code North Mini Code medium Релиз: 2026-06-18 Бесплатно доступно	Grok 4.20 Grok 4.20 none Релиз: 2026-03-31
Оценка	5.8	4.4
Ранг	#110	#160
Надежность	8.5	Н/Д
Стабильность	8.5	8.5
Тестов верно
Доля успешных попыток	50.8%	28.6%
Нестабильные тесты	4	0
Всего запусков	55	54
Стоимость за результат	0.000	1.570
Общая стоимость	$0.000	$0.057
Цена входа	$0.000 / 1M	$1.250 / 1M
Цена выхода	$0.000 / 1M	$2.500 / 1M
Общее число входных токенов	32,891	41,313
Выходные токены	424,772	1,923
Токены рассуждений	1,021,489	0
Время ответа (среднее)	106.18s	1.11s
Время ответа (макс.)	357.05s	6.04s
Время ответа (суммарно)	2229.70s	19.96s

Генерация showcase

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#110 North Mini Code

medium

Стоимость: $0.000
Время: 51.8s
Токены: 12,460 tok

#160 xAI: Grok 4.20

none

Стоимость: $0.004
Время: 6.5s
Токены: 1,367 tok

Лучшие модели по оценке

Оценка vs общая стоимость

Время ответа (среднее)

Оценка vs Время ответа (среднее)

Общее число выходных токенов

Оценка vs Общее число выходных токенов

Разбивка по категориям

Анти-ИИ уловки	Оценка	Стабильность	Доля успешных попыток	Нестабильные тесты	Тестов верно	Время ответа (среднее)	Входные токены	Выходные токены	Токены рассуждений
North Mini Code	8.4	10.0	75.0%	0		64.79s	324	64,441	68,535
Grok 4.20	4.8	10.0	25.0%	0		501ms	1,986	267	0

Программирование	Оценка	Стабильность	Доля успешных попыток	Нестабильные тесты	Тестов верно	Время ответа (среднее)	Входные токены	Выходные токены	Токены рассуждений
North Mini Code	4.5	4.9	33.3%	2		320.43s	7,119	219,891	561,569
Grok 4.20	1.1	3.1	0.0%	0		1.22s	1,074	312	0

Комбинированный	Оценка	Стабильность	Доля успешных попыток	Нестабильные тесты	Тестов верно	Время ответа (среднее)	Входные токены	Выходные токены	Токены рассуждений
North Mini Code	2.8	1.6	33.3%	1		323.07s	14,760	0	151,500
Grok 4.20	3.0	10.0	0.0%	0		6.04s	17,673	282	0

Парсинг и извлечение данных	Оценка	Стабильность	Доля успешных попыток	Нестабильные тесты	Тестов верно	Время ответа (среднее)	Входные токены	Выходные токены	Токены рассуждений
North Mini Code	10.0	10.0	100.0%	0		24.06s	6,819	240	2,659
Grok 4.20	10.0	10.0	100.0%	0		522ms	7,749	207	0

Предметно-ориентированное	Оценка	Стабильность	Доля успешных попыток	Нестабильные тесты	Тестов верно	Время ответа (среднее)	Входные токены	Выходные токены	Токены рассуждений
North Mini Code	5.3	7.2	44.4%	1		71.37s	621	8,483	104,079
Grok 4.20	3.0	10.0	0.0%	0		687ms	1,746	325	0

Общий интеллект	Оценка	Стабильность	Доля успешных попыток	Нестабильные тесты	Тестов верно	Время ответа (среднее)	Входные токены	Выходные токены	Токены рассуждений
North Mini Code	5.1	10.0	0.0%	0		25.08s	444	1,546	1,635
Grok 4.20	4.8	10.0	0.0%	0		659ms	819	83	0

Следование инструкциям	Оценка	Стабильность	Доля успешных попыток	Нестабильные тесты	Тестов верно	Время ответа (среднее)	Входные токены	Выходные токены	Токены рассуждений
North Mini Code	9.8	10.0	100.0%	0		15.43s	379	909	1,339
Grok 4.20	6.3	10.0	50.0%	0		445ms	1,350	60	0

Решение головоломок	Оценка	Стабильность	Доля успешных попыток	Нестабильные тесты	Тестов верно	Время ответа (среднее)	Входные токены	Выходные токены	Токены рассуждений
North Mini Code	3.3	10.0	0.0%	0		19.70s	543	2,215	2,485
Grok 4.20	5.3	10.0	33.3%	0		473ms	1,671	198	0

Вызов инструментов	Оценка	Стабильность	Доля успешных попыток	Нестабильные тесты	Тестов верно	Время ответа (среднее)	Входные токены	Выходные токены	Токены рассуждений
North Mini Code	10.0	10.0	100.0%	0		3.93s	1,776	41	563
Grok 4.20	10.0	10.0	100.0%	0		4.63s	7,245	189	0

Эрудиция	Оценка	Стабильность	Доля успешных попыток	Нестабильные тесты	Тестов верно	Время ответа (среднее)	Входные токены	Выходные токены	Токены рассуждений
North Mini Code	3.0	10.0	0.0%	0		305.02s	106	127,006	127,125
Grok 4.20	0.0	0.0	0.0%	0		0ms	0	0	0

Быстрое сравнение

Сменить пару сравнения