Навигация
AI BENCHY
Advertise here

AI BENCHY Compare

Anthropic: Claude Opus 4.6 vs Qwen: Qwen3.5-122B-A10B

Сводка

Сравнение benchmark Claude Opus 4.6 vs Qwen3.5-122B-A10B: Средний балл практически равен: 7.7 vs 7.7. Qwen3.5-122B-A10B имеет более низкую стоимость benchmark: $0.588 vs $2.053. Claude Opus 4.6 быстрее: 25.89s vs 42.49s, с долей успешных попыток 61.9% vs 73.0%.

Рекомендуемая модель: Qwen3.5-122B-A10B - Здесь у него лучший балл (7.7), при этом он примерно в 3.5 раза дешевле, чем Claude Opus 4.6.

Бенчмарки сгенерированы из тестовых наборов AI BENCHY в: 2026-07-02

Метрика Claude Opus 4.6 Claude Opus 4.6 medium Релиз: 2026-02-05 Qwen3.5-122B-A10B Qwen3.5-122B-A10B medium Релиз: 2026-02-24
Оценка 7.7 7.7
Ранг #40 #37
Надежность 10.0 10.0
Стабильность 8.8 8.8
Тестов верно
Доля успешных попыток 61.9% 73.0%
Нестабильные тесты 3 3
Всего запусков 63 63
Стоимость за результат 17.103 5.235
Общая стоимость $2.053 $0.588
Цена входа $5.000 / 1M $0.260 / 1M
Цена выхода $25.000 / 1M $2.080 / 1M
Общее число входных токенов 53,227 41,832
Выходные токены 47,446 26,187
Токены рассуждений 24,000 251,028
Время ответа (среднее) 25.89s 42.49s
Время ответа (макс.) 83.40s 168.16s
Время ответа (суммарно) 362.49s 892.30s

Генерация showcase

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#40 Claude Opus 4.6

medium
Неверный SVG
Стоимость
$0.000
Время
300.0s
Токены
0 tok

#37 Qwen3.5-122B-A10B

medium
Стоимость
$0.019
Время
48.7s
Токены
6,034 tok

Лучшие модели по оценке

Оценка vs общая стоимость

Время ответа (среднее)

Оценка vs Время ответа (среднее)

Общее число выходных токенов

Оценка vs Общее число выходных токенов

Разбивка по категориям

Анти-ИИ уловки Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Входные токены Выходные токены Токены рассуждений
Claude Opus 4.6 6.4 5.8 66.7% 2 7.45s 840 986 1,071
Qwen3.5-122B-A10B 10.0 10.0 100.0% 0 9.75s 672 269 16,835
Программирование Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Входные токены Выходные токены Токены рассуждений
Claude Opus 4.6 5.7 7.1 44.4% 1 30.10s 8,522 13,057 4,121
Qwen3.5-122B-A10B 6.0 7.2 55.6% 1 114.48s 7,630 8,057 82,578
Комбинированный Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Входные токены Выходные токены Токены рассуждений
Claude Opus 4.6 10.0 10.0 100.0% 0 76.66s 20,685 8,178 5,194
Qwen3.5-122B-A10B 10.0 10.0 100.0% 0 107.79s 14,947 483 11,337
Парсинг и извлечение данных Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Входные токены Выходные токены Токены рассуждений
Claude Opus 4.6 10.0 10.0 100.0% 0 7.37s 8,676 691 757
Qwen3.5-122B-A10B 10.0 10.0 100.0% 0 23.41s 7,782 270 16,558
Предметно-ориентированное Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Входные токены Выходные токены Токены рассуждений
Claude Opus 4.6 3.0 10.0 0.0% 0 83.40s 674 14,642 8,687
Qwen3.5-122B-A10B 2.9 7.2 11.1% 1 63.40s 771 15,537 64,889
Общий интеллект Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Входные токены Выходные токены Токены рассуждений
Claude Opus 4.6 10.0 10.0 100.0% 0 5.04s 564 188 292
Qwen3.5-122B-A10B 3.4 2.2 33.3% 1 34.11s 344 66 7,592
Следование инструкциям Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Входные токены Выходные токены Токены рассуждений
Claude Opus 4.6 10.0 10.0 100.0% 0 2.43s 792 266 467
Qwen3.5-122B-A10B 10.0 10.0 100.0% 0 9.88s 593 77 7,372
Решение головоломок Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Входные токены Выходные токены Токены рассуждений
Claude Opus 4.6 7.7 10.0 66.7% 0 4.71s 816 532 630
Qwen3.5-122B-A10B 10.0 10.0 100.0% 0 17.89s 696 284 27,575
Вызов инструментов Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Входные токены Выходные токены Токены рассуждений
Claude Opus 4.6 10.0 10.0 100.0% 0 9.73s 11,454 861 329
Qwen3.5-122B-A10B 10.0 10.0 100.0% 0 4.60s 8,193 322 1,226
Эрудиция Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Входные токены Выходные токены Токены рассуждений
Claude Opus 4.6 3.0 10.0 0.0% 0 63.24s 204 8,045 2,452
Qwen3.5-122B-A10B 3.0 10.0 0.0% 0 52.87s 204 822 15,066

Быстрое сравнение

Сменить пару сравнения