- 順位
- #58
- 合計出力トークン
- 224,128
- 応答時間(平均)
- 142.84s
- 合計コスト
- $3.467
Kimi K3 (max) vs Qwen3.8 27B (medium)
Kimi K3 (max) が平均スコアでリードし、7.9 vs 7.8 です。 ローカルハードウェアの費用は計測していないため、費用の比較はできません。 Qwen3.8 27B (medium) の方が高速で、33.05s vs 142.84s です、成功率は 77.3% vs 66.7% です。
- 順位
- #68
- 合計出力トークン
- 136,162
- 応答時間(平均)
- 33.05s
- 合計コスト
- 該当なし
おすすめモデル
Kimi K3 (max)
この比較で最も高いスコア(7.9)を出し、全 2 モデルの中でコストと応答時間のバランスも最良です。
詳細比較
| 指標 | Kimi K3 Kimi K3 max | Qwen3.8 27B Qwen3.8 27B medium |
|---|---|---|
| スコア | 7.9 | 7.8 |
| 順位 | #58 | #68 |
| 信頼性 | 9.0 | 9.6 |
| 一貫性 | 9.2 | 9.7 |
| 試行回数 | 66/66 | 66/66 |
| 正解テスト | ||
| 試行ごとの合格率 | 77.3% | 66.7% |
| 不安定なテスト | 2 | 1 |
| 総実行回数 | 66 | 66 |
| 結果あたりのコスト | 21.668 | 該当なし |
| 合計コスト | $3.467 | 該当なし |
| 入力価格 | $3.000 / 1M | 該当なし |
| 出力価格 | $15.000 / 1M | 該当なし |
| 合計入力トークン | 34,960 | 98,266 |
| 出力トークン | 2,887 | 1,861 |
| 推論トークン | 221,241 | 134,301 |
| 応答時間(平均) | 142.84s | 33.05s |
| 応答時間(最大) | 766.58s | 214.63s |
| 応答時間(合計) | 2714.02s | 694.04s |
| パラメータ | 2.8T 総数 (104B アクティブ) | 27.3B |
| 公開状況 | 重み公開 | 重み公開 |
モデル生成ショーケース
Hamster playing table tennis
Prompt: Create a detailed SVG illustration of a hamster playing table tennis.
#58 MoonshotAI: Kimi K3
max- コスト
- $0.281
- 時間
- 506.9s
- トークン
- 18,863 tok
#68 Qwen3.8 27B
medium- コスト
- 該当なし
- 時間
- 43.4s
- トークン
- 2,956 tok
スコア上位モデル
スコア vs 総コスト
応答時間(平均)
スコア vs 応答時間(平均)
合計出力トークン
スコア vs 合計出力トークン
カテゴリ内訳
| 反AIトリック | スコア | 一貫性 | 試行ごとの合格率 | 不安定なテスト | 正解テスト | 応答時間(平均) | 入力トークン | 出力トークン | 推論トークン |
|---|---|---|---|---|---|---|---|---|---|
| Kimi K3 | 10.0 | 10.0 | 100.0% | 0 | 10.24s | 1,638 | 496 | 2,629 | |
| Qwen3.8 27B | 10.0 | 10.0 | 100.0% | 0 | 2.93s | 672 | 228 | 1,842 |
| コーディング | スコア | 一貫性 | 試行ごとの合格率 | 不安定なテスト | 正解テスト | 応答時間(平均) | 入力トークン | 出力トークン | 推論トークン |
|---|---|---|---|---|---|---|---|---|---|
| Kimi K3 | 10.0 | 10.0 | 100.0% | 0 | 325.79s | 8,061 | 460 | 84,012 | |
| Qwen3.8 27B | 10.0 | 10.0 | 100.0% | 0 | 40.50s | 7,893 | 585 | 26,808 |
| 複合 | スコア | 一貫性 | 試行ごとの合格率 | 不安定なテスト | 正解テスト | 応答時間(平均) | 入力トークン | 出力トークン | 推論トークン |
|---|---|---|---|---|---|---|---|---|---|
| Kimi K3 | 6.5 | 10.0 | 50.0% | 0 | 223.03s | 12,792 | 399 | 20,460 | |
| Qwen3.8 27B | 8.7 | 6.9 | 83.3% | 1 | 124.48s | 77,767 | 70 | 51,705 |
| データ解析と抽出 | スコア | 一貫性 | 試行ごとの合格率 | 不安定なテスト | 正解テスト | 応答時間(平均) | 入力トークン | 出力トークン | 推論トークン |
|---|---|---|---|---|---|---|---|---|---|
| Kimi K3 | 7.3 | 5.8 | 83.3% | 1 | 16.72s | 7,839 | 354 | 2,606 | |
| Qwen3.8 27B | 6.5 | 10.0 | 50.0% | 0 | 8.76s | 9,039 | 144 | 2,271 |
| ドメイン特化 | スコア | 一貫性 | 試行ごとの合格率 | 不安定なテスト | 正解テスト | 応答時間(平均) | 入力トークン | 出力トークン | 推論トークン |
|---|---|---|---|---|---|---|---|---|---|
| Kimi K3 | 5.3 | 7.2 | 44.4% | 1 | 683.62s | 838 | 57 | 106,892 | |
| Qwen3.8 27B | 5.3 | 10.0 | 33.3% | 0 | 76.98s | 780 | 12 | 41,184 |
| 汎用知能 | スコア | 一貫性 | 試行ごとの合格率 | 不安定なテスト | 正解テスト | 応答時間(平均) | 入力トークン | 出力トークン | 推論トークン |
|---|---|---|---|---|---|---|---|---|---|
| Kimi K3 | 10.0 | 10.0 | 100.0% | 0 | 14.91s | 732 | 191 | 871 | |
| Qwen3.8 27B | 5.0 | 10.0 | 0.0% | 0 | 9.20s | 516 | 204 | 1,299 |
| 指示追従 | スコア | 一貫性 | 試行ごとの合格率 | 不安定なテスト | 正解テスト | 応答時間(平均) | 入力トークン | 出力トークン | 推論トークン |
|---|---|---|---|---|---|---|---|---|---|
| Kimi K3 | 10.0 | 10.0 | 100.0% | 0 | 7.66s | 1,179 | 147 | 1,119 | |
| Qwen3.8 27B | 10.0 | 10.0 | 100.0% | 0 | 2.54s | 699 | 48 | 984 |
| パズル解決 | スコア | 一貫性 | 試行ごとの合格率 | 不安定なテスト | 正解テスト | 応答時間(平均) | 入力トークン | 出力トークン | 推論トークン |
|---|---|---|---|---|---|---|---|---|---|
| Kimi K3 | 10.0 | 10.0 | 100.0% | 0 | 7.36s | 1,416 | 495 | 1,368 | |
| Qwen3.8 27B | 8.3 | 10.0 | 66.7% | 0 | 12.62s | 696 | 444 | 6,237 |
| ツール呼び出し | スコア | 一貫性 | 試行ごとの合格率 | 不安定なテスト | 正解テスト | 応答時間(平均) | 入力トークン | 出力トークン | 推論トークン |
|---|---|---|---|---|---|---|---|---|---|
| Kimi K3 | 3.0 | 10.0 | 0.0% | 0 | 0ms | 0 | 0 | 0 | |
| Qwen3.8 27B | 3.0 | 10.0 | 0.0% | 0 | 0ms | 0 | 0 | 0 |
| 雑学 | スコア | 一貫性 | 試行ごとの合格率 | 不安定なテスト | 正解テスト | 応答時間(平均) | 入力トークン | 出力トークン | 推論トークン |
|---|---|---|---|---|---|---|---|---|---|
| Kimi K3 | 3.0 | 10.0 | 0.0% | 0 | 19.67s | 465 | 288 | 1,284 | |
| Qwen3.8 27B | 3.0 | 10.0 | 0.0% | 0 | 11.29s | 204 | 126 | 1,971 |
クイック比較
比較ペアを切り替え
Kimi K3maxvsGPT-5.2 ChatnoneKimi K3maxvsStep 3.7 FlashmediumClaude Opus 4.8lowvsQwen3.8 27BmediumKimi K3maxvsQwen3.8 27BlowKimi K3maxvsGPT-5.6 TerrahighKimi K3maxvsInklingmediumKimi K3maxvsQwen3.7 PlusmediumSeed-2.0-CodelowvsQwen3.8 27BmediumKimi K3maxvsGLM 5.2highKimi K3maxvsQwen3.6 PlusmediumGemini 3.5 Flash LitemediumvsKimi K3maxKimi K3maxvsGLM 5.2medium