- 順位
- #157
- 合計出力トークン
- 56,766
- 応答時間(平均)
- 34.90s
- 合計コスト
- $1.488
Ember-1 (low) vs MiMo-V2.5 (medium)
MiMo-V2.5 (medium) が平均スコアでリードし、7.1 vs 7.0 です。 MiMo-V2.5 (medium) の benchmark コストが低く、$0.419 vs $1.488 です。 Ember-1 (low) の方が高速で、34.90s vs 49.20s です、成功率は 65.2% vs 69.6% です。
比較対象モデル
- 順位
- #152
- 合計出力トークン
- 341,511
- 応答時間(平均)
- 49.20s
- 合計コスト
- $0.419
おすすめモデル
MiMo-V2.5 (medium)
ここでは最高スコア(7.1)で、Ember-1 (low) より約 3.6 倍低コストです。
詳細比較
| 指標 | Ember-1 Ember-1 low | MiMo-V2.5 MiMo-V2.5 medium |
|---|---|---|
| スコア | 7.0 | 7.1 |
| 順位 | #157 | #152 |
| 信頼性 | 8.8 | 10.0 |
| 一貫性 | 8.2 | 7.6 |
| 試行回数 | 69/69 | 69/69 |
| 正解テスト | ||
| 試行ごとの合格率 | 65.2% | 69.6% |
| 不安定なテスト | 5 | 7 |
| 総実行回数 | 69 | 69 |
| 結果あたりのコスト | 11.441 | 3.491 |
| 合計コスト | $1.488 | $0.419 |
| 入力価格 | $3.000 / 1M | $0.140 / 1M |
| 出力価格 | $15.000 / 1M | $0.280 / 1M |
| 合計入力トークン | 211,908 | 259,664 |
| 出力トークン | 14,158 | 8,414 |
| 推論トークン | 42,608 | 333,097 |
| 応答時間(平均) | 34.90s | 49.20s |
| 応答時間(最大) | 121.29s | 316.27s |
| 応答時間(合計) | 802.79s | 1131.69s |
| パラメータ | ~2.8T 総数 (~104B アクティブ) | 310B 総数 (15B アクティブ) |
| 公開状況 | クローズド | オープンソース |
モデル生成ショーケース
Hamster playing table tennis
Prompt: Create a detailed SVG illustration of a hamster playing table tennis.
#157 Ember-1
low- コスト
- $0.016
- 時間
- 24.2s
- トークン
- 1,165 tok
#152 MiMo-V2.5
medium- コスト
- $0.002
- 時間
- 54.8s
- トークン
- 5,247 tok
スコア上位モデル
スコア vs 総コスト
応答時間(平均)
スコア vs 応答時間(平均)
合計出力トークン
スコア vs 合計出力トークン
カテゴリ内訳
クイック比較
比較ペアを切り替え
Ember-1lowvsKimi K2.7 CodemediumEmber-1lowvsGemini 3.1 Flash Lite PreviewmediumEmber-1lowvsQwen3.5-122B-A10BmediumGPT-5.2 ChatnonevsMiMo-V2.5mediumEmber-1lowvsGPT-5.2 ChatnoneClaude Opus 5nonevsMiMo-V2.5mediumEmber-1lowvsGLM 5.3 FlashXmediumEmber-1lowvsGemini 3.1 Flash LitemediumGrok 4.6lowvsMiMo-V2.5mediumGemini 3 Flash PreviewlowvsMiMo-V2.5mediumStep 3.7 FlashlowvsMiMo-V2.5mediumMuse Glimmer 30BlowvsMiMo-V2.5medium