- 順位
- #53
- 合計出力トークン
- 444,665
- 応答時間(平均)
- 32.88s
- 合計コスト
- $0.591
DeepSeek V4.1 Flash (medium) vs GPT-6 Sol (low)
DeepSeek V4.1 Flash (medium) が平均スコアでリードし、8.7 vs 8.7 です。 GPT-6 Sol (low) の benchmark コストが低く、$0.477 vs $0.591 です。 GPT-6 Sol (low) の方が高速で、8.72s vs 32.88s です、成功率は 73.9% vs 87.0% です。
比較対象モデル
- 順位
- #59
- 合計出力トークン
- 13,211
- 応答時間(平均)
- 8.72s
- 合計コスト
- $0.477
おすすめモデル
GPT-6 Sol (low)
スコアはここでの最高値に近く(8.7 vs 8.7)、DeepSeek V4.1 Flash (medium) より約 3.8 倍速く応答します。
詳細比較
| 指標 | DeepSeek V4.1 Flash DeepSeek V4.1 Flash medium | GPT-6 Sol GPT-6 Sol low |
|---|---|---|
| スコア | 8.7 | 8.7 |
| 順位 | #53 | #59 |
| 信頼性 | 9.6 | 10.0 |
| 一貫性 | 9.3 | 8.6 |
| 試行回数 | 69/69 | 69/69 |
| 正解テスト | ||
| 試行ごとの合格率 | 73.9% | 87.0% |
| 不安定なテスト | 2 | 4 |
| 総実行回数 | 69 | 69 |
| 結果あたりのコスト | 1.757 | 2.650 |
| 合計コスト | $0.591 | $0.477 |
| 入力価格 | $0.013 / 1M | $2.000 / 1M |
| 出力価格 | $1.320 / 1M | $10.000 / 1M |
| キャッシュ読み取り料金 | $0.013 / 1M | $0.200 / 1M |
| キャッシュ書き込み料金 | 該当なし | $2.500 / 1M |
| 合計入力トークン | 280,643 | 172,359 |
| 出力トークン | 7,342 | 5,026 |
| 推論トークン | 437,323 | 8,185 |
| 応答時間(平均) | 32.88s | 8.72s |
| 応答時間(最大) | 276.31s | 48.43s |
| 応答時間(合計) | 756.34s | 200.61s |
| パラメータ | 748B 総数 (16B アクティブ) | ~2T 総数 (~150B アクティブ) |
| 公開状況 | オープンソース | クローズド |
キャッシュ料金は入力トークンに適用されます。読み取りは保存済みのプロンプトを再利用し、書き込みは保存するため追加料金がかかる場合があります。出力トークンには出力料金が適用されます。
モデル生成ショーケース
Hamster playing table tennis
Prompt: Create a detailed SVG illustration of a hamster playing table tennis.
#53 DeepSeek V4.1 Flash
medium- コスト
- $0.014
- 時間
- 34.7s
- トークン
- 11,541 tok
#59 GPT-6 Sol
low- コスト
- $0.018
- 時間
- 17.4s
- トークン
- 1,850 tok
カテゴリ内訳
| エージェントタスク | スコア | 一貫性 | 試行ごとの合格率 | 不安定なテスト | 正解テスト | 応答時間(平均) | 入力トークン | 出力トークン | 推論トークン |
|---|---|---|---|---|---|---|---|---|---|
| DeepSeek V4.1 Flash | 10.0 | 10.0 | 100.0% | 0 | 47.59s | 192,135 | 1,932 | 11,917 | |
| GPT-6 Sol | 10.0 | 10.0 | 100.0% | 0 | 48.43s | 94,477 | 979 | 555 |
| 反AIトリック | スコア | 一貫性 | 試行ごとの合格率 | 不安定なテスト | 正解テスト | 応答時間(平均) | 入力トークン | 出力トークン | 推論トークン |
|---|---|---|---|---|---|---|---|---|---|
| DeepSeek V4.1 Flash | 8.3 | 10.0 | 75.0% | 0 | 3.07s | 852 | 156 | 4,108 | |
| GPT-6 Sol | 10.0 | 10.0 | 100.0% | 0 | 2.43s | 606 | 172 | 339 |
| コーディング | スコア | 一貫性 | 試行ごとの合格率 | 不安定なテスト | 正解テスト | 応答時間(平均) | 入力トークン | 出力トークン | 推論トークン |
|---|---|---|---|---|---|---|---|---|---|
| DeepSeek V4.1 Flash | 10.0 | 10.0 | 100.0% | 0 | 34.45s | 7,509 | 396 | 71,345 | |
| GPT-6 Sol | 6.2 | 4.8 | 66.7% | 2 | 8.74s | 7,302 | 405 | 1,296 |
| 複合 | スコア | 一貫性 | 試行ごとの合格率 | 不安定なテスト | 正解テスト | 応答時間(平均) | 入力トークン | 出力トークン | 推論トークン |
|---|---|---|---|---|---|---|---|---|---|
| DeepSeek V4.1 Flash | 10.0 | 10.0 | 100.0% | 0 | 22.21s | 66,161 | 3,956 | 24,673 | |
| GPT-6 Sol | 10.0 | 10.0 | 100.0% | 0 | 8.13s | 54,674 | 2,524 | 512 |
| データ解析と抽出 | スコア | 一貫性 | 試行ごとの合格率 | 不安定なテスト | 正解テスト | 応答時間(平均) | 入力トークン | 出力トークン | 推論トークン |
|---|---|---|---|---|---|---|---|---|---|
| DeepSeek V4.1 Flash | 6.5 | 10.0 | 50.0% | 0 | 3.77s | 2,397 | 120 | 998 | |
| GPT-6 Sol | 10.0 | 10.0 | 100.0% | 0 | 13.63s | 7,140 | 224 | 17 |
| ドメイン特化 | スコア | 一貫性 | 試行ごとの合格率 | 不安定なテスト | 正解テスト | 応答時間(平均) | 入力トークン | 出力トークン | 推論トークン |
|---|---|---|---|---|---|---|---|---|---|
| DeepSeek V4.1 Flash | 2.9 | 7.2 | 11.1% | 1 | 153.01s | 909 | 24 | 298,454 | |
| GPT-6 Sol | 5.3 | 7.2 | 44.4% | 1 | 11.45s | 732 | 71 | 4,573 |
| 汎用知能 | スコア | 一貫性 | 試行ごとの合格率 | 不安定なテスト | 正解テスト | 応答時間(平均) | 入力トークン | 出力トークン | 推論トークン |
|---|---|---|---|---|---|---|---|---|---|
| DeepSeek V4.1 Flash | 10.0 | 10.0 | 100.0% | 0 | 3.13s | 549 | 131 | 581 | |
| GPT-6 Sol | 10.0 | 10.0 | 100.0% | 0 | 17.91s | 477 | 83 | 0 |
| 指示追従 | スコア | 一貫性 | 試行ごとの合格率 | 不安定なテスト | 正解テスト | 応答時間(平均) | 入力トークン | 出力トークン | 推論トークン |
|---|---|---|---|---|---|---|---|---|---|
| DeepSeek V4.1 Flash | 10.0 | 10.0 | 100.0% | 0 | 9.69s | 783 | 63 | 1,483 | |
| GPT-6 Sol | 10.0 | 10.0 | 100.0% | 0 | 2.37s | 660 | 93 | 185 |
| パズル解決 | スコア | 一貫性 | 試行ごとの合格率 | 不安定なテスト | 正解テスト | 応答時間(平均) | 入力トークン | 出力トークン | 推論トークン |
|---|---|---|---|---|---|---|---|---|---|
| DeepSeek V4.1 Flash | 8.7 | 7.7 | 88.9% | 1 | 8.01s | 828 | 293 | 12,340 | |
| GPT-6 Sol | 10.0 | 10.0 | 100.0% | 0 | 2.66s | 642 | 209 | 314 |
| ツール呼び出し | スコア | 一貫性 | 試行ごとの合格率 | 不安定なテスト | 正解テスト | 応答時間(平均) | 入力トークン | 出力トークン | 推論トークン |
|---|---|---|---|---|---|---|---|---|---|
| DeepSeek V4.1 Flash | 10.0 | 10.0 | 100.0% | 0 | 15.33s | 8,259 | 258 | 296 | |
| GPT-6 Sol | 10.0 | 10.0 | 100.0% | 0 | 4.03s | 5,454 | 236 | 16 |
| 雑学 | スコア | 一貫性 | 試行ごとの合格率 | 不安定なテスト | 正解テスト | 応答時間(平均) | 入力トークン | 出力トークン | 推論トークン |
|---|---|---|---|---|---|---|---|---|---|
| DeepSeek V4.1 Flash | 3.0 | 10.0 | 0.0% | 0 | 20.25s | 261 | 13 | 11,128 | |
| GPT-6 Sol | 4.7 | 1.6 | 66.7% | 1 | 3.67s | 195 | 30 | 378 |
クイック比較
比較ペアを切り替え
Seed 2.1 TurbomediumvsGPT-6 SollowGPT-6 SollowvsMiMo-V2.6-PromediumGPT-6 SollowvsQwen3.8 27Bhigh無料で利用可能DeepSeek V4.1 FlashmediumvsMuse Spark 1.2lowDeepSeek V4.1 FlashmaxvsGPT-6 SollowClaude Sonnet 5.5highvsGPT-6 SollowDeepSeek V4.1 FlashmediumvsQwen3.8 27Bhigh無料で利用可能DeepSeek V4.1 FlashmediumvsQwen3.8 MAXlowDeepSeek V4.1 FlashhighvsGPT-6 SollowGPT-6 SollowvsGrok 4.6highDeepSeek V4.1 FlashmediumvsMuse Spark 1.1lowClaude Sonnet 5.5highvsDeepSeek V4.1 Flashmedium