ナビゲーション
AI BENCHY
Advertise here

AI BENCHY Compare

North Mini Code vs DeepSeek: DeepSeek V4 Flash

概要

North Mini Code vs DeepSeek V4 Flash の benchmark 比較: DeepSeek V4 Flash が平均スコアでリードし、5.5 vs 5.1 です。 North Mini Code の benchmark コストが低く、$0.000 vs $0.007 です。 DeepSeek V4 Flash の方が高速で、26.75s vs 29.82s です、成功率は 19.1% vs 30.2% です。

おすすめモデル: DeepSeek V4 Flash - この比較で最も高いスコア(5.5)を出し、全 2 モデルの中でコストと応答時間のバランスも最良です。

ベンチマークは AI BENCHY テストスイートから次の日時に生成: 2026-06-18

指標 North Mini Code North Mini Code none リリース: 2026-06-18 無料で利用可能 DeepSeek V4 Flash DeepSeek V4 Flash none リリース: 2026-04-24
スコア 5.1 5.5
順位 #131 #117
信頼性 8.5 10.0
一貫性 9.9 8.9
正解テスト
試行ごとの合格率 19.1% 30.2%
不安定なテスト 0 3
総実行回数 57 63
結果あたりのコスト 0.000 0.203
合計コスト $0.000 $0.007
入力価格 $0.000 / 1M $0.090 / 1M
出力価格 $0.000 / 1M $0.180 / 1M
合計入力トークン 43,264 50,127
出力トークン 8,278 13,710
推論トークン 0 0
応答時間(平均) 29.82s 26.75s
応答時間(最大) 159.85s 111.96s
応答時間(合計) 626.26s 561.82s

Generation showcase

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#131 North Mini Code

none
Cost
$0.000
Time
266.1s
Tokens
63,551 tok

#117 DeepSeek V4 Flash

none
Cost
$0.004
Time
157.6s
Tokens
11,297 tok

スコア上位モデル

スコア vs 総コスト

応答時間(平均)

スコア vs 応答時間(平均)

合計出力トークン

スコア vs 合計出力トークン

カテゴリ内訳

反AIトリック スコア 一貫性 試行ごとの合格率 不安定なテスト 正解テスト 応答時間(平均) 入力トークン 出力トークン 推論トークン
North Mini Code 3.0 10.0 0.0% 0 22.48s 402 4,075 0
DeepSeek V4 Flash 3.0 10.0 0.0% 0 20.18s 540 174 0
コーディング スコア 一貫性 試行ごとの合格率 不安定なテスト 正解テスト 応答時間(平均) 入力トークン 出力トークン 推論トークン
North Mini Code 3.9 10.0 0.0% 0 21.96s 7,119 504 0
DeepSeek V4 Flash 4.2 7.4 11.1% 1 17.13s 7,279 9,717 0
複合 スコア 一貫性 試行ごとの合格率 不安定なテスト 正解テスト 応答時間(平均) 入力トークン 出力トークン 推論トークン
North Mini Code 3.5 8.7 0.0% 0 159.85s 24,265 2,920 0
DeepSeek V4 Flash 4.5 2.1 66.7% 1 111.96s 24,398 2,664 0
データ解析と抽出 スコア 一貫性 試行ごとの合格率 不安定なテスト 正解テスト 応答時間(平均) 入力トークン 出力トークン 推論トークン
North Mini Code 10.0 10.0 100.0% 0 28.00s 6,819 183 0
DeepSeek V4 Flash 10.0 10.0 100.0% 0 23.79s 7,290 195 0
ドメイン特化 スコア 一貫性 試行ごとの合格率 不安定なテスト 正解テスト 応答時間(平均) 入力トークン 出力トークン 推論トークン
North Mini Code 3.0 10.0 0.0% 0 14.73s 621 14 0
DeepSeek V4 Flash 5.3 10.0 33.3% 0 19.73s 666 18 0
汎用知能 スコア 一貫性 試行ごとの合格率 不安定なテスト 正解テスト 応答時間(平均) 入力トークン 出力トークン 推論トークン
North Mini Code 3.9 9.6 0.0% 0 34.77s 444 115 0
DeepSeek V4 Flash 4.2 9.9 0.0% 0 23.74s 471 67 0
指示追従 スコア 一貫性 試行ごとの合格率 不安定なテスト 正解テスト 応答時間(平均) 入力トークン 出力トークン 推論トークン
North Mini Code 6.5 10.0 50.0% 0 30.68s 597 57 0
DeepSeek V4 Flash 6.5 10.0 50.0% 0 17.54s 627 321 0
パズル解決 スコア 一貫性 試行ごとの合格率 不安定なテスト 正解テスト 応答時間(平均) 入力トークン 出力トークン 推論トークン
North Mini Code 3.5 10.0 0.0% 0 24.43s 435 353 0
DeepSeek V4 Flash 3.1 7.3 11.1% 1 23.72s 594 207 0
ツール呼び出し スコア 一貫性 試行ごとの合格率 不安定なテスト 正解テスト 応答時間(平均) 入力トークン 出力トークン 推論トークン
North Mini Code 9.5 10.0 100.0% 0 3.64s 2,403 51 0
DeepSeek V4 Flash 10.0 10.0 100.0% 0 77.93s 8,079 327 0
雑学 スコア 一貫性 試行ごとの合格率 不安定なテスト 正解テスト 応答時間(平均) 入力トークン 出力トークン 推論トークン
North Mini Code 3.0 10.0 0.0% 0 37.37s 159 6 0
DeepSeek V4 Flash 3.0 10.0 0.0% 0 3.07s 183 20 0

クイック比較

比較ペアを切り替え