ナビゲーション
AI BENCHY
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

AI BENCHY Compare

North Mini Code vs Mistral: Mistral Small 4

概要

North Mini Code vs Mistral Small 4 の benchmark 比較: 平均スコアは 5.1 vs 5.1 でほぼ同等です。 North Mini Code の benchmark コストが低く、$0.000 vs $0.068 です。 Mistral Small 4 の方が高速で、9.40s vs 29.82s です、成功率は 19.1% vs 44.4% です。

おすすめモデル: Mistral Small 4 - ここでは最高スコア(5.1)で、North Mini Code より約 3.2 倍速く応答します。

ベンチマークは AI BENCHY テストスイートから次の日時に生成: 2026-06-18

指標 North Mini Code North Mini Code none リリース: 2026-06-18 無料で利用可能 Mistral Small 4 Mistral Small 4 medium リリース: 2026-03-16
スコア 5.1 5.1
順位 #131 #133
信頼性 8.5 10.0
一貫性 9.9 6.9
正解テスト
試行ごとの合格率 19.1% 44.4%
不安定なテスト 0 8
総実行回数 57 63
結果あたりのコスト 0.000 1.344
合計コスト $0.000 $0.068
入力価格 $0.000 / 1M $0.150 / 1M
出力価格 $0.000 / 1M $0.600 / 1M
合計入力トークン 43,264 42,576
出力トークン 8,278 24,184
推論トークン 0 84,678
応答時間(平均) 29.82s 9.40s
応答時間(最大) 159.85s 59.15s
応答時間(合計) 626.26s 197.39s

Generation showcase

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#131 North Mini Code

none
Cost
$0.000
Time
266.1s
Tokens
63,551 tok

#133 Mistral Small 4

medium
Cost
$0.006
Time
47.9s
Tokens
9,857 tok

スコア上位モデル

スコア vs 総コスト

応答時間(平均)

スコア vs 応答時間(平均)

合計出力トークン

スコア vs 合計出力トークン

カテゴリ内訳

反AIトリック スコア 一貫性 試行ごとの合格率 不安定なテスト 正解テスト 応答時間(平均) 入力トークン 出力トークン 推論トークン
North Mini Code 3.0 10.0 0.0% 0 22.48s 402 4,075 0
Mistral Small 4 5.6 3.8 66.7% 3 2.67s 708 4,055 4,778
コーディング スコア 一貫性 試行ごとの合格率 不安定なテスト 正解テスト 応答時間(平均) 入力トークン 出力トークン 推論トークン
North Mini Code 3.9 10.0 0.0% 0 21.96s 7,119 504 0
Mistral Small 4 4.4 5.1 33.3% 2 39.98s 7,636 11,635 54,715
複合 スコア 一貫性 試行ごとの合格率 不安定なテスト 正解テスト 応答時間(平均) 入力トークン 出力トークン 推論トークン
North Mini Code 3.5 8.7 0.0% 0 159.85s 24,265 2,920 0
Mistral Small 4 3.0 10.0 0.0% 0 25.25s 18,706 2,612 10,700
データ解析と抽出 スコア 一貫性 試行ごとの合格率 不安定なテスト 正解テスト 応答時間(平均) 入力トークン 出力トークン 推論トークン
North Mini Code 10.0 10.0 100.0% 0 28.00s 6,819 183 0
Mistral Small 4 7.3 5.9 83.3% 1 1.23s 6,171 335 723
ドメイン特化 スコア 一貫性 試行ごとの合格率 不安定なテスト 正解テスト 応答時間(平均) 入力トークン 出力トークン 推論トークン
North Mini Code 3.0 10.0 0.0% 0 14.73s 621 14 0
Mistral Small 4 5.3 7.2 44.4% 1 6.11s 742 2,621 6,904
汎用知能 スコア 一貫性 試行ごとの合格率 不安定なテスト 正解テスト 応答時間(平均) 入力トークン 出力トークン 推論トークン
North Mini Code 3.9 9.6 0.0% 0 34.77s 444 115 0
Mistral Small 4 4.8 10.0 0.0% 0 2.05s 519 821 828
指示追従 スコア 一貫性 試行ごとの合格率 不安定なテスト 正解テスト 応答時間(平均) 入力トークン 出力トークン 推論トークン
North Mini Code 6.5 10.0 50.0% 0 30.68s 597 57 0
Mistral Small 4 7.3 5.8 83.3% 1 1.38s 729 540 1,031
パズル解決 スコア 一貫性 試行ごとの合格率 不安定なテスト 正解テスト 応答時間(平均) 入力トークン 出力トークン 推論トークン
North Mini Code 3.5 10.0 0.0% 0 24.43s 435 353 0
Mistral Small 4 3.4 9.7 0.0% 0 2.17s 735 1,226 2,632
ツール呼び出し スコア 一貫性 試行ごとの合格率 不安定なテスト 正解テスト 応答時間(平均) 入力トークン 出力トークン 推論トークン
North Mini Code 9.5 10.0 100.0% 0 3.64s 2,403 51 0
Mistral Small 4 10.0 10.0 100.0% 0 3.50s 6,420 321 810
雑学 スコア 一貫性 試行ごとの合格率 不安定なテスト 正解テスト 応答時間(平均) 入力トークン 出力トークン 推論トークン
North Mini Code 3.0 10.0 0.0% 0 37.37s 159 6 0
Mistral Small 4 3.0 10.0 0.0% 0 5.92s 210 18 1,557

クイック比較

比較ペアを切り替え