#106 Nemotron 3 Super
medium
No showcase result has been generated for this model yet.
- Cost
- $0.000
- Time
- -
- Tokens
- 0 tok
AI BENCHY Compare
概要
Nemotron 3 Super vs Qwen3.5-Flash の benchmark 比較: 平均スコアは 5.8 vs 5.8 でほぼ同等です。 Qwen3.5-Flash の benchmark コストが低く、$0.005 vs $0.021 です。 Qwen3.5-Flash の方が高速で、3.58s vs 32.00s です、成功率は 41.3% vs 39.7% です。
おすすめモデル: Qwen3.5-Flash - ここでは最高スコア(5.8)で、Nemotron 3 Super より約 4.9 倍低コストです。
ベンチマークは AI BENCHY テストスイートから次の日時に生成: 2026-06-10
| 指標 | Nemotron 3 Super Nemotron 3 Super medium 無料で利用可能 | Qwen3.5-Flash Qwen3.5-Flash none |
|---|---|---|
| スコア | 5.8 | 5.8 |
| 順位 | #106 | #109 |
| 信頼性 | 10.0 | 10.0 |
| 一貫性 | 9.2 | 9.7 |
| 正解テスト | ||
| 試行ごとの合格率 | 41.3% | 39.7% |
| 不安定なテスト | 2 | 1 |
| 総実行回数 | 63 | 63 |
| 結果あたりのコスト | 0.004 | 0.075 |
| 合計コスト | $0.021 | $0.005 |
| 入力価格 | $0.090 / 1M | $0.065 / 1M |
| 出力価格 | $0.450 / 1M | $0.260 / 1M |
| 合計入力トークン | 37,527 | 46,439 |
| 出力トークン | 14,850 | 4,276 |
| 推論トークン | 33,754 | 0 |
| 応答時間(平均) | 32.00s | 3.58s |
| 応答時間(最大) | 232.25s | 27.18s |
| 応答時間(合計) | 607.91s | 75.28s |
Generation showcase
Prompt: Create a detailed SVG illustration of a hamster playing table tennis.
| 反AIトリック | スコア | 一貫性 | 試行ごとの合格率 | 不安定なテスト | 正解テスト | 応答時間(平均) | 入力トークン | 出力トークン | 推論トークン |
|---|---|---|---|---|---|---|---|---|---|
| Nemotron 3 Super | 8.3 | 10.0 | 75.0% | 0 | 7.85s | 686 | 748 | 1,305 | |
| Qwen3.5-Flash | 3.5 | 8.3 | 8.3% | 1 | 1.32s | 696 | 690 | 0 |
| コーディング | スコア | 一貫性 | 試行ごとの合格率 | 不安定なテスト | 正解テスト | 応答時間(平均) | 入力トークン | 出力トークン | 推論トークン |
|---|---|---|---|---|---|---|---|---|---|
| Nemotron 3 Super | 3.1 | 10.0 | 0.0% | 0 | 147.32s | 2,275 | 797 | 4,424 | |
| Qwen3.5-Flash | 5.5 | 10.0 | 33.3% | 0 | 850ms | 7,913 | 519 | 0 |
| 複合 | スコア | 一貫性 | 試行ごとの合格率 | 不安定なテスト | 正解テスト | 応答時間(平均) | 入力トークン | 出力トークン | 推論トークン |
|---|---|---|---|---|---|---|---|---|---|
| Nemotron 3 Super | 10.0 | 10.0 | 100.0% | 0 | 87.80s | 15,561 | 2,021 | 9,996 | |
| Qwen3.5-Flash | 3.0 | 10.0 | 0.0% | 0 | 6.22s | 18,879 | 1,794 | 0 |
| データ解析と抽出 | スコア | 一貫性 | 試行ごとの合格率 | 不安定なテスト | 正解テスト | 応答時間(平均) | 入力トークン | 出力トークン | 推論トークン |
|---|---|---|---|---|---|---|---|---|---|
| Nemotron 3 Super | 10.0 | 10.0 | 100.0% | 0 | 18.16s | 7,944 | 877 | 2,607 | |
| Qwen3.5-Flash | 10.0 | 10.0 | 100.0% | 0 | 1.57s | 7,794 | 243 | 0 |
| ドメイン特化 | スコア | 一貫性 | 試行ごとの合格率 | 不安定なテスト | 正解テスト | 応答時間(平均) | 入力トークン | 出力トークン | 推論トークン |
|---|---|---|---|---|---|---|---|---|---|
| Nemotron 3 Super | 2.9 | 4.4 | 22.2% | 2 | 16.19s | 456 | 5,255 | 6,072 | |
| Qwen3.5-Flash | 7.7 | 10.0 | 66.7% | 0 | 905ms | 789 | 15 | 0 |
| 汎用知能 | スコア | 一貫性 | 試行ごとの合格率 | 不安定なテスト | 正解テスト | 応答時間(平均) | 入力トークン | 出力トークン | 推論トークン |
|---|---|---|---|---|---|---|---|---|---|
| Nemotron 3 Super | 4.1 | 10.0 | 0.0% | 0 | 6.91s | 492 | 105 | 363 | |
| Qwen3.5-Flash | 10.0 | 10.0 | 100.0% | 0 | 803ms | 522 | 100 | 0 |
| 指示追従 | スコア | 一貫性 | 試行ごとの合格率 | 不安定なテスト | 正解テスト | 応答時間(平均) | 入力トークン | 出力トークン | 推論トークン |
|---|---|---|---|---|---|---|---|---|---|
| Nemotron 3 Super | 7.3 | 10.0 | 50.0% | 0 | 6.97s | 723 | 956 | 2,383 | |
| Qwen3.5-Flash | 6.3 | 10.0 | 50.0% | 0 | 8.81s | 711 | 63 | 0 |
| パズル解決 | スコア | 一貫性 | 試行ごとの合格率 | 不安定なテスト | 正解テスト | 応答時間(平均) | 入力トークン | 出力トークン | 推論トークン |
|---|---|---|---|---|---|---|---|---|---|
| Nemotron 3 Super | 3.0 | 10.0 | 0.0% | 0 | 3.15s | 708 | 570 | 1,322 | |
| Qwen3.5-Flash | 3.1 | 10.0 | 0.0% | 0 | 10.89s | 714 | 579 | 0 |
| ツール呼び出し | スコア | 一貫性 | 試行ごとの合格率 | 不安定なテスト | 正解テスト | 応答時間(平均) | 入力トークン | 出力トークン | 推論トークン |
|---|---|---|---|---|---|---|---|---|---|
| Nemotron 3 Super | 10.0 | 10.0 | 100.0% | 0 | 39.75s | 8,544 | 270 | 1,969 | |
| Qwen3.5-Flash | 10.0 | 10.0 | 100.0% | 0 | 3.67s | 8,211 | 264 | 0 |
| 雑学 | スコア | 一貫性 | 試行ごとの合格率 | 不安定なテスト | 正解テスト | 応答時間(平均) | 入力トークン | 出力トークン | 推論トークン |
|---|---|---|---|---|---|---|---|---|---|
| Nemotron 3 Super | 3.0 | 10.0 | 0.0% | 0 | 55.32s | 138 | 3,251 | 3,313 | |
| Qwen3.5-Flash | 3.0 | 10.0 | 0.0% | 0 | 588ms | 210 | 9 | 0 |
比較ペアを切り替え