Anthropic: Claude Fable 5 vs Google: Gemini 3.5 Flash

Gemini 3.5 Flash (high) が平均スコアでリードし、9.5 vs 8.6 です。 Gemini 3.5 Flash (high) の benchmark コストが低く、$1.976 vs $3.478 です。 Gemini 3.5 Flash (high) の方が高速で、15.07s vs 17.20s です、成功率は 78.8% vs 93.9% です。

おすすめモデルGemini 3.5 Flash (high)ここでは最高スコア（9.5）で、Claude Fable 5 (medium) より約 1.8 倍低コストです。

ベンチマークは AI BENCHY テストスイートから次の日時に生成: 2026-07-25

指標	Claude Fable 5 Claude Fable 5 medium リリース: 2026-06-10	Gemini 3.5 Flash Gemini 3.5 Flash high リリース: 2026-05-19

指標	Claude Fable 5 Claude Fable 5 medium リリース: 2026-06-10	Gemini 3.5 Flash Gemini 3.5 Flash high リリース: 2026-05-19
スコア	8.6	9.5
順位	#22	#4
信頼性	10.0	10.0
一貫性	9.6	9.3
正解テスト
試行ごとの合格率	78.8%	93.9%
不安定なテスト	1	2
総実行回数	66	66
結果あたりのコスト	20.459	9.879
合計コスト	$3.478	$1.976
入力価格	$10.000 / 1M	$1.500 / 1M
出力価格	$50.000 / 1M	$9.000 / 1M
合計入力トークン	89,643	107,137
出力トークン	41,360	8,777
推論トークン	10,269	192,900
応答時間（平均）	17.20s	15.07s
応答時間（最大）	80.80s	145.92s
応答時間（合計）	378.41s	331.48s

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#22 Claude Fable 5

medium

コスト: $0.606
時間: 156.7s
トークン: 12,264 tok

#4 Gemini 3.5 Flash

high

コスト: $0.208
時間: 118.2s
トークン: 23,158 tok

スコア上位モデル

スコア vs 総コスト

応答時間（平均）

スコア vs 応答時間（平均）

合計出力トークン

スコア vs 合計出力トークン

カテゴリ内訳

カテゴリ:

反AIトリック	スコア	一貫性	試行ごとの合格率	不安定なテスト	正解テスト	応答時間（平均）	入力トークン	出力トークン	推論トークン
Claude Fable 5	10.0	10.0	100.0%	0		6.20s	834	530	402
Gemini 3.5 Flash	10.0	10.0	100.0%	0		2.57s	492	174	4,997

コーディング	スコア	一貫性	試行ごとの合格率	不安定なテスト	正解テスト	応答時間（平均）	入力トークン	出力トークン	推論トークン
Claude Fable 5	10.0	10.0	100.0%	0		15.59s	10,590	7,383	1,318
Gemini 3.5 Flash	10.0	10.0	100.0%	0		22.96s	8,118	456	47,129

複合	スコア	一貫性	試行ごとの合格率	不安定なテスト	正解テスト	応答時間（平均）	入力トークン	出力トークン	推論トークン
Claude Fable 5	6.5	10.0	50.0%	0		27.47s	52,197	2,373	1,599
Gemini 3.5 Flash	8.2	6.9	66.7%	1		84.14s	82,416	7,153	93,585

データ解析と抽出	スコア	一貫性	試行ごとの合格率	不安定なテスト	正解テスト	応答時間（平均）	入力トークン	出力トークン	推論トークン
Claude Fable 5	10.0	10.0	100.0%	0		7.18s	10,503	521	363
Gemini 3.5 Flash	10.0	10.0	100.0%	0		6.43s	7,548	279	8,466

ドメイン特化	スコア	一貫性	試行ごとの合格率	不安定なテスト	正解テスト	応答時間（平均）	入力トークン	出力トークン	推論トークン
Claude Fable 5	5.3	7.2	44.4%	1		53.40s	975	25,215	5,001
Gemini 3.5 Flash	7.6	7.2	77.8%	1		14.09s	633	12	24,721

汎用知能	スコア	一貫性	試行ごとの合格率	不安定なテスト	正解テスト	応答時間（平均）	入力トークン	出力トークン	推論トークン
Claude Fable 5	10.0	10.0	100.0%	0		7.42s	708	366	144
Gemini 3.5 Flash	10.0	10.0	100.0%	0		3.63s	486	115	1,650

指示追従	スコア	一貫性	試行ごとの合格率	不安定なテスト	正解テスト	応答時間（平均）	入力トークン	出力トークン	推論トークン
Claude Fable 5	10.0	10.0	100.0%	0		5.90s	909	139	202
Gemini 3.5 Flash	10.0	10.0	100.0%	0		3.35s	615	70	3,799

パズル解決	スコア	一貫性	試行ごとの合格率	不安定なテスト	正解テスト	応答時間（平均）	入力トークン	出力トークン	推論トークン
Claude Fable 5	7.7	10.0	66.7%	0		5.18s	894	402	324
Gemini 3.5 Flash	10.0	10.0	100.0%	0		3.23s	558	241	4,940

ツール呼び出し	スコア	一貫性	試行ごとの合格率	不安定なテスト	正解テスト	応答時間（平均）	入力トークン	出力トークン	推論トークン
Claude Fable 5	10.0	10.0	100.0%	0		16.96s	11,775	729	344
Gemini 3.5 Flash	9.8	10.0	100.0%	0		4.96s	6,115	265	1,608

雑学	スコア	一貫性	試行ごとの合格率	不安定なテスト	正解テスト	応答時間（平均）	入力トークン	出力トークン	推論トークン
Claude Fable 5	3.0	10.0	0.0%	0		25.64s	258	3,702	572
Gemini 3.5 Flash	10.0	10.0	100.0%	0		3.94s	156	12	2,005

クイック比較

比較ペアを切り替え

Gemini 3.5 FlashhighvsGPT-5.6 Sollow Gemini 3.5 FlashhighvsGPT-5.6 Solmedium Gemini 3.5 FlashhighvsGPT-5.5low Claude Fable 5mediumvsGrok 4.5low Claude Fable 5mediumvsGrok 4.5high Claude Fable 5mediumvsGemini 3.5 Flashlow Claude Opus 5mediumvsGemini 3.5 Flashhigh Claude Fable 5mediumvsMuse Spark 1.1low Gemini 3.5 FlashhighvsQwen3.7 Maxmedium Gemini 3.5 FlashhighvsGPT-5.5medium Claude Fable 5mediumvsMuse Spark 1.1high Claude Fable 5mediumvsGemini 3.5 Flash-Litehigh