Anthropic: Claude Fable 5 vs Google: Gemini 3.5 Flash

Gemini 3.5 Flash (low) が平均スコアでリードし、8.9 vs 8.6 です。 Gemini 3.5 Flash (low) の benchmark コストが低く、$0.433 vs $3.478 です。 Gemini 3.5 Flash (low) の方が高速で、5.55s vs 17.20s です、成功率は 78.8% vs 87.9% です。

おすすめモデルGemini 3.5 Flash (low)ここでは最高スコア（8.9）で、Claude Fable 5 (medium) より約 8.0 倍低コストです。

ベンチマークは AI BENCHY テストスイートから次の日時に生成: 2026-07-25

指標	Claude Fable 5 Claude Fable 5 medium リリース: 2026-06-10	Gemini 3.5 Flash Gemini 3.5 Flash low リリース: 2026-05-19

指標	Claude Fable 5 Claude Fable 5 medium リリース: 2026-06-10	Gemini 3.5 Flash Gemini 3.5 Flash low リリース: 2026-05-19
スコア	8.6	8.9
順位	#22	#16
信頼性	10.0	10.0
一貫性	9.6	9.7
正解テスト
試行ごとの合格率	78.8%	87.9%
不安定なテスト	1	1
総実行回数	66	66
結果あたりのコスト	20.459	2.277
合計コスト	$3.478	$0.433
入力価格	$10.000 / 1M	$1.500 / 1M
出力価格	$50.000 / 1M	$9.000 / 1M
合計入力トークン	89,643	87,817
出力トークン	41,360	2,239
推論トークン	10,269	31,182
応答時間（平均）	17.20s	5.55s
応答時間（最大）	80.80s	53.55s
応答時間（合計）	378.41s	122.19s

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#22 Claude Fable 5

medium

コスト: $0.606
時間: 156.7s
トークン: 12,264 tok

#16 Gemini 3.5 Flash

low

コスト: $0.068
時間: 39.1s
トークン: 7,588 tok

スコア上位モデル

スコア vs 総コスト

応答時間（平均）

スコア vs 応答時間（平均）

合計出力トークン

スコア vs 合計出力トークン

カテゴリ内訳

カテゴリ:

反AIトリック	スコア	一貫性	試行ごとの合格率	不安定なテスト	正解テスト	応答時間（平均）	入力トークン	出力トークン	推論トークン
Claude Fable 5	10.0	10.0	100.0%	0		6.20s	834	530	402
Gemini 3.5 Flash	10.0	10.0	100.0%	0		2.52s	494	209	2,536

コーディング	スコア	一貫性	試行ごとの合格率	不安定なテスト	正解テスト	応答時間（平均）	入力トークン	出力トークン	推論トークン
Claude Fable 5	10.0	10.0	100.0%	0		15.59s	10,590	7,383	1,318
Gemini 3.5 Flash	7.8	10.0	66.7%	0		6.71s	8,118	458	13,420

複合	スコア	一貫性	試行ごとの合格率	不安定なテスト	正解テスト	応答時間（平均）	入力トークン	出力トークン	推論トークン
Claude Fable 5	6.5	10.0	50.0%	0		27.47s	52,197	2,373	1,599
Gemini 3.5 Flash	8.2	6.9	66.7%	1		29.99s	63,752	557	3,713

データ解析と抽出	スコア	一貫性	試行ごとの合格率	不安定なテスト	正解テスト	応答時間（平均）	入力トークン	出力トークン	推論トークン
Claude Fable 5	10.0	10.0	100.0%	0		7.18s	10,503	521	363
Gemini 3.5 Flash	10.0	10.0	100.0%	0		1.81s	7,548	279	1,164

ドメイン特化	スコア	一貫性	試行ごとの合格率	不安定なテスト	正解テスト	応答時間（平均）	入力トークン	出力トークン	推論トークン
Claude Fable 5	5.3	7.2	44.4%	1		53.40s	975	25,215	5,001
Gemini 3.5 Flash	7.7	10.0	66.7%	0		3.39s	633	12	4,538

汎用知能	スコア	一貫性	試行ごとの合格率	不安定なテスト	正解テスト	応答時間（平均）	入力トークン	出力トークン	推論トークン
Claude Fable 5	10.0	10.0	100.0%	0		7.42s	708	366	144
Gemini 3.5 Flash	10.0	10.0	100.0%	0		2.27s	486	119	916

指示追従	スコア	一貫性	試行ごとの合格率	不安定なテスト	正解テスト	応答時間（平均）	入力トークン	出力トークン	推論トークン
Claude Fable 5	10.0	10.0	100.0%	0		5.90s	909	139	202
Gemini 3.5 Flash	9.9	10.0	100.0%	0		1.86s	615	71	1,652

パズル解決	スコア	一貫性	試行ごとの合格率	不安定なテスト	正解テスト	応答時間（平均）	入力トークン	出力トークン	推論トークン
Claude Fable 5	7.7	10.0	66.7%	0		5.18s	894	402	324
Gemini 3.5 Flash	10.0	10.0	100.0%	0		2.35s	558	288	2,150

ツール呼び出し	スコア	一貫性	試行ごとの合格率	不安定なテスト	正解テスト	応答時間（平均）	入力トークン	出力トークン	推論トークン
Claude Fable 5	10.0	10.0	100.0%	0		16.96s	11,775	729	344
Gemini 3.5 Flash	10.0	10.0	100.0%	0		3.27s	5,457	234	403

雑学	スコア	一貫性	試行ごとの合格率	不安定なテスト	正解テスト	応答時間（平均）	入力トークン	出力トークン	推論トークン
Claude Fable 5	3.0	10.0	0.0%	0		25.64s	258	3,702	572
Gemini 3.5 Flash	10.0	10.0	100.0%	0		1.88s	156	12	690

クイック比較

比較ペアを切り替え

Gemini 3.5 FlashlowvsGrok 4.5high Gemini 3.5 FlashlowvsGPT-5.3-Codexmedium Gemini 3.5 FlashlowvsGPT-5.5medium Claude Opus 4.8mediumvsGemini 3.5 Flashlow Gemini 3.5 FlashlowvsQwen3.7 Maxmedium Claude Fable 5mediumvsGrok 4.5low Claude Opus 4.7mediumvsGemini 3.5 Flashlow Claude Opus 5mediumvsGemini 3.5 Flashlow Claude Opus 5highvsGemini 3.5 Flashlow Claude Fable 5mediumvsGrok 4.5high Gemini 3.5 FlashlowvsMuse Spark 1.1medium Claude Fable 5mediumvsMuse Spark 1.1low