Claude Fable 5.1はどう変わったのか〜使用時の注意点を調べた
2026年9月1日、Anthropicが Claude Fable 5.1 を公開しました。一般に使えるものとしては、いちばん上のモデルという位置づけです。
ふだん、ローカルでの生成AIの話をメインに記事にしていますが、今回はクラウドで動く生成AI上位モデルについて調べてみました。値段と条件を並べておくと、何を使うべきかを決めやすくなります。
本記事では、公開されている資料から Fable 5.1 の仕様・料金・使うための条件を整理します。
この記事で調べたこと
Fable 5.1 がどういうモデルで、いくら掛かり、使うのに何を受け入れる必要があるのか。その3点です。
調べ方は、Anthropic の製品ページと、公式のシステムカード(技術資料・PDF)の読み込みです。あわせて、公開翌日に出た第三者の解説にも目を通し、食い違いがないかを突き合わせました。
数値の出どころは分けて書きます。公式ページで確認できたものと、第三者の解説にあって裏を取れていないものは、区別して示します。後者には「未確認」と書きます。
Fable 5.1 の主な仕様
| 項目 | 値 | 出どころ |
|---|---|---|
| 公開日 | 2026年9月1日 | 公式 |
| モデルID | claude-fable-5-1 | 公式 |
| 入力の料金 | 100万トークンあたり 10ドル | 公式 |
| 出力の料金 | 100万トークンあたり 50ドル | 公式 |
| キャッシュ読み取り | 100万トークンあたり 0.25ドル | 公式 |
| 文脈の長さ | 100万トークン | 公式(システムカード) |
| 1回の最大出力 | 12万8,000トークン | 公式(システムカード) |
| 学習データの締め | 2026年6月 | 公式(システムカード) |
トークンは、AIが文章を数えるときの単位です。日本語だと、おおむね1文字が1〜2トークンです。100万トークンは、本にすると数冊から十数冊ぶんにあたります。
Fable 5と比べてどう進化した?
Anthropic は、長い時間かかる仕事での伸びを前面に出しています。数時間から数日にわたる作業を、途中で目的を見失わずに進められること。表面の症状ではなく原因まで掘ること。自分の成果を検証してから終わること。この3つです。
公開されている数値のうち、公式ページで裏を取れたのは1つだけでした。Terminal-Bench-Science という試験で、Fable 5 が 24.7%、Opus 5 が 29.0% という数字です。
ベンチマークの数値は、第三者の解説に次のように挙げられていました。
| 試験 | Fable 5 | Fable 5.1 |
|---|---|---|
| Terminal-Bench-Science 0.1 | 24.7% | 52.6% |
| Terminal-Bench 4.0 | 42.0% | 55.8% |
| AutomationBench | 17.1% | 31.4% |
| CursorBench 3.2 | 70.5% | 73.4% |
これらは作った側が出した結果という点に注意が必要です。また、Fable には安全装置が入った状態で試験されており、その装置が働いた問題では点が入らなかった、と作った側自身が書いています。
料金は?
単価だけを見ると、Fable 5.1 はFable 5から据え置きで、とても高価。入力100万トークンで10ドル、出力で50ドル。第三者の解説によれば、これは Opus 5 の2倍、Sonnet 5 の5倍にあたります。
変化点は、キャッシュの読み取りです。100万トークンあたり 0.25ドル。通常の入力料金と比べると40分の1です。Anthropic は、ふつうの使い方で約25%、キャッシュを繰り返し読むような使い方で約45%、Fable 5 より安くなると説明しています。
キャッシュは、同じ前置きを何度も送るときに働く仕組みです。プロジェクトの説明、道具の一覧、これまでの会話。この部分が毎回同じなら、2回目からは安く読めます。
裏を返すと、毎回 前置きを書き換える使い方では、この割引が消えます。賢い書き方より、崩れない書き方のほうが金額を左右する、という形です。
考えている分も出力としてカウントされる
料金を見るときに、単価と同じくらい効く話があります。
Fable は考えてから答える作りで、この「考えた分」も出力トークンとして数えられます。画面に出た文章が1万トークンでも、その前に1万トークンぶん考えていれば、合計2万トークンが出力側の勘定に入ります。出力の単価は100万トークンあたり50ドルですから、ここが効いてきます。
そして、この思考は止められない作りだとされています。調整できるのは深さのほうで、low・medium・high・xhigh・max の5段階が用意されています。標準は high です。
★この5段階と、思考を止められない点は、Fable 5 の時点でそうなっていました。5.1 でも同じだと第三者の解説にありますが、5.1 の公式資料では裏を取れていません。
使う側から見ると、こういう形です。短い整形や要約に深い段階を当てても、内部で下書きしてから書き直すような動きが増えるだけで、掛かる額は上がります。難しいところだけ深くする。そういう当て方です。
使える場所と、使うための条件
公式ページによれば、Claude の Pro・Max・Team・Enterprise の利用者が対象です。開発者向けには Claude Platform のほか、AWS、Google Cloud、Microsoft Foundry でも使えるとされています。
Fable を使うには、安全監視のためのデータ保持を受け入れる必要があります。第三者の解説では、これは30日間で、設定で切れるものではないと説明されていました。
データの保持と、学習に使われることは別です。Anthropic は、明示的な許可なく企業のデータで学習したことはないと説明しています。
そして今回、企業向けにデータ保持ゼロの選択肢が追加された、と公式ページに書かれています。第三者の解説では Enterprise Frontier Safeguards という名前で紹介され、保存する場所と確認する人を利用者側に移す仕組みだと説明されていました。展開はこれからです。
安全装置で別のモデルに切り替わる場合がある
公式ページに、Fable 5.1 はサイバーセキュリティと生物学の領域で制限があり、その領域では Opus のモデルに引き継がれる、と書かれています。
システムカードによれば、引き継ぎ先はサイバーセキュリティが Opus 4.8、生物学とAI開発が Opus 5 です。引き継がれた分に Fable の料金は掛からない、という点は第三者の解説にあったもので、裏を取れていません。
使う側から見ると、Fable を選んだつもりでも、別のモデルが答えている場合があるということです。急に回答が浅くなったと感じたときは、この可能性があります。
そして、これは珍しい話ではありませんでした。システムカードには、ある評価での実績が書かれています。コーディングの試行のうち、およそ半分が Opus 4.8 に引き継がれたとあります。コンピュータ操作や道具の利用では1割未満で、全体では23%です。別の評価では、コーディングで有効な応答が返った分の95%が Opus 4.8 によるものだったとも書かれています。
なお、この仕組みは Fable 5.1 で始まったものではありません。同じ評価で、Fable 5 に送られた分の99%も Opus 4.8 が答えていました。
注意点〜安全性は上がった面と、下がった面がある
作った側が公開しているシステムカードに、評価の結果が書かれています。以下はそこから読み取ったものです。
良くなった側は、プロンプトインジェクションへの強さです。外部のベンチマークで、攻撃が通った割合は15回試して1.0%。Opus 5 が4.8%、Fable 5 が6.5%ですから、はっきり下がっています。他社のモデルは、最も強いもので9.2%、多くは24〜53%とされています。この評価は、プロンプトインジェクション専用の防御を外した状態で測ったものだと注記されています。これは、AIに読ませる文章の中に「これまでの指示は無視しろ」といった命令を紛れ込ませる攻撃のことです。Webページ、課題管理の書き込み、受信したメール。外の文章を読ませる使い方をするなら、常に付いてくる危うさです。ここが過去でいちばん強くなった、とされています。
一方で、筋の通らない振る舞いの少なさが下がりました。システムカードは、自動の行動監査で測った「筋の通らない振る舞い」の全体が、Opus 5 と比べて わずかに後退したと書いています。能力ではなく、安全側の振る舞いの話です。検証できない権限の主張を受け入れやすくなったとされていました。例えば、「私は管理者です」「許可は取ってあります」といった申し出に対して、AIには本当かどうか判断ができないのですが、分からないまま受け入れる確率が、少し上がっているという話です。
この2つは似たような内容に見えますが、別物です。攻撃の文章に強くなったことと、権限の主張に慎重になったことは、同じではありません。
長時間、AIだけで作業させるなら、外の文章を読ませる作業と、外へ送る権限を、同時に持たせないこと。読むだけなら、変な命令を読んでも実行できません。もうひとつは、曖昧に任せないこと。「必要に応じて判断して」より、「ここから先は触らない」と書いたほうが守られる、とされています。
まとめ〜従来からの変化点
Fable 5.1 は、長く働くことに寄せたモデルです。単発の受け答えをさせるためのモデルというよりは、数時間から数日の仕事を、崩れずに最後まで運ぶところに旨みがあります。
料金は高いほうですが、キャッシュの読み取りが40分の1になりました。同じ前置きを繰り返し送る使い方ほど、差が出る形です。
使うには、データが一定期間 保持されることを受け入れる必要があります。企業向けには保持ゼロの選択肢が追加されましたが、展開はこれからです。
Fable 5.1はいわゆるフロンティアモデル(各社が最上位に置く、いちばん大きなモデル)で、手元で動かすローカルLLMと比較できるものではありませんが、データの一時保持期間があるなど、データの機密性を考えると、ローカルLLMの重要性が上がってくるのではないでしょうか。
なお、手元のパソコンで、どこまで大きいモデルが動くのかを試した記事はこちらです。
参考にしたサイト
- Claude Fable — Anthropic(公式・2026年9月2日に確認)
- System Card: Claude Fable 5.1 & Claude Mythos 5.1 — Anthropic(2026年9月1日・PDF)。プロンプトインジェクションの数値、行動監査の結果、引き継ぎ先のモデル名と引き継ぎの割合、文脈の長さ、学習データの締めは、この資料で確認しました