Claude Fable 5.1・Mythos 5.1リリース!

Claude Fable 5.1・Mythos 5.1リリース!
性能・価格・セキュリティから企業導入まで徹底解説
3行まとめ
1. はじめに:この3か月で何があったのか
2026年9月1日(日本時間では9月2日の早朝)、AnthropicがClaude Fable 5.1とClaude Mythos 5.1を発表しました。公式の言い方は「コーディングと知識労働のための、世界で最も先進的なモデル」です。
「Fable」と「Mythos」、名前が2つあるので身構えますよね。中身は同じAIです。違うのは安全装置の強さだけ。
公式発表の原文でも “the same model, but with different levels of safeguards”(同じモデルだが、セーフガードの水準が異なる)と書かれています。
一般向けに安全装置を強めに掛けたのがFable 5.1、審査を通った専門組織向けに安全装置を一部ゆるめたのがMythos 5.1、という兄弟関係です。
| 日付(米国時間) | できごと |
|---|---|
| 2026年4月7日 | Claude Mythos Previewを限定公開(強すぎて封印されたAI「Claude Mythos Preview」の全貌) |
| 2026年6月9日 | Claude Fable 5とMythos 5を発表(Claude Fable 5リリース!性能・価格・Mythos 5との関係まで総まとめ) |
| 2026年6月12日 | 米政府の輸出管理指令で、Fable 5とMythos 5を全世界で提供停止 |
| 2026年6月27日 | Mythos 5を米国の一部組織向けに再開 |
| 2026年6月30日〜7月1日 | 輸出管理指令が解除され、Fable 5が世界で復旧(解除日はCNBC等の報道ベース) |
| 2026年7月24日 | Claude Opus 5を発表 |
| 2026年9月1日 | Claude Fable 5.1とMythos 5.1を発表 |
2. まず確認:自分は使えるのか
新モデルの記事で最初に知りたいのは「自分のプランで使えるのか」ですよね。
結論から言うと、契約しているプランで扱いが大きく変わります。Anthropicのヘルプセンター「Claude Fable models on your plan」の整理はこうです。
| プラン | Fable 5.1の扱い |
|---|---|
| Free | 利用不可 |
| Pro、Teamの標準シート | usage credits(後払いの追加課金)でのみ利用。プランに含まれる利用枠は消費しない |
| Max、Team/Enterpriseのプレミアムシート(上位の席種) | 週次の利用枠の50%までは追加課金なし。超えた分はusage creditsに切り替わる |
| Enterprise(従量課金) | APIの標準料金がそのまま課金される |
高速出力のfast modeはOpus 5とOpus 4.8だけの機能で、Fable系では使えません。
提供先はClaude API、Amazon Bedrock、Google Cloud(Vertex AI)、Microsoft Foundry、Claude Platform on AWS(いずれも各社のクラウド経由での提供)が9月1日に同時開始で、Microsoft 365 Copilotも同日に対応しています。
GitHub CopilotについてはFable 5.1単独の提供開始告知が見つからず、本記事執筆時点では未確認です。
なおMythos 5.1は、一般ユーザーには関係ありません。誰が使えるのかは8章で触れます。
3. 料金:安くなったのは「キャッシュ読み込み」だけ
「25%安い」「最大45%安い」という見出しが飛び交いましたが、料金表を見ると入力と出力の単価はFable 5と1セントも変わっていません。
| モデル | 入力(100万トークンあたり) | キャッシュ読み込み | 出力(100万トークンあたり) |
|---|---|---|---|
| Claude Fable 5.1 | $10(約1,500円) | $0.25(約38円) | $50(約7,500円) |
| Claude Fable 5 | $10 | $1(約150円) | $50 |
| Claude Opus 5 | $5(約750円) | $0.50 | $25(約3,750円) |
| Claude Sonnet 5 | $2(約300円) | $0.20 | $10(約1,500円) |
| Claude Haiku 4.5 | $1(約150円) | $0.10 | $5(約750円) |
Fable 5のキャッシュ読み込みは入力単価の10%($1)でしたが、Fable 5.1では2.5%($0.25)という特例扱いです。
Opus 5など他のモデルは10%のままなので、Fable 5.1だけ再利用が極端に安い。
公式が言う「典型的な使い方で約25%減、エージェント的な作業では最大約45%減」は、この再利用料金の値下げをFable 5と比べた試算で、どんな作業を想定したかは公開されていません。
つまり効くのは、同じ資料を何度も読み直しながら長時間働くような、API(プログラムから直接AIを呼び出す方式)経由の自動処理です。
月額プランでチャットしているだけの人には、直接の値下げ感はほぼありません。
3-1. 「安くなった」に異論もある
独立系の評価機関Artificial Analysis(ただしAnthropicの事前評価に協力したと自ら開示しています)は、逆の数字を出しています。
同社の総合テストでは、effortを最大にしたFable 5.1は1タスクあたり$3.76かかり、Fable 5より20%高かった。出力トークンが約1.7倍に増えたのが理由です。
ただし1段階下のxhighなら、ほぼ同じ点数(65点)を$2.72で出せて、Opus 5(63点・$2.34)より費用対効果は良いとも書いています。
一方Anthropicのシステムカード(モデルの詳細報告書)は、自社のコーディング課題では「どのeffortでもFable 5より安い(low〜highで約半分、xhighとmaxで約30%減)」としています。
測っている課題が違うので、どちらが嘘というわけではありません。
effortを上げ切ると高くつく、という点だけ覚えておけばOKです。
3-2. effortを上げると、いくらかかるのか
そのeffort、公式には「AIがどれだけじっくり考えるかの目安」で、low/medium/high/xhigh/maxの5段階です(初期値はhigh)。
上げるほど賢くなる代わりに、時間とお金がかかります。
同じ「自転車に乗るペリカンの絵を描く」課題をeffort別に投げた実測を、あるユーザーがブログとXで公開しています。
| effort | 出力トークン | 所要時間 | コスト |
|---|---|---|---|
| low | 1,998 | 23.8秒 | $0.10(約15円) |
| medium | 1,977 | 23秒 | $0.10 |
| high | 2,612 | 29.6秒 | $0.13 |
| xhigh | 36,767 | 7分51秒 | $1.83(約275円) |
| max | 65,927 | 13分54秒 | $3.30(約495円) |
一番いい絵が出たのはmaxだったそうですが、本人も「ペリカンで実力を測れるかは自信が下がってきた」と断っています。
僕も執筆中に、小さな確認をひとつだけしました。
Claude Codeをコマンドから呼び出す形(claude -p、バージョン2.1.258)で「effortとは何かを150字で、生成AIを知らない人向けに」という同じ質問をFable 5.1とOpus 5に投げたところ、Fable 5.1は51秒・$0.76、Opus 5は9秒・$0.27でした。
effortは初期値のhigh、料金はAPI定価換算で、Claude Code側の長い前置きも含みます。
Fable 5.1は答える前に約2,900トークンぶん考え込み、Opus 5は考えずに即答。
答えの質はどちらも料理の比喩を使った同じような出来で、差は出ませんでした。
Fable 5.1の答えはこうです。
> 「effort」とは、AIがどれだけじっくり考えてから答えるかを決める設定です。料理で「手早く作る」か「時間をかけて丁寧に仕上げる」かを選ぶようなもの。上げるほど答えは良くなりやすい一方、時間や料金もかかります。
1回きりの確認なので一般化はできませんが、ぶっちゃけ、短い質問にFable 5.1を使うのは時間もお金も割に合わないって感じです。
Opus 5との使い分けは、以前の記事で整理した「まずOpus 5」という結論がそのまま生きています。
3-3. Claude Codeのキャッシュ寿命は「サブエージェントだけ5分」
キャッシュ読み込みが安くなった話には、裏返しの落とし穴があります。
キャッシュは当たったときだけ安く、外れた部分は「書き込み」扱いで処理されます。
Fable 5.1は当たりが$0.25、外れが$12.50(5分キャッシュへの書き込み、いずれも100万トークンあたり)で、差は50倍。
Opus 5は$0.50と$6.25で12.5倍なので、Fable 5.1は外したときの痛みが一番大きいモデルです。
では、いつ外れるのか。
Claude Codeのキャッシュには寿命があって、公式ドキュメントでは次の2種類に分かれます(2026年9月2日時点)。
| 対象 | サブスクの枠内 | usage credits・APIキー・クラウド経由 |
|---|---|---|
| メインの会話 | 1時間 | 5分 |
| それ以外(サブエージェント、compaction、ワークフロー等) | 5分 | 5分 |
Xでもこの点を注意喚起する投稿が出ています。いいね数は少ないのですが、公式ドキュメントの記述と一致していたので載せておきます。
ここで効いてくるのが「既存のサブエージェントに聞き直す」使い方です。
サブエージェントを再開すると、それまでの会話履歴を丸ごと引き継ぎます。
5分以上空いていればキャッシュは消えているので、履歴全部を書き込み料金で読み直す。
Fable 5.1のサブエージェントに長い調査をさせたあと、10分後に「さっきの続きを」と頼むと、その瞬間に一番高い請求が来る、という構図です。
一方、同じ定義のサブエージェントを新しく呼び直す分には、共通部分(システムプロンプトやツール定義)は同じモデル・同じ先頭部分なら共有される、と公式は説明しています。
整理するとこうなります。
- サブエージェントは短時間で使い切る。続きを頼むなら5分以内か、履歴が短いうちに
- 長い調査を任せるなら、設定の
subagentPromptCacheTtlを1hにする(Claude Code v2.1.242以降)。ただし1時間キャッシュは書き込みが2倍の料金(Fable 5.1は100万トークンあたり$20)なので、短い作業ではかえって損 - 親とサブエージェントでモデルが違っても、それ自体は損になりません。もともと親のキャッシュはサブエージェントに引き継がれない(システムプロンプトが違う)ためです
- 6章の安全機構でOpus 4.8に自動で切り替わると、モデルが変わるのでキャッシュは全部消えます
4. 何が良くなったのか(実例で見る)
では、お金と時間をかける価値はどこにあるのか。
数字より先に成果物を並べた方が、伸びた方向がつかめます。
その方向はかなりはっきりしていて、何時間もかけて、手順の多い作業を最後まで作り切るタイプの仕事です。
公式はこれを「long-horizon agentic work(長時間のエージェント作業)」と呼んでいます。
まずAnthropic社員が公開した例。
土地の写真を1枚渡しただけで、家を設計し、レンダリング(設計データから画像を描き出す処理)し、映画のようなウォークスルー動画(建物の中を歩いて見せる動画)まで作ったという35秒の動画です。
中の人のポストなので割り引く必要はありますが、「写真1枚から動画まで」という工程の長さが伝わります。
一般ユーザー側では、1つの指示でHTMLファイル(Webページのもとになるファイル)を100本作らせ、「デザインの重複なし、壊れたファイルもほぼなし、フロントエンド(画面側の作り)ではこれまでで最高の結果」と報告した例があります。
大量に作らせても品質が崩れにくい、という長丁場向きの性質が出ています。
ゲームの「一発生成」(1回の指示だけで完成品を作らせること)も発表当日から流行りました。
Minecraft風ゲームの実演動画、マリオカート風ゲームを一発で作らせて「Fable 5から大きく進歩した」と評した報告などです。
いずれも投稿者の自己申告で、動画の細部までは確認できていません。
非エンジニア目線で気になる声もありました。
発表前の1週間試したユーザーが「初心者でも、コーディング以外の用途でも、人間の共同作業者と組んでいるような信頼感がある」と勧めています。
早期アクセス者の主観ですが、「Fableが合わなかった人ももう一度」という言い方が印象的でした。
面白いのは、速さでは負けている比較です。
間取り図1枚から3D制作ソフトのBlenderで3Dモデルを作り、静止画と動画まで仕上げる同じ課題で、OpenAIのGPT-5.6 Solは30分で静止画6枚・動画36秒、Fable 5.1は111分で静止画14枚・動画44秒だったという実測があります。
時間は3倍以上かかっているのに、作った量は2倍以上。
速い=良い、ではない典型例かなと思います。
早期に使い込んだメディアEveryの所感も似ていて、「Opus 5と同じ結果を約半分のトークンで」「Claude Codeでの1日あたりのリクエスト数が約5倍に」と書いています。
こちらは体感値であって、ベンチマーク(性能を測る共通テスト)の結果ではありません。
僕自身は発表直後、公式のグラフを見て「Fable 5のmaxよりFable 5.1のlowの方がスコアが高い」ことに一番反応しました。
同じ結果を得るのに考える量が少なくて済むなら、待ち時間と料金が両方下がる。
3か月前のFable 5で感じていた「賢いけど重い」がどこまで解消されたかは、まだ確かめられていません。
5. 気をつけること①:文章の質は用途で評価が割れる
コーディングや長時間作業の話ばかりしてきましたが、この記事を読んでいる方の多くは、文章を書かせる用途が中心だと思います。
ここは正直に書きます。
評価が割れています。
Fable 5.1に短編小説を書かせてFable 5と比べたユーザーは、「ストーリー構成も文章表現もFable 5の方が優れていた。5.1はChatGPTのような短文の連続が多く、文章の流れが悪い」と報告しています。
投稿者自身が「1回限りのテストで、正確な評価はこれから」と断っている点も含めて受け取ってください。
英語圏の掲示板Hacker Newsでも、Anthropic社員が文体の改善を紹介する一方で、「文章が冗長で読みにくい」「簡潔さを重視して別のモデルに乗り換えた」という声が同じスレッドに並んでいました。
Everyのレビューも、良い点と一緒に「指定した語数や引用数を超えがち」「デザインは不得手」と弱点を挙げています。
独立ベンチマークのVals AIでは、法務エージェント(契約書の処理などを自律的にこなす課題)の指標がFable 5の11.25%から6.67%に下がるという、数少ない後退も記録されています。
日本語の文章品質については、確認できた実例が上の1件しかなく、良くなったとも悪くなったとも断定できません。
6. 気をつけること②:安全機構と「勝手にモデルが変わる」問題
Fable 5を使っていて一番評判が悪かったのが、この安全機構でした。
仕組みはこうです。
- 送った内容を、サイバー攻撃・生物・「思考の抜き取り」の3種類の分類器(見張り役)が判定する
- 危ないと判定されると、その場で別のモデルに処理が引き継がれる(フォールバック)
- 引き継ぎ先は、サイバー系ならOpus 4.8、生物系ならOpus 5
- 引き継ぎが起きると画面に「モデルが切り替わりました」と表示され、どのモデルが答えたかは分かる
問題は、危なくない質問でも見張り役が反応する「誤検知」でした。
Claude Codeの公開Issue(不具合報告の掲示板)には、防御目的のセキュリティ確認や不正対策の業務が繰り返しOpus 4.8に切り替えられた、という報告が残っています。
Fable 5.1では、公式発表いわく、サイバー系のセーフガードの介入がClaude Codeのセッションあたり平均で60%減り、基礎的な生物・医学に関する無害な質問に生物系のセーフガードが誤って反応する率は85%減りました。
後者はFable 5にも同じ改善が入っています。
Xでも「Opus 4.8にフォールバックする仕様が改善しまくったようです」と喜ぶ声が出ています。
ただし、システムカードには但し書きがあります。
- Fable 5より誤検知は減ったが、依然としてOpus 5のセーフガードより反応しやすい
- 防御目的でも、脆弱性(セキュリティ上の弱点)を探す作業の一部は今もブロック対象
もうひとつ、9章で見るベンチマークの数値は、この安全機構を有効にしたまま測られています。
見張り役が反応した課題はパソコン操作のテストOSWorld 2.0では0点扱い、サイバー系の課題はOpus 4.8、生物系の課題はOpus 5が代わりに解いた、と発表ページの脚注に書かれています。
自社に不利な条件を開示している点は、公平に評価していいと思います。
7. 気をつけること③:9月14日からの週次上限(Fable 5.1とは別の話)
Fable 5.1の発表と前後して、「週次の上限が減る」という話がXで広まりました。
混同しやすいので、2つの制度を分けて書きます。
制度A:プラン側の話
2章で見たとおり、MaxやプレミアムシートではFable系のモデルを週次の利用枠の50%まで追加課金なしで使えます。
これはFable 5のときから続く条件です。
制度B:Claude Code側の話
Claude Codeの公式アカウントが8月29日に告知した内容で、9月14日からClaude Codeの標準の週次上限が恒久的に25%引き上げられます。
ところが5月13日から続いていた一時的な「50%増量」が9月13日で終わるため、今と比べると約17%減。
公式自身が続くポストで「今日と比べると17%の削減になる」と認めています。
対象はPro、Max、Team、シート制のEnterprise。
Claude Codeだけが対象で、ClaudeアプリやCowork(デスクトップに常駐する作業用エージェント)は無関係、5時間ごとの上限も変わりません。
僕の見立てとしては、Fable 5.1のキャッシュ読み込みが75%安くなった分、同じ作業で消費する枠が減るので、17%減でも意外といけるのでは、と思っています。
発表当日にそうポストもしました。
ただこれは見立てであって、9月14日以降に実際の消費量を見ないと分かりません。
8. Mythos 5.1とは(一般ユーザーには関係ない話)
先に断っておくと、Mythos 5.1は一般ユーザーは使えません。
名前だけが先に一人歩きしているので、実態を書いておきます。
中身はFable 5.1と同じモデルで、価格も同じ。
違いはサイバーセキュリティと生命科学の分野で安全装置をゆるめてある点だけです。
ゆるめる代わりに、身元審査を通った組織にしか渡さない。
この枠組みを公式はtrusted access programs(信頼アクセスプログラム)と呼び、発表ページとシステムカードではCyber Verification Program(CVP、サイバー防御向け)とLife Sciences Verification Program(LSVP、生命科学向け)の2本立てだと説明しています。
一方で開発者向けドキュメントは「Project Glasswingの参加者限定」と書いており、公式資料の中で呼び方が揃っていません。
Glasswingは4月のMythos Previewのときにできたサイバー防御の枠組みで、システムカードの本文にはこの名前が一度も出てきません。
どちらが正式名称かは断定を避けます。
システムカードを読んで分かった新しい事実がひとつ。
LSVPは提供中ですが、CVP経由でMythos 5.1が使えるのは「近い将来」で、サイバー用途には当面「Opus 5をCVP経由で」が推奨されています。
「サイバー防御者が今すぐMythos 5.1を使える」わけではありません。
加えて現時点では米国の一部組織に限られています。
6月の輸出管理の一件との関係を疑いたくなりますが、公式はその因果を明言していません。
数値で唯一違いが出ているのが、ターミナルを伴う作業のベンチマークTerminal-Bench 4.0です。
Mythos 5.1が60.9%、Fable 5.1が55.8%。
同じモデルなので、この差はそのまま安全装置の有無による差ということになります。
なお、Mythos 5.1の能力は「Claude Security」というEnterprise向けの脆弱性スキャン製品の裏側でも使われている、とシステムカードに書かれています。
9. ベンチマークを読む(ここから深掘り)
先に但し書きを一つ。
発表ページには7つの指標が載っていて、Fable 5.1がすべて1位に見えます。
ただ、システムカードの評価一覧はもっと長く、14行あります。
別の節に載っているCursor社の課題も足して、15行を丸ごと載せます。
| 指標 | 何を測るか | Fable 5.1 | Fable 5 | Opus 5 | GPT-5.6 Sol |
|---|---|---|---|---|---|
| SWE-bench Pro | 実在するソフトの不具合修正 | 81.2 | 80 | 79.2 | 64.6 |
| SWE-bench Multilingual | 同上、9言語版 | 89.1 | 86.6 | 89.5 | — |
| SWE-bench Multimodal | 同上、画面画像つき | 54.7 | 54.1 | 59.4 | — |
| Terminal-Bench 4.0 | ターミナル操作を伴う作業 | 55.8% | 42.0% | 52.3% | 37.3% |
| Terminal-Bench-Science 0.1 | 科学研究の作業(70課題) | 52.6% | 24.7% | 29.0% | 22.4% |
| Humanity’s Last Exam(ツールなし) | 専門家が作った最難関問題 | 60.9% | 57.8% | 56.6% | — |
| Humanity’s Last Exam(ツールあり) | 同上、検索など可 | 65.0% | 63.8% | 63.6% | — |
| OSWorld 2.0(部分点/厳格) | パソコンの画面操作 | 77.9 / 41.7 | 72.9 / 36.1 | 75.4 / 39.6 | — |
| HealthBench Professional | 医療の専門的な問答 | 62.1% | 63.3% | 59.8% | — |
| GDPval-AA v2 | 実務の知識労働 | 1853 | 1723 | 1824 | 1711 |
| AA-Briefcase | 同上、Artificial Analysis版 | 1694 | 1572 | 1685 | 1502 |
| AutomationBench | 定型的な事務作業の自動化 | 31.4 | 17.1 | 26.9 | 19.6 |
| ARC-AGI-1 | 初見のパターンから規則を推測 | 97.5% | 98.5% | 97.5% | 96.5% |
| ARC-AGI-2 | 同上、難化版 | 90.0% | 89.2% | 90.42% | 92.5% |
| CursorBench 3.2.0 | Cursor社の実務コーディング課題 | 73.4% | 70.5% | 70.0% | 67.2% |
見えてくることが2つあります。
ひとつは、伸びがエージェント作業系に集中していること。
Terminal-Bench-Scienceは24.7%から52.6%へ2倍以上、Terminal-Bench 4.0は14ポイント、AutomationBenchも14ポイント上がっています。
もうひとつは、SWE-bench Proは1.2ポイント、ARC-AGI-1は逆に1ポイント減、HealthBenchも1.2ポイント減と、素の知識や推論を測る指標はほぼ横ばいなこと。
画面画像つきのSWE-bench MultimodalではOpus 5に、ARC-AGI-2ではGPT-5.6 Solに負けてもいます。
発表ページの表にSWE-benchやARC-AGIが載っていないのは、そういうことかなと思います。
都合の悪い行は表から外したくなる気持ちは分かる。
独立系の総合指標では、Artificial AnalysisのIntelligence Indexが66点で1位(Opus 5が63、Fable 5が62、GPT-5.6 Solが61)。
Vals AIの総合指標でも1位(67.87%、Opus 5が67.21%)です。
Anthropicの管理下にないVals AIが同じ順位を出している点は、3-1章で触れたArtificial Analysisの留保を少し補ってくれます。
科学系の成果として公式が挙げているのは、
- Mythos 5.1がタンパク質の設計で12の標的に対しておよそ50%の的中率(通常は10〜15%)
- NASAのレーダーデータから金星の地形図を作り直して細部が従来の10〜20kmから2〜3kmまで見えるようになった
- オープンソースの深層学習モデル7本を最大2.5倍高速化した
ことの3点です。
いずれも公式発表の記述で、外部の追試はこれからです。
大学院レベルの理系問題を出すGPQA Diamondは、今回は公表されていません。
10. 開発者向けの変更点
APIを触る人だけの話なので、短くまとめます。
Fable 5から互換性が切れる変更が3つあります。
- 道具の使用を強制する指定(
tool_choiceの強制モード)がエラーになる - AIの思考のメモ(thinking block)は、それを作ったモデルしか読めない。Fable 5.1の思考を古いモデルに渡せない
- 会話の途中を後から書き換えると、思考のメモが無効になる。対象は2026年8月31日以降に作った新規APIアカウントで、既存アカウントは当面そのまま
3つめの動機を、Anthropicは発表ページで「Anti-distillation mechanisms(蒸留対策)」とはっきり書いています。
蒸留とは、他社モデルの出力を大量に集めて、その賢さを自分のモデルに写し取る手法のこと。
偽アカウントを何千も使って産業規模で行われることがあり、思考のメモを抜き取る手口を塞いだ、というのが公式の説明です。
開発者ドキュメントとシステムカードは技術仕様として淡々と書いているだけなので、「蒸留対策」という言葉は発表ページにしか出てきません。
追加された機能は、
- 会話の途中でeffortを変えられる(キャッシュを壊さない)
- ターンごとのシステムメッセージ
- 道具呼び出しの合間の進捗表示
の3つで、いずれもベータです。
発表前に流れた「著作権の制限が厳しくなる」という噂は、公式資料に根拠が見つかりませんでした。
11. 文章に入る「見えない印」とデータの扱い
Fable 5.1とMythos 5.1が書いた文章には、すべてのプラットフォームで目に見えないウォーターマーク(電子透かし)が入ります。
これはAnthropicが自主的に始めた機能ではなく、EU AI Act(EUのAI規制法)の行動規範に対応して、2026年8月2日以降に公開したモデルに求められたものです。
検出用のAPIは限定公開で、対象は規制当局、報道機関、研究者、教育機関など。
つまり、一般ユーザーが「この文章はAIが書いたか」を自分で確かめる手段は、今のところありません。
画像や動画は別方式で、API経由で受け取ったファイルにC2PAのContent Credentials(誰がいつ作ったかを示す電子証明書)が付きます。
データの扱いも押さえておきましょう。
Fable 5.1とMythos 5.1は、安全機構を動かすために30日間のデータ保持が標準で、送ったデータを一切残さない設定(ゼロデータ保持、ZDR)は原則使えません。
企業向けには同日にEnterprise Frontier Safeguards(EFS)という仕組みが発表されました。
顧客が管理するクラウドにデータを置いたまま不正利用を検知する方式で、Anthropicの従業員が中身を見ることは標準ではありません。
ただし提供は2026年秋後半に段階的に、とされていて、発表時点では使えません。
それまでは条件を満たす企業に限って、時限的にゼロデータ保持が認められています。
12. 注意点・現時点で未確定のこと(2026年9月2日時点)
発表から1日しか経っていないので、確認できていないことを集めておきます。
13. まとめ
Fable 5.1を一言でいうと、
「賢さが跳ね上がった」のではなく、同じ値段で長く働かせても壊れにくくなったアップデートです。
だから恩恵を受けるのは、何時間分もの作業をまとめて任せる人と、APIで同じ資料を何度も読ませる人。
短い相談や文章の推敲が主目的なら、急いで乗り換える理由は薄いと思います。
発売当日に複数のアカウントで使い込んだユーザーの所感が、この温度感をよく表しています。
「強くなった」より「使いやすくなったFable」が本質で、使い方は「まずOpus 5、届かないときにFable 5.1」。
公式ドキュメントの「ほとんどの用途はOpus 5から。Fable 5.1はOpus 5のeffortを上げても足りないときに」という指針とも一致します。
早期利用者の声をまとめて「大きな問題はなく、Fable 5の.1アップデート」「使っていない人が無理に乗り換える必要はない」と整理した投稿も、冷静な見方として添えておきます。
僕の中で残っている問いは、文章の質です。
コーディングが伸びたぶん、日本語の長文がどう変わったのかは、まだ1件の報告しか材料がありません。
次の記事までに自分で比べてみます。
試すなら、いつもの短いチャットではなく、面倒で手順の多い作業を1つ選んで、effortを1段階上げて任せてみてください。
時間と料金がどう変わるかを見るのが、一番わかりやすい体験だと思います。
企業としてはどう判断するか
企業向けに今回のアップデートを一言でまとめるなら、
「AIを使う」ためのアップデートというより、「AIに仕事を任せる」ためのアップデート
です。
社内FAQやメール作成だけなら、Fable 5.1である必要性は高くありません。
一方、
- 数十分〜数時間かかる調査
- 大規模なコード修正
- 複数資料を使った分析
- 複数ツールをまたぐ処理
- 自律的なテストと修正
- 大量の社内情報を参照するAIエージェント
では、今回の改善が効いてくる可能性があります。
企業PoCで測るべき指標
| KPI | 確認すること |
|---|---|
| Task Completion Rate | 人間なしで最後まで仕事を完了できたか |
| Cost per Completed Task | 1業務完了までに実際いくらかかったか |
| Human Intervention Rate | 人間が途中で何回介入したか |
| Execution Time | 完了まで何分・何時間かかったか |
| Cache Hit Rate | Prompt Cacheをどの程度再利用できたか |
| Retry Rate | 何回やり直したか |
| Fallback Rate | Safeguardによるモデル変更が何回起きたか |
| Acceptance Rate | 出力を修正せず採用できた割合 |
「AIが1回いくらか」ではなく「仕事を1件終わらせるのにいくらか」
です。
例えば安価なモデルが1回100円でも、3回失敗して人間が30分修正するなら、Fable 5.1が500円で一発完了する方が企業全体では安い可能性があります。
企業導入チェックリスト
セキュリティ・法務
- 30日間のデータ保持を許容できるか
- ZDRの適用条件を確認したか
- EFSの提供状況を確認したか
- 個人情報を入力できるか整理したか
- 機密情報の投入ルールを定義したか
- 利用リージョンを確認したか
- クラウド経由時のデータフローを確認したか
コスト
- APIのtoken単価だけで比較していないか
- Prompt Cacheの利用量を計測できるか
- Cache Hit Rateを確認できるか
- effortの上限を設定しているか
- 1業務あたりのコストを計測しているか
- 長時間処理を強制停止できるか
システム
- 要求モデルと実際の実行モデルを記録できるか
- Safeguardによるfallbackを記録できるか
- AIのツール操作を監査できるか
- AIへ与える権限を最小化しているか
- 失敗時のロールバック手段があるか
- 人間による承認ポイントを設定しているか
業務
- AIへ任せる範囲を決めているか
- 成功条件を定義しているか
- 人間のレビュー責任者を決めているか
- 現在の人間の作業時間を計測しているか
- 既存モデルとのABテストができるか
最終結論
Fable 5.1は、
「すべての仕事で一番良いモデル」ではありません。
短い質問、メール、要約、文章作成などなら、安価で速いモデルの方が合理的なケースは多いでしょう。
一方で、
調べる → 考える → ツールを使う → 作る → 確認する → 修正する
という長い工程をAIへまとめて任せるなら、Fable 5.1はかなり面白い選択肢になっています。
企業が試すなら、普通のチャットでOpus 5と回答を比較するのではなく、
「人間なら1〜3時間かかる仕事」
を1つ選んでください。
そして、
人間の作業時間 / AIの実行時間 / 完遂率 / 修正時間 / APIコスト / Prompt Cache / 再実行回数
を比較する。
そこで初めて、Fable 5.1が単なる「新しい高性能LLM」なのか、自社の業務プロセスを変えられるAIエージェント基盤なのかが見えてくると思います。
FAQ
❓よくある質問
Q.Fable 5.1は全社員の標準AIとして導入した方がいいですか?
必ずしもそうではありません。メール作成、要約、FAQなどの軽い処理では、SonnetやHaikuなど安価なモデルで十分な可能性があります。Fable 5.1は長時間・高難度の業務を中心に評価する方が適しています。
Q.Fable 5.1で一番大きく変わったところはどこですか?
単純な知識性能の大幅向上というより、長時間にわたるエージェント型の作業を最後まで続ける能力です。Terminal-BenchやAutomationBenchなどで大きな伸びが確認されています。
Q.Fable 5.1は安くなったのですか?
入力$10、出力$50という基本料金はFable 5から変わっていません。大きく下がったのはPrompt Cacheの読み込み料金で、$1から$0.25へ75%低下しています。
Q.企業がコストを見る場合、何を測ればいいですか?
token単価だけでなく、Cost per Completed Task(1業務完了あたりのコスト)、Retry Rate、Cache Hit Rate、人間の修正時間まで含めて評価するのがおすすめです。
Q.Mythos 5.1はFable 5.1の上位モデルですか?
いいえ。基盤となるモデルは同じで、主な違いはサイバーセキュリティや生命科学領域におけるSafeguardです。Mythos 5.1は審査された専門組織向けです。
Q.Fable 5.1へ既存システムをそのまま移行できますか?
API仕様やThinking Block、Tool Callingなどに変更があるため、モデルIDだけを変更するのではなく回帰テストを行うのが安全です。
Q.企業PoCでは何を試すのがおすすめですか?
人間なら1〜3時間程度かかる、調査・分析・作成・確認など複数工程を含む実業務を選ぶと、Fable 5.1の特徴を確認しやすくなります。
引用元
Anthropic公式
- Introducing Claude Fable 5.1 and Claude Mythos 5.1(Anthropic公式発表)
- Claude Fable 5.1 & Claude Mythos 5.1 System Card(Anthropic公式・PDF)
- Developing Enterprise Frontier Safeguards with our customers(Anthropic公式)
- How Claude’s text watermark works(Anthropic公式)
- Anthropic、Fable 5とMythos 5のアクセス停止に関する公式声明
Claude Docs
- Claude Fable 5.1 overview
- What’s new in Claude Fable 5.1
- Models overview
- Pricing
- Model deprecations
- Effort
Anthropic Help Center
- Claude Fable models on your plan
- How Claude marks AI-generated content
- Why Claude switched models in your conversation with Fable 5
- Claude Code May–August 2026 weekly limits promotion
Claude Code / Claude Platform
- Model configuration(Claude Code Docs)
- Fast mode
- How Claude Code uses prompt caching
- Prompt caching(Claude Platform Docs)
クラウド・外部サービス
- Claude Fable 5.1 on AWS(AWS What’s New)
- Claude Fable 5.1 in Microsoft Copilot(Microsoft)
第三者評価
- Claude Fable 5.1(Artificial Analysis)
- Claude Fable 5.1(Vals AI)
- Fable 5.1 vibe check(Every)
- A few notes on Claude Fable 5.1(Simon Willison)
- Hacker Newsのスレッド
SNS
- Anthropic公式アカウントの発表スレッド(X)
- Claude Codeの週次上限に関する告知(X・@ClaudeDevs)
- その他、本文中でリンクしたXでの報告
AppTime株式会社 代表取締役:システム開発・DX支援|2018年〜現在
HOJOJO株式会社 取締役CTO:技術戦略・プロダクト開発|2024年〜2025年
関西学院大学大学院(MBA課程)にて、経営管理の高度な知見を統合。
〜主な経歴〜
2017年に個人事業主として独立。エンジニアとして数多くのシステム開発を
手掛けた後、2018年にAppTime株式会社を設立し、代表取締役に就任。
現在は自社の経営のみならず、2024年〜2025年にはHOJOJO株式会社の取締役CTO(最高技術責任者)も兼任。技術の「便利さ」だけでなく、LLM・機械学習をはじめとする先端技術を活かし、企業のコストカットや「利益創出」に直結させるという、実益重視のコンサルティングを展開している。
単なるIT導入に留まらない、経営層・役員の意思決定に資する「経営×IT」の架け橋として、次世代のDXリテラシー向上を支援している。
コメント
まだコメントはありません。最初のコメントを書いてみませんか?