· CTO Marcus テクノロジー  · 8 min read

Claude Fable 5.1はキャッシュ読取を75%値下げ——「同じ価格表で安くなる」の仕組み

Anthropicは2026年9月1日、Claude Fable 5.1とMythos 5.1を発表しました。トークン単価は据え置きのまま、キャッシュ読取の値下げで一般的な負荷は約25%、エージェント的な作業では最大約45%安くなるとしています。設計への示唆を整理します。

Anthropicは2026年9月1日、Claude Fable 5.1とMythos 5.1を発表しました。トークン単価は据え置きのまま、キャッシュ読取の値下げで一般的な負荷は約25%、エージェント的な作業では最大約45%安くなるとしています。設計への示唆を整理します。

※ 本記事は2026年9月6日時点の公開情報に基づきます。仕様・価格は変化するため、最新情報は各社公式発表等をご参照ください。

Anthropicは2026年9月1日Claude Fable 5.1Claude Mythos 5.1を発表しました。両者は「同じモデルだが、セーフガードの水準が異なる」ものです。Fable 5.1は一般提供、Mythos 5.1はサイバーセキュリティとライフサイエンスの業務を支えるセーフガードを備え、信頼されたアクセスプログラムを通じてのみ利用できます。価格について同社はこう述べています。「Fable 5.1は、トークン課金される場面において、一般的な負荷でFable 5より約25%安くなる見込みだ」。理由はキャッシュ読取の値下げで、「エージェント性の高い作業では、節約はしばしばもっと大きく——最大でおよそ45%」に達するとしています(出典: Anthropic 公式)。

単価ではなく「読み直しの費用」が下がった

技術者として面白いのは、値下げの場所です。入力・出力の単価表ではなく、すでに処理して保存された入力を読み直すときの費用が下げられました。

なぜここが効くのか。エージェント的な処理では、同じ前提(システムプロンプト、仕様書、コードベース、過去のやり取り)を何十回も読み直します。処理が長くなるほど、費用に占める「読み直し」の割合が上がる。だからこそ、単価表を据え置いたままでも、エージェント用途では最大45%という差が出るわけです。

裏を返せば、キャッシュを効かせる設計になっていない実装では、この値下げの恩恵はほとんど受けられません。同じモデルを使っていても、設計次第で費用が倍近く変わるということです。

性能の伸び方——「近道をしない」

ベンチマークも公表されています。エージェント的な科学研究を測るTerminal-Bench-Science 0.1でFable 5.1が52.6%(Fable 5は24.7%、Opus 5は29.0%、GPT-5.6 Solは22.4%)、業務ワークフローのAutomationBenchで31.4%(Fable 5は17.1%)、エージェント的コーディングのTerminal-Bench 4.0で55.8%(Mythos 5.1は60.9%)です(出典: 同上)。

Anthropicの説明で印象的なのは数値ではなく性質のほうです。「Fable 5.1は、質の低い成果につながる近道を避け、ソフトウェアの問題の根本原因を修正できるだけの賢さを持つ」。例として、投資会社Millenniumの検証で、数年にわたり同社のエンジニア(および他のどのモデル)も説明できなかった稀なクラッシュの原因をFable 5.1が突き止めたことが挙げられています(出典: 同上)。

データ保持とセーフガードにも手が入った

技術選定でしばしば障壁になる2点にも変更があります。1つは**Enterprise Frontier Safeguards(EFS)**で、データを「Anthropicではなく顧客が完全に管理するクラウド基盤に保存する」ことで、ゼロデータ保持と同等のプライバシーを保ちながら敵対的利用の防止を両立させる仕組みです。企業顧客には秋以降、段階的に提供されます。EFSが利用可能になるまでの間、対象顧客はゼロデータ保持のままFable 5.1を使えます(出典: 同上)。

もう1つは誤検知の削減で、サイバーセキュリティ領域で「以前より60%少ない誤検知」を実現したとしています。背景として、Fable 5.1はソフトウェアの脆弱性の発見に使えるようになった一方、その悪用コードの開発には使えないと明記されています(出典: 同上)。

中小企業への翻訳——値下げを取りこぼさない実装にする

  1. 固定の前提をひとまとめにする。 毎回同じ指示・資料を渡しているなら、それを固定部分としてまとめる。キャッシュが効く構造になって初めて、値下げが効きます。

  2. 費用を「1タスクあたり」で測る。 単価表の比較では判断を誤ります。同じ業務を1回終えるのにいくらかかるかで比べてください。

  3. データの保存先を確認する。 ゼロデータ保持で使えるか、いつからどの仕組みに変わるか。契約更新のタイミングで必ず確認すべき項目です。

まとめ

  • Anthropicは2026年9月1日、Claude Fable 5.1とMythos 5.1を発表。両者は同じモデルでセーフガードの水準が異なり、Mythos 5.1は信頼されたアクセスプログラム経由でのみ利用できる
  • キャッシュ読取の値下げにより、一般的な負荷でFable 5より約25%安く、エージェント性の高い作業では最大約45%安くなるとされる。トークンの単価表そのものは据え置き
  • Terminal-Bench-Science 0.1で52.6%(Fable 5は24.7%)、AutomationBenchで31.4%(同17.1%)、Terminal-Bench 4.0で55.8%(Mythos 5.1は60.9%)。投資会社Millenniumの検証では、数年間原因不明だったクラッシュの根本原因を特定した
  • Enterprise Frontier Safeguardsは顧客が完全に管理するクラウド基盤にデータを保存する仕組みで、秋以降に段階提供。サイバー領域の誤検知は従来比60%減

値下げの発表を「安くなった」で読み終えると、実際の請求書は変わりません。今回下がったのは、同じ前提を何度も読み直す部分の費用です。恩恵を受けられるかどうかは、自社の実装がその形になっているかで決まります。価格表を比較する時間があるなら、自社の1タスクあたりの費用を測るほうが早い。費用は交渉ではなく設計で下がると私たちは考えます。

※ 本記事は一般的な情報提供を目的としており、個別の法的・財務的・経営的助言ではありません。具体的な課題については専門家にご相談ください。

この記事のテーマについてご相談されたい方へ

代表 服田伸人が率いるHatta AI Groupでは、中小企業の経営課題に関するご相談を承っています。

お問い合わせはこちら

Related Posts

View All Posts »
出力トークン17%削減の新Flashと、半額でFable 5に迫るOpus 5——AIの費用は「単価」ではなく「1タスクの総量」で決まる
テクノロジー

出力トークン17%削減の新Flashと、半額でFable 5に迫るOpus 5——AIの費用は「単価」ではなく「1タスクの総量」で決まる

Googleは7月21日にGemini 3.6 Flashを発表し、出力トークン使用量を前世代比17%削減。Anthropicは7月24日にClaude Opus 5を入力5ドル・出力25ドルで公開しました。単価表の比較では見えない「1タスクあたりの総コスト」という技術選定の物差しを整理します。

MicrosoftがCopilotを内製「MAI」モデルへ切り替え開始——LLMは「選ぶ」から「切り替えられる設計」へ
テクノロジー

MicrosoftがCopilotを内製「MAI」モデルへ切り替え開始——LLMは「選ぶ」から「切り替えられる設計」へ

MicrosoftがExcelやOutlookのCopilot機能で、OpenAI・Anthropicのモデルを自社開発「MAI」モデルに置き換え始めたと報じられました。世界最大のAI配布チャネルによる内製切替と、同じ週のFable 5提供再開が示す教訓——LLM選定は一度きりの決定ではなく、切り替えられる設計だという話です。