製品・サービス · · Team LATENT
AnthropicがClaude Fable 5.1とMythos 5.1を発表
Fable 5.1は開発や研究の評価で前モデルを上回り、キャッシュの読み取り単価は4分の1になった。費用が下がる条件と、利用先を限るMythosとの違いを解説する。
Opusより上位のモデルを、日々の仕事にも使いやすくできるか。AnthropicはFableとMythosを更新し、性能だけでなく、繰り返し資料を読む費用や安全対策による中断にも手を入れた。2つの名前が表す違いと、値下げの恩恵を受ける条件を見ていく。
この記事の要点
- Fable 5.1とMythos 5.1は同じモデルで、安全対策と利用できる範囲が異なる。
- 安くなったのは処理済みの入力を再利用する料金。初めて読む入力と出力の単価は変わらない。
- 性能評価は開発元によるもの。仕事全体の費用は、使うトークン数や資料の再利用の割合にも左右される。
出来事
- Anthropicが9月1日、日本時間2日未明にFable 5.1とMythos 5.1を発表した。
- Fable 5.1はClaudeとAPI、AWS、Google Cloud、Microsoft Azureで提供する。
- Mythos 5.1の直接利用は、発表時点では審査を受けた米国の一部組織に限られる。
一次情報:Anthropicの発表、APIの料金表
FableとMythosは同じモデルで安全対策が異なる
名前が違うため、Mythos 5.1のほうが大きなモデルに見えるかもしれない。しかし、Anthropicの説明では両者の中身は同じだ。Fableには広く提供するための制限を設け、Mythosでは審査した利用者のサイバー防御や生命科学の研究に合わせて制限を調整する。
この違いは、モデルを選ぶ際にも効いてくる。文章を書く、コードを直すといった仕事のために、Mythosの利用権が必要というわけではない。一方、研究やセキュリティの仕事では、解く力があることと、依頼を受け付けることが別の問題になる。
Mythosへのアクセスは、利用目的や組織の確認を伴う。発表時点の対象は米国の一部組織で、海外への拡大は今後の予定だ。日本から通常の契約で選べるFableと、同じように利用できるとは考えないほうがよい。
開発と科学研究の評価で前モデルを上回った
開発元の比較表では、端末を使って開発作業を進めるTerminal-Bench 4.0で、Fable 5.1は55.8%。Fable 5の42.0%、Opus 5の52.3%を上回った。科学研究の課題を扱うTerminal-Bench-Science 0.1でも、24.7%から52.6%へ伸びた。
ただし、これらはAnthropicが自社の環境で測った結果だ。安全対策が介入した課題では、別のOpusモデルに処理を引き継いだものもある。数値には、モデル単体の能力だけでなく、制限や実行環境の影響も含まれている。
開発の試験で55.8%という値を、そのまま自分の仕事の成功率に置き換えることはできない。コード修正なら、変更が小さいか、テストが通るか、後から人が直す量が減るかまで含めて比べる必要がある。
値下げしたのは処理済みの入力を読み直す料金
APIの料金表では、100万トークンあたりの入力は10ドル、出力は50ドルで、Fable 5から据え置きになった。下がったのはキャッシュの読み取りで、1ドルから0.25ドルになった。保存済みの入力を再利用する場合の単価が、75%下がった計算だ。
長いプログラムや資料を読み、道具を使いながら何度も続きを処理する仕事では、同じ入力を繰り返し参照する。その部分にキャッシュが使えれば、値下げが仕事全体の費用にも効く。一度だけ短く質問し、長い回答を出させる使い方では、同じ恩恵は得にくい。
例えば、100万トークンをキャッシュから読み、1万トークンを出力する処理だけを比べると、従来は1.50ドル、今回は0.75ドルになる。これは料金表からの編集部の計算で、最初にキャッシュを作る費用は含めていない。出力が10万トークンなら6ドルから5.25ドルで、下がる割合は12.5%にとどまる。
読み取りの単価が4分の1でも、請求額全体が4分の1になるわけではない。キャッシュを作る料金と再利用できた量、生成した量を分けて見れば、値下げが自分の仕事にどれほど効いたかを確かめられる。
100万トークンあたりのAPI単価。通常の入力と出力は据え置き。
通常の入力新しく渡す文章など
Fable 5$10
Fable 5.1$10
キャッシュ読み取り処理済みの入力の再利用
Fable 5$1
Fable 5.1$0.25
出力モデルが生成するトークン
Fable 5$50
Fable 5.1$50
キャッシュの書き込みは別料金。5分保存は12.50ドル、1時間保存は20ドルで、両モデルとも同じ。税金や為替、クラウド独自の条件は含めていない。
開発元の料金表発表当日の料金表に基づき編集部が作成。
Opusとの費用差は入力の再利用で変わる
同じ発表当日の料金表で、Opus 5は入力5ドル、出力25ドル、キャッシュ読み取り0.50ドルだった。Fable 5.1の入力と出力はその2倍だが、キャッシュの読み取りは半額になる。
そのため、高い価格帯のモデルほど、どの処理でも費用が高くなるとは限らない。長い資料を何度も読み直す仕事と、毎回新しい文章を大量に生成する仕事では、料金の内訳が変わる。さらに、モデルごとに使うトークン数が違えば、同じ単価でも仕事を終えるまでの費用は変わる。
比較すべきなのは、単価だけでなく、求める品質の成果が得られるまでの合計だ。最初の回答が安くても修正を何度も頼めば費用は増える。逆に上位モデルの回答を使うことで、追加のやり取りが減る可能性もある。今回の料金表だけで、どちらが常に安いとは結論できない。
脆弱性の発見は認めるが攻撃コードの作成には制限を残す
Fable 5.1ではソフトウェアの弱点を見つける作業を認める一方、攻撃コードの生成などではOpusに処理を切り替える制限が残る。Claude Codeでは、サイバー関連の安全対策が介入する回数は、1回のセッションあたり、従来のFable 5に比べて平均約60%減る見込みだという。
ここでの60%は、攻撃能力や被害が減った割合ではない。サイバー関連の安全対策が、1回のセッション中に作業へ介入する回数についての開発元の説明だ。自分のコードの安全性を確認したい利用者には、性能の伸びと同時に、必要な調査を最後まで続けられるかが重要になる。
企業向けには監視用データを自社で管理する仕組みも用意する
同時に発表したEnterprise Frontier Safeguards(EFS)は、不正利用を検知するためのデータを、顧客が管理するクラウドに保存する仕組みだ。複数の会話にまたがる不審な動きを自動で調べ、必要な人手の確認も顧客側で行えるようにする。
提供は今秋から段階的に進める予定で、発表日にすべての企業が使えるわけではない。対象となる顧客には、準備が整うまでFable 5と5.1でデータを保持しない契約を提供する。
機密情報を扱う企業では、モデルが賢くなるだけでは導入が進まない。作業記録を誰が保管し、誰が見られるかも判断材料になる。今回の更新は、性能、継続利用の費用、データ管理を合わせて、上位モデルを実務に取り込もうとするものと読める。
出典・参考資料
- Introducing Claude Fable 5.1 and Claude Mythos 5.1 Anthropic/9月1日の発表/現在の公式ページ
- Claude APIの料金表 Anthropic/9月2日日本時間の保存版/現在の公式ページ
- Developing Enterprise Frontier Safeguards with our customers Anthropic/9月1日の発表/現在の公式ページ
更新履歴
- 公開しました。
- 安全対策の介入が約60%減るという説明を、サイバー関連の対策と1セッションあたりの回数に限定しました。