核心内容の要約
AnthropicはClaude Fable 5.1モデルをリリースし、開発者が新モデルの行動変化に適応できるようにヒントガイドも提供しました。主な特徴は以下の通りです:
- 労力レベルの調整(コストとパフォーマンスのバランス)
- モデル行動の最適化(並行処理の削減、進捗更新の減少など)
- コンテキスト処理の新規ルール(履歴の追加のみ)
- 古いヒントの冗長部分の削除
これにより、より低コストで同等またはより良い結果を実現できます。
1. 労力レベル:お金を節約しながら賢く使う「調整スイッチ」
「effort」はFable5.1のコスト管理のための最も重要な機能で、モデルの「努力度」を調整するものです:
- 5つのレベルが選択可能:low(最もコストがかからない)、medium、high(デフォルト)、xhigh、max(最も賢いが最もコストがかかる)
- コストの驚き:Fable5.1のlowレベルの性能はFable5のhighレベルと同等ですが、コストは1/3になりました。キャッシュの読み取りコストも75%削減され(1ドル/千語から0.25ドルに)、長時間の会話でよりお金を節約できます。
- 柔軟な切り替え:困難な時には一時的にxhighに切り替え、作業が終わったら再びhighに戻すことができ、キャッシュに影響しません。
簡単に言うと:以前は高価なモデルを使って簡単なタスクを行っていましたが、今ではlowレベルで済み、コストを節約しながらも性能は変わりません。難しい部分では一時的にコストを増やしてモデルにより多くの処理をさせ、作業が終わったら元に戻します。
2. モデルの行動が変わった?ヒントを少し変えればいい
Fable5.1はFable5と比べて7つの行動変化があり、Anthropicは「修正用のテンプレート」を提供しています:
- 並行処理の削減:モデルは一度に1つのツールのみを呼び出すようになり、処理時間が長くなりました。対策として、必要なツールをリストアップさせ、一度に呼び出す必要のないものは一緒に処理させます(例:天気予報と株価の確認を同時に行う)。
- 進捗更新の減少:モデルが作業中に数分間静かになる?`display:updates`スイッチをオンにするか、ヒントを追加して「作業開始前に何をするかを伝え、進行中に小さな更新を行い、最後に成果をまとめる」。
- 文章スタイルの変更:文章が長く、段落が少なくなった?「余計な表現を省く」ようにヒントを追加します(例:「ノブ」の代わりに「パラメータ」と言う)。
- フォーマットの変更:以前はリストや太字をよく使用していましたが、今では不要です。必要に応じて「内容が多い場合はリストを使用して明確にする」ようにヒントを追加します。
- 作業が終わらないうちに停止する:モデルが「続けるか」と頻繁に尋ねる?「ユーザーはリアルタイムで見ていないので、質問せずに自分で処理してください」とヒントを追加します。
簡単に言うと:モデルは新しい従業員のようなもので、いくつかの習慣を修正する必要があります。Anthropicが提供するテンプレートをコピーして貼り付けるだけで、より使いやすくなります。
3. コンテキスト処理:履歴を変更しないで、階層的に処理することでコストを節約
Fable5.1は対話履歴に厳格な要件を持っています:
- 履歴の追加のみ:過去の内容を変更すると後の推論が正しくならなくなります(日記を書くようなもので、書き変えられません)。新しい指示は「一時メッセージ」として追加し、次のユーザーのメッセージの後に自動的に消えます。
- キャッシュが安くなったので急いで圧縮する必要はない:以前はトークンを節約するために履歴を事前に圧縮していましたが、今ではキャッシュが安くなったので後で圧縮しても構いません(例:会話が長い場合は後で処理します)。
- 要約の圧縮:圧縮する際にはユーザーの元の言葉、困難な解決策、決定の制約を保持する必要があります(例:ユーザーが「赤いボタンが欲しい」と言った場合、「ボタンが欲しい」と変更しない)。
簡単に言うと:モデルの記憶は「読み取り専用」で、過去の内容を変更することはできません。古い記憶を見るのは安くなったので、急いで削除する必要はありません。圧縮する際にはユーザーの要求と重要な決定を重点的に保持します。
4. 古いヒントの削除:古いモデル用の冗長なヒントを削除する
Fable5の時にAnthropicは80%の冗長なヒントを削除しましたが、Fable5.1でもさらに削除を続けています:
- 削除すべき内容:確認のための儀式(例:「私の要求を理解しているか確認してください」)、繰り返しの指示(同じ指示を3回言う)、古いモデルのチュートリアル、矛盾するルール(例:「決して注釈を書かない」と言っていたが、新しいモデルはそれを判断します)。
- ツールの自動監査:`Claude Code`の`prompt-audit`機能を使用して、ヒントに含まれる矛盾する部分を自動的にチェックします。
簡単に言うと:古いモデルはまるで愚かな子供のようで、多くのルールが必要でした。新しいモデルは賢くなったので、そのような冗長な部分は削除して、ヒントをよりシンプルにします。
5. 小さな問題の解決:lowレベルでは検索しない、セキュリティの誤報など
- lowレベルでは検索しない:lowレベルでは記憶に頼って回答することがあります(古くなっている可能性があります)。対策として、レベルを上げるか、ヒントを追加します:「AIの分野は変化が速いので、名前を知っているからといって現状を理解しているわけではない。まず検索してから回答してください」。
- セキュリティの誤報:「コンパイルできますか?」と尋ねると誤報が発生しやすいので、「何かバグはありますか?」に変更します。マイナーな言語の場合はドキュメントを提供します。ツールの出力から`base64`を削除します。
- ファイルの書き換え:数行のコードを変更するだけでファイル全体を書き換える?「必要な部分のみを変更して、ファイル全体を書き換えないようにしてください」。
簡単に言うと:モデルは時々小さな間違いを犯しますが、目的に応じたヒントを追加するだけで解決できます。大きな変更は必要ありません。
まとめ
Fable5.1の核心は「より賢く、よりコストを節約すること」です。開発者はAnthropicが提供するガイドに従ってヒントを調整するだけで、より低コストでより良い結果を得ることができます。一般ユーザーにとっては、将来Claudeを使用すると応答がより速く、ニーズに合ったものになり、コストの最適化によってサービスがより手頃になるでしょう。