AIニュース

Anthropic、新モデル「Claude Fable 5.1」と「Claude Mythos 5.1」を発表 エージェント型の科学タスクで性能が倍増

公開日: ・出典: VentureBeat

Anthropicは9月1日、コーディングとナレッジワーク向けの新モデル「Claude Fable 5.1」と、サイバー防衛・重要インフラ分野の信頼できるパートナー向けに限定提供する「Claude Mythos 5.1」を発表した。両モデルは同一のベースモデルをもとにしており、コンテキストウィンドウは100万トークン、最大出力は12万8000トークンとなっている。

性能面では、エージェント型の科学研究タスクを評価する「Terminal-Bench-Science 0.1」でFable 5.1が52.6%を記録し、前モデルFable 5の24.7%から倍増した。コーディング能力を測る「Terminal-Bench 4.0」でもFable 5.1は55.8%(Fable 5は42.0%)を記録し、サイバー領域での安全対策をより緩めて動作するMythos 5.1は同ベンチマークで60.9%に達したという。

料金体系も見直され、入力100万トークンあたり10ドル・出力100万トークンあたり50ドルという基本料金自体はFable 5から据え置かれた一方、プロンプトキャッシュの読み込み料金は1ドルから0.25ドルへと75%引き下げられた。この結果、通常のワークロードでは平均25%程度、複雑なエージェントタスクでは最大45%程度のコスト削減が見込めるとしている。

またFable 5.1では、新規に発行したAPIアカウントについて、モデルの思考過程(thinking block)を保持したまま過去の会話履歴だけを書き換えることができなくなった。これはClaudeの思考内容を不正に抽出して他モデルの学習に流用する、いわゆる蒸留目的の手法への対策とみられる。

出典: VentureBeat

Xでシェア

Claude Fable 5.1とFable 5の違い

Anthropicの公式発表内容をもとに、旧モデルFable 5との主な違いを比較します。

項目 Claude Fable 5 Claude Fable 5.1
Terminal-Bench-Science 0.1(科学タスク) 24.7% 52.6%
Terminal-Bench 4.0(コーディング) 42.0% 55.8%
プロンプトキャッシュ読み込み料金(入力100万トークンあたり) 1.00ドル 0.25ドル
基本料金(入力/出力 100万トークンあたり) 10ドル/50ドル 10ドル/50ドル(据え置き)

※出典: Anthropic公式発表 / VentureBeat