AIニュース

Anthropic、Claude Fable 5の生物学分野の安全装置を刷新 誤って制限される「フォールバック」を85%削減

公開日: ・出典: Anthropic公式ブログ

Anthropicは、生物学分野の質問を審査する安全分類器の仕組みを刷新し、無害な質問が誤って制限される「フォールバック」件数を全製品面で平均約85%削減したと発表した。Claude Fable 5は血液検査の仕組みや細胞生物学といった一般的な質問と、病原体設計など明確に有害な質問の間に広がる「デュアルユース(両用)」領域の判定に安全分類器を用いているが、これまでは日常的な健康・教育目的の質問まで過度に制限してしまうケースが多かったという。Anthropicは分類器の判定基準となる「constitution(憲章)」を書き直し、無害な用途をより細かく例外として定義したうえで、社内外の専門家からフィードバックを得て再学習させ、有害・デュアルユースのコンテンツを引き続き検知できることを検証したとしている。

削減効果は利用面によって差があり、一般ユーザー向けのClaude.aiで約67%、チーム向けのClaude Coworkで約55%、開発者向けのClaude Codeで約17%、APIであるClaude Platformで約7%のフォールバックが減ったとAnthropicは説明する。コンシューマー向けの利用面ほど改善幅が大きいのは、日常的な健康相談や学習目的の質問がより多く含まれていたためとみられる。

一方で、ウイルス学・毒性学・分子設計などAnthropicが「デュアルユース」と位置付ける領域については、引き続きより上位のモデルであるClaude Opus 5への振り分けが維持される。Anthropicはこの点について、Fable 5は依然として専門的な生物学研究や創薬用途にそのまま使えるわけではないと認めており、今後は身元確認済みの研究者向けに信頼されたアクセス経路を用意することでこのギャップを埋めていく考えを示した。

出典: Anthropic公式ブログ

Xでシェア

誤検知フォールバック率の変化(対象別)

生物学分野の安全装置刷新により、製品面ごとに問い合わせが誤って制限される割合がどれだけ減ったかをAnthropicの公式発表の数値でまとめました。

対象 誤検知フォールバックの削減率
Claude.ai 約67%削減
Claude Cowork 約55%削減
Claude Code 約17%削減
Claude Platform(API) 約7%削減
全体(製品横断) 約85%削減

※出典: Anthropic公式発表 / Claude公式Xアカウント