Anthropicは、生物学分野の質問を審査する安全分類器の仕組みを刷新し、無害な質問が誤って制限される「フォールバック」件数を全製品面で平均約85%削減したと発表した。Claude Fable 5は血液検査の仕組みや細胞生物学といった一般的な質問と、病原体設計など明確に有害な質問の間に広がる「デュアルユース(両用)」領域の判定に安全分類器を用いているが、これまでは日常的な健康・教育目的の質問まで過度に制限してしまうケースが多かったという。Anthropicは分類器の判定基準となる「constitution(憲章)」を書き直し、無害な用途をより細かく例外として定義したうえで、社内外の専門家からフィードバックを得て再学習させ、有害・デュアルユースのコンテンツを引き続き検知できることを検証したとしている。
削減効果は利用面によって差があり、一般ユーザー向けのClaude.aiで約67%、チーム向けのClaude Coworkで約55%、開発者向けのClaude Codeで約17%、APIであるClaude Platformで約7%のフォールバックが減ったとAnthropicは説明する。コンシューマー向けの利用面ほど改善幅が大きいのは、日常的な健康相談や学習目的の質問がより多く含まれていたためとみられる。
一方で、ウイルス学・毒性学・分子設計などAnthropicが「デュアルユース」と位置付ける領域については、引き続きより上位のモデルであるClaude Opus 5への振り分けが維持される。Anthropicはこの点について、Fable 5は依然として専門的な生物学研究や創薬用途にそのまま使えるわけではないと認めており、今後は身元確認済みの研究者向けに信頼されたアクセス経路を用意することでこのギャップを埋めていく考えを示した。
出典: Anthropic公式ブログ



