Anthropicは、AIモデルが利用者の心理的な健康・ウェルビーイングに与える影響を独立した立場で評価する研究を支援するため、500万ドル規模の助成プログラムを新設したと発表した。対象となるのは、AIとの対話が利用者に及ぼす影響を測定するためのオープンソースの評価手法(エバリュエーション)を開発する研究者やチームで、資金提供に加えてAnthropicのモデルへのアクセスや技術サポートも提供するとしている。
採択されたグラント受給者は完全に独立した立場で研究を進め、成果物はどの開発者も利用できるオープンソースのプロジェクトとして公開することが求められる。Anthropicは、利用者がAIに親密さや心の拠り所を求める場面や、メンタルヘルスの危機に直面した際にモデルがどう振る舞うべきかについて、業界全体で明確な評価基準がまだ確立されていないとし、今回の助成プログラムはその土台となる測定手法を整備する狙いがあると説明している。
応募は2026年9月21日締め切りで、詳細な提案書の提出対象に選ばれた応募者には10月5日までに通知される予定。Anthropicはこれまでにも希少疾患研究向けの助成プログラムなど、AIの社会的な活用を後押しする外部研究支援を続けており、今回はモデルの安全性・利用者保護に軸足を置いた取り組みという位置づけになる。
出典: Anthropic公式ブログ



