1. Home
  2. News
  3. AIセーフティのAnthropic、Claude Fable 5の生物学セーフガードを改良し誤検知によるモデル切り替えを約85%削減
2026/08/09

Startup Portfolio

AIセーフティのAnthropic、Claude Fable 5の生物学セーフガードを改良し誤検知によるモデル切り替えを約85%削減

Anthropicは、Claude Fable 5に導入している生物学分野のセーフガードを更新し、安全な質問が誤って制限されるケースを大幅に減らしたと発表しました。同社のテストでは、生物学関連の質問でFable 5から別モデルへ切り替わる「fallback」が約85%減少し、日常的な健康、教育、臨床関連の幅広い質問にFable 5が対応できるようになります。

Anthropicは、危険性のある生物学タスクを検出するAI分類器のルール体系を見直し、新たな学習データで再訓練しました。これにより、有害またはデュアルユースの可能性がある要求を引き続き検出しながら、正常な質問をより細かく区別できるようにしています。一方、ウイルス学、毒性学、分子設計など悪用可能性のある専門的研究については、引き続きClaude Opus 5へ切り替える制御を維持します。

フロンティアAIが専門家レベルの生物学能力を獲得するにつれ、安全性を高めるだけでなく、過剰な制限によって正当な利用を妨げないことも重要になっています。今回の改良は、安全性分類器そのものを継続的に学習・改善し、モデルの能力を制限する方式から用途ごとにアクセスを精密に制御する方式へ移行する取り組みです。医療やライフサイエンスで高性能AIを実用化するうえで、能力と安全性を両立する技術として注目されます。

 

Anthropicについて
Anthropicとは、2021年に米国サンフランシスコでDario Amodei、Daniela Amodeiらが設立したAI企業です。大規模言語モデルClaudeを主力製品として、個人・企業向けサービスやAPIを提供しています。AIの安全性、解釈可能性、制御可能性に関する研究をモデル開発と並行して進めています。Public Benefit Corporationとして商業的成長と公共的利益の両立を重視しています。高度なAIを安全かつ信頼できる形で社会へ展開することを目指しています。

 

TagsAIUnited States

関連ニュース

Contact

AT PARTNERSにご相談ください