2026年2〜3月、METRはAnthropicら4社を対象にAIエージェントの内部利用リスクを評価。エージェントが自律的な不正展開を行う可能性について調査を行った。
発表の内容
METRは2026年2月中旬から3月中旬にかけて、主要AI開発企業4社(Anthropic、Google、Meta、OpenAI)を対象にパイロット実習を実施した。各社は最新の内部モデルへのアクセス権と思考プロセスを提供し、メトリクス評価や内部運用の実態を調査した。この取り組みは特定のモデルではなく組織全体を評価対象とし、定期的な実施を目指している。
