Google DeepMindは2026年9月4日に、フロンティアAIモデルの能力を検証するための新しい枠組みを提言するエッセイを発表しました。技術の進歩が理解を上回る速さで進む中、イノベーションを促進しながら責任ある行動を促す動的なテスト体制の構築を目指しています。
フロンティアAIの基準と評価体制
提言では、米国における新しい基準策定機関の設立が提案されています。この機関は、公的な監督下にある官民パートナーシップのような形態を想定しており、独立した技術専門家やオープンソースの代表者を含む理事会によって運営されます。基準を満たしたモデルは「フロンティア級」と定義され、それらを開発する組織は「フロンティア・ラボ」として位置づけられます。
評価プロトコルと安全性への取り組み
フロンティア・ラボは、モデルのリリース最大30日前までに、基準策定機関に対してモデルを共有しレビューを受けることが推奨されています。評価の内容には、サイバーセキュリティや生物学的脅威などの高リスク領域における厳格な科学的評価が含まれます。また、AIによる欺瞞や安全ガードレールの回避を検知するための、エージェント型AI特有のテストも検討されています。
評価の継続的な更新と国際協力
AIの能力向上に合わせ、評価プロトコルは四半期ごとに更新されることが想定されています。基準策定機関は、ラボ側が過学習(オーバーフィッティング)を起こさないよう、独自のテストセットを構築する能力を持つべきだと述べています。この取り組みは、米国が主導して国際的な共通基準の策定へと発展させることを目的としています。
