NVIDIAは2026年9月9日、メディア・エンターテインメント業界向けのAI技術「NVIDIA AI for Media」の拡張を発表しました。この拡張により、放送やスポーツ、ライブ制作のワークフローにおいて、動画の真偽確認や高画質化、多言語対応などが、既存の環境を乱すことなく実現可能になります。
動画の真偽確認と高画質化技術の展開
NVIDIAは、動画がAI生成か否かを判定する「NVIDIA Synthetic Video Detector (SVD)」の展開を強化しています。SVDは、テキストから生成された動画に対して99.3%、画像から生成された動画に対して97.7%の精度で真偽を判定できます。DaletやTwelveLabs、Wowzaといった企業が、ニュース制作やコンプライアンス確認のワークフローにこの技術を統合しています。
また、動画の滑らかさを向上させる「Video Frame Generation (VFG)」や、低解像度の動画を高画質化する「NVIDIA Video Super Resolution (VSR)」も提供されています。VFGはフレームレートを2倍または4倍に高めることができ、Ross Videoはこれをスポーツのリプレイ制作に活用しています。VSRは、ノイズやボケを低減しながらアップスケーリングを行うことが可能です。
モーション解析と音声・映像の最適化
「NVIDIA 3D Body Pose」は、単一のカメラ映像から人間の関節位置や角度を推定します。Vizrtは、この技術を用いてバーチャルスタジオ内で、被写体の動きに合わせたリアルタイムな3D照明効果を生成しています。
さらに、映像と音声を同期させる「NVIDIA LipSync」などのマイクロサービスにより、多言語展開が容易になります。NDIは、この技術を用いて、既存の放送ワークフロー内でリアルタイムな翻訳やリップシンク(口の動きの同期)を実現しています。また、背景ノイズを抑制し音声の明瞭度を高める「Studio Voice」も提供されています。
