生成・検出・翻訳が生放送へ:NVIDIAのリアルタイムMedia AI

NVIDIAはIBC 2026で合成動画検出、3D姿勢、フレーム生成、超解像、リップシンクを放送環境へ配備するAI for Mediaを拡張しました。

放送基盤に入る生成・判別AI

NVIDIAは9月9日、IBC 2026に合わせてAI for Mediaを拡張しました。SDK、NIM、手順書を通じて、合成動画分析、単眼3D Body Pose、フレーム生成、Video Super Resolution、TrueHDR、LipSync、話者検出をリアルタイム制作へ接続します。

Video Frame Generationは2倍・4倍のフレーム率を作り、Ross Videoはスポーツの6倍スローへ統合中です。NDIはLipSyncによるリアルタイム翻訳・吹替を進めます。クラウド、オンプレミス、エッジ、隔離環境へ配備できます。

検出点は真偽判定ではない

NVIDIAはSynthetic Video Detectorでtext-to-video 99.3%、image-to-video 97.7%を報告しましたが、供給側評価です。未知の生成器、再圧縮、編集、実放送で同じ精度を保証しません。編集・鑑識担当が確認する一つの信号として、来歴情報、原取材、人の検証を組み合わせる必要があります。生成フレームとリップシンクには表示、承認、原本保存も必要です。

公式情報