OpenAI、動画・音声生成モデル「Sora 2」のシステムカードを公開
OpenAIは新しい動画・音声生成モデル「Sora 2」に関するシステムカードを公開した。物理法則の再現精度向上や同期音声生成、操作性の強化などが特徴とされる。
OpenAIは、動画・音声生成モデルの最新版「Sora 2」に関するシステムカードを公開した。前世代モデル「Sora」の基盤を発展させたもので、従来の動画生成モデルでは実現が難しかった複数の課題に取り組んでいるという。
Sora 2の主な特徴
公式発表によれば、Sora 2では以下の点が強化されている。
- より正確な物理法則の再現
- 鮮明でリアルな映像表現
- 映像と同期した音声生成
- 操作性(steerability)の向上
- 表現できるスタイルの幅の拡大
特に、映像に合わせた音声の同期生成は、これまでの動画生成モデルにとって大きな課題とされてきた領域であり、Sora 2ではこの点への対応が明示されている。
システムカード公開の意義
システムカードは、モデルの能力や限界、安全性に関する評価をまとめたドキュメントであり、OpenAIは新モデルのリリースに際して同様の資料を公開することが多い。今回のSora 2に関するシステムカードも、モデルの性能や想定される利用シーン、リスクへの対応方針などを含むとみられる。
動画生成AIは近年急速に進化しており、映像制作やコンテンツ制作の現場での活用が期待される一方、悪用リスクへの懸念も指摘されている。OpenAIによる詳細な情報公開は、こうした技術の実力と課題を評価する上で重要な材料となる。
原文ソース
OpenAI