映像と同じくらいの正確さで記述していただく、想定している音そのものの内容
映像についての要件と、それに合わせて必要になる台詞、環境音、あるいは効果音の指定
シーン、その動き、カメラワーク、話される言葉、環境音、そして効果音について記述してください
映像の内容と、それに合わせて必要になる台詞、環境音、効果音について記述してください。Vizifyはネイティブ音声への対応を確認したポリシーだけを使用し、対応するモデルが見つからない場合には、無音のクリップを黙ってお返しするのではなく、その理由を説明したうえで処理を止めます。
入力していただいた要件と、アップロードして用意しておいた素材は、生成を開始する前にVizify上で開かれ、その内容をご自身で確認していただけます。
映像と同じくらいの正確さで記述していただく、想定している音そのものの内容
映像についての要件と、それに合わせて必要になる台詞、環境音、あるいは効果音の指定
シーン、その動き、カメラワーク、話される言葉、環境音、そして効果音について記述してください
ネイティブ音声を伴った、短い動画が1本
編集に回したりフィードに載せたりしていく前に、音まで含めた状態で確認していただけるクリップ
アップロードして用意した参照音声は、そのままリクエストに紐づいた状態で残ります
音声への対応はモデルごとに異なります。Vizifyは音に対応していることを確認したポリシーだけを使用し、無音のモデルで代用することはせず、理由を説明したうえで処理を止めます。また、口の動きと音声が正確に一致することについては保証しておりません。
話し言葉、その空間に流れる環境音、そして個別の効果音という3つの音のレイヤーを分けて書き出したうえで、そのうちのどれを主役として際立たせたいのかを明示してください。映像についての要件の最後に、付け足しのように書かれた音は、たいていの場合、ありふれた背景の物音になって返ってきます。
最初に音を出した状態でクリップを再生し、話し声が指定した言葉と一致しているかどうか、環境音がその場所にふさわしいものかどうか、そして効果音が意図とは違うフレームに乗ってしまっていないかどうかを確認してください。
Vizifyはその時点で処理を止めたうえで、どの部分が対応していないのかを説明します。無音のモデルに切り替えたうえで、その結果を、音声のリクエストが満たされたかのように提示することはありません。
できます。MP3、WAV、OGG、FLAC、M4Aの形式に対応しており、3ファイルまで、1ファイルあたり20MBまでご利用いただけます。参照音声はリズムや音の質感を導くための手がかりとして使われるもので、そのままサウンドトラックとして出力にコピーされるわけではありません。また、アップロードには無料のVizifyアカウントが必要になります。
正確には合いません。口の動きはあくまで近似的なものであり、テイクごとに変わってしまいます。台詞は短く保ったうえで、話し方の正確さが実際に問われる場所で使う前には、必ずご自身でクリップを確認してください。
年齢、声色、話す速さ、なまりといった形で説明していただくことはでき、モデルはその説明を解釈します。ただしVizifyが実在する特定の人物の声を複製することはありませんし、同じ説明をお使いになったとしても、別々のジョブで同一の声が生成されるわけではありません。
雰囲気や楽器の編成を指定していただければ、それに応じてくれるモデルもありますが、これはあくまで動画のための機能であって、音楽を生成するためのツールではありません。完全な楽曲やライセンス済みの音源が必要な場合は、音楽に特化した専用のワークフローをご利用ください。
リクエストされた操作と入力について、調査したポリシーが音声に対応していることを確認できた公開モデルだけが選ばれます。そのぶん候補となるモデルは絞り込まれるため、無音の動画ページで選べる画面比率や長さの組み合わせのうち、いくつかはこのページではご利用いただけません。
いいえ、すぐには完成しません。動画の生成は非同期のジョブとして実行されるため、数秒ではなく数分単位の時間がかかります。Vizifyは送信されたジョブが完了するか失敗するまで状態の確認を続けるので、お手元に届くのは完成したファイルか、原因のはっきりした明確な失敗の通知のどちらかになります。処理待ちの状態を、あたかも結果であるかのように見せかけてお渡しすることはありません。
この公開されたページの上では、ログインしていない状態でも、要件を書いたり、その内容を練り直したりしていただけます。ただし、実際に生成ジョブを実行すること、ファイルをアップロードすること、そして完成した成果物をその後もワークスペースに保存しておくことについては、アカウントが必要になります。
映像の内容と、それに合わせて必要になる台詞、環境音、効果音について記述してください。Vizifyはネイティブ音声への対応を確認したポリシーだけを使用し、対応するモデルが見つからない場合には、無音のクリップを黙ってお返しするのではなく、その理由を説明したうえで処理を止めます。 音声への対応はモデルごとに異なります。Vizifyは音に対応していることを確認したポリシーだけを使用し、無音のモデルで代用することはせず、理由を説明したうえで処理を止めます。また、口の動きと音声が正確に一致することについては保証しておりません。
映像と音声を同時に生成するモデルは、声を説得力のある形で映像に重ねることができますが、口の形はあくまで近似的なものにとどまり、テイクごとに変わってしまいます。話していただく台詞は短く保ち、正確さが問われる場面では口元に寄ったクローズアップを避けるようにしてください。そして、台詞の多い結果はあくまで下書きとして扱い、どこかで実際に使う前に1フレームずつ確認していくことをおすすめします。
Vizifyは非同期ジョブの状態を継続して確認し、そのジョブが完了するか、あるいは失敗するまで追跡し続けます。そのうえで、処理待ちのステータスをそのままお返しするのではなく、完成した成果物のほうをお渡しします。 最初に音を出した状態でクリップを再生し、話し声が指定した言葉と一致しているかどうか、環境音がその場所にふさわしいものかどうか、そして効果音が意図とは違うフレームに乗ってしまっていないかどうかを確認してください。