動画ツール
ネイティブ音声付きのAI動画

音を伴った短いAI動画を、1回のリクエストのなかで生成します。

映像の内容と、それに合わせて必要になる台詞、環境音、効果音について記述してください。Vizifyはネイティブ音声への対応を確認したポリシーだけを使用し、対応するモデルが見つからない場合には、無音のクリップを黙ってお返しするのではなく、その理由を説明したうえで処理を止めます。

音声を付加的な要素ではなく、満たすべき要件として扱います 映像についての要件と、それに合わせて必要になる台詞、環境音、あるいは効果音の指定 ネイティブ音声を伴った、短い動画が1本
まとまっていないアイデアから始める選択項目は Vizify が成果物を整える助けになります。
入力例

入力していただいた要件と、アップロードして用意しておいた素材は、生成を開始する前にVizify上で開かれ、その内容をご自身で確認していただけます。

入力

映像と同じくらいの正確さで記述していただく、想定している音そのものの内容

映像についての要件と、それに合わせて必要になる台詞、環境音、あるいは効果音の指定

シーン、その動き、カメラワーク、話される言葉、環境音、そして効果音について記述してください

Vizify の成果物

ネイティブ音声を伴った、短い動画が1本

編集に回したりフィードに載せたりしていく前に、音まで含めた状態で確認していただけるクリップ

アップロードして用意した参照音声は、そのままリクエストに紐づいた状態で残ります

できること

完成した成果を返すために設計されています。

Vizify

音声は、この取り決めに含まれています

音声への対応はモデルごとに異なります。Vizifyは音に対応していることを確認したポリシーだけを使用し、無音のモデルで代用することはせず、理由を説明したうえで処理を止めます。また、口の動きと音声が正確に一致することについては保証しておりません。

Vizify

ショットだけでなく、音のバランスまで記述してください

話し言葉、その空間に流れる環境音、そして個別の効果音という3つの音のレイヤーを分けて書き出したうえで、そのうちのどれを主役として際立たせたいのかを明示してください。映像についての要件の最後に、付け足しのように書かれた音は、たいていの場合、ありふれた背景の物音になって返ってきます。

Vizify

映像を見るよりも先に、まず音を聴いてください

最初に音を出した状態でクリップを再生し、話し声が指定した言葉と一致しているかどうか、環境音がその場所にふさわしいものかどうか、そして効果音が意図とは違うフレームに乗ってしまっていないかどうかを確認してください。

よくある質問

よくある質問への回答。

音声に対応した互換性のあるモデルが1つもない場合は、どうなりますか?

Vizifyはその時点で処理を止めたうえで、どの部分が対応していないのかを説明します。無音のモデルに切り替えたうえで、その結果を、音声のリクエストが満たされたかのように提示することはありません。

参考として使う音声トラックをアップロードすることはできますか?

できます。MP3、WAV、OGG、FLAC、M4Aの形式に対応しており、3ファイルまで、1ファイルあたり20MBまでご利用いただけます。参照音声はリズムや音の質感を導くための手がかりとして使われるもので、そのままサウンドトラックとして出力にコピーされるわけではありません。また、アップロードには無料のVizifyアカウントが必要になります。

口の動きは正確に合いますか?

正確には合いません。口の動きはあくまで近似的なものであり、テイクごとに変わってしまいます。台詞は短く保ったうえで、話し方の正確さが実際に問われる場所で使う前には、必ずご自身でクリップを確認してください。

特定の声の質やなまりを指定してお願いすることはできますか?

年齢、声色、話す速さ、なまりといった形で説明していただくことはでき、モデルはその説明を解釈します。ただしVizifyが実在する特定の人物の声を複製することはありませんし、同じ説明をお使いになったとしても、別々のジョブで同一の声が生成されるわけではありません。

台詞の代わりに音楽を生成してもらうことはできますか?

雰囲気や楽器の編成を指定していただければ、それに応じてくれるモデルもありますが、これはあくまで動画のための機能であって、音楽を生成するためのツールではありません。完全な楽曲やライセンス済みの音源が必要な場合は、音楽に特化した専用のワークフローをご利用ください。

このページでは、どのモデルが選ばれることになりますか?

リクエストされた操作と入力について、調査したポリシーが音声に対応していることを確認できた公開モデルだけが選ばれます。そのぶん候補となるモデルは絞り込まれるため、無音の動画ページで選べる画面比率や長さの組み合わせのうち、いくつかはこのページではご利用いただけません。

動画は送信するとすぐに完成しますか?

いいえ、すぐには完成しません。動画の生成は非同期のジョブとして実行されるため、数秒ではなく数分単位の時間がかかります。Vizifyは送信されたジョブが完了するか失敗するまで状態の確認を続けるので、お手元に届くのは完成したファイルか、原因のはっきりした明確な失敗の通知のどちらかになります。処理待ちの状態を、あたかも結果であるかのように見せかけてお渡しすることはありません。

Vizifyのアカウントは必要になりますか?

この公開されたページの上では、ログインしていない状態でも、要件を書いたり、その内容を練り直したりしていただけます。ただし、実際に生成ジョブを実行すること、ファイルをアップロードすること、そして完成した成果物をその後もワークスペースに保存しておくことについては、アカウントが必要になります。

リクエストは短いクリップ1本の範囲に収めてください

映像の内容と、それに合わせて必要になる台詞、環境音、効果音について記述してください。Vizifyはネイティブ音声への対応を確認したポリシーだけを使用し、対応するモデルが見つからない場合には、無音のクリップを黙ってお返しするのではなく、その理由を説明したうえで処理を止めます。 音声への対応はモデルごとに異なります。Vizifyは音に対応していることを確認したポリシーだけを使用し、無音のモデルで代用することはせず、理由を説明したうえで処理を止めます。また、口の動きと音声が正確に一致することについては保証しておりません。

口の動きの同期は、現時点でどこまでできるのか

映像と音声を同時に生成するモデルは、声を説得力のある形で映像に重ねることができますが、口の形はあくまで近似的なものにとどまり、テイクごとに変わってしまいます。話していただく台詞は短く保ち、正確さが問われる場面では口元に寄ったクローズアップを避けるようにしてください。そして、台詞の多い結果はあくまで下書きとして扱い、どこかで実際に使う前に1フレームずつ確認していくことをおすすめします。

生成された結果を確認してください

Vizifyは非同期ジョブの状態を継続して確認し、そのジョブが完了するか、あるいは失敗するまで追跡し続けます。そのうえで、処理待ちのステータスをそのままお返しするのではなく、完成した成果物のほうをお渡しします。 最初に音を出した状態でクリップを再生し、話し声が指定した言葉と一致しているかどうか、環境音がその場所にふさわしいものかどうか、そして効果音が意図とは違うフレームに乗ってしまっていないかどうかを確認してください。

要件から完成したクリップへ

次にお作りになる動画を、Vizifyで準備しましょう。

Vizifyを開く