01Source video

Upload a video

MP4, MOV, WebM · max 300MB · short side ≤ 1080px

02Voice track

Upload audio

MP3, WAV, M4A · max 100MB

03Video mode
Cost:

AIリップシンク生成

動画と音声をアップロードすると、AIが話し手の口元を新しい声に合わせ直します。吹き替え、ナレーションの差し替え、多言語版の制作に。
AI Lip Sync Generator created with AvatarCraft AI

リップシンクをきれいに仕上げるには

顔がはっきり映った動画から始める
流したい音声を用意する
Normal と Loop を選ぶ
公開する前に確認する
入力・制限・権利

このリップシンクツールでできること・できないこと

動画の条件

短辺1080px以下、300MBまでのクリップ。顔が最後まではっきり映っているものが最適です。

音声の条件

1秒以上、100MBまで。完成済みのトラックをご用意ください。ツールは音声を生成するのではなく、それに合わせます。

出力の長さ

出力は最長120秒です。Normal では動画と音声の短いほうに合わせた長さになります。

再生モード

Normal は動画を一度だけ再生し、Loop は音声が終わるまで繰り返します。トラックの長さに合うほうを選んでください。

音声トラックは一度に1本

このワークフローは1本の音声トラックを映像に合わせます。同じ場面で複数の話者を分離したり割り当てたりはしません。

映像と音声の権利

自分が権利を持っている、または使用許諾を得た映像と音声のみをアップロードしてください。実在の人物の声は本人の同意がある場合に限ります。

AIで動画をリップシンクする手順

3ステップ:素材動画 → 新しい音声 → 生成
01

素材動画をアップロード

話し手の顔がはっきり映ったクリップを選びます。短辺は1080px以下、ファイルは300MBまでです。

02

新しい音声をアップロード

話し手に話させたいセリフ・ナレーション・歌唱トラックを追加します。1秒以上、100MBまで。

03

再生モードを選んで生成

Normal か Loop を選んで生成し、書き出す前に口元のタイミングを確認します。出力は最長120秒です。

AIリップシンク生成が使われる理由

テイクはそのまま、セリフだけ変える

撮り直しのコストが高く、舞台や出演者より原稿のほうが頻繁に変わる場合に向いています。

Normal と Loop の2つの再生

短い映像に長めのナレーションを合わせる——Loop はまさにこのための設計です。

料金は出力の長さと解像度で決まる

音声が短いほど、素材の解像度が低いほど、生成にかかる費用は下がります。
AvatarCraft AI でリップシンク動画を作る際のよくある質問。

AIリップシンク生成 よくある質問

AvatarCraft AI でリップシンクを作る
AvatarCraft AI を試す