Vidu Q4 · 参照から動画
Vidu Q4 参照から動画ジェネレーター
最大12枚の参照画像(キャラクター、物体、シーン)と任意の音声参照をVidu Q4に与え、一貫したアイデンティティのショットを生成。5つのアスペクト比、3〜16秒、ネイティブ音声付き最大4K。
参照から動画がワークフローを変える理由
マルチ画像条件付きはVidu Q4の真骨頂。誰が・何が登場するかを一度定義したら、あとはプロンプトで新ショットを演出できます。
参照画像最大12枚
キャラクターシート、小物、ロケーションを組み合わせ、プロンプトで@image-1タグで参照。
音声参照
最大3つの音声/ボイスクリップを添付し、生成されるセリフの声質を統一。
5つのアスペクト比
ソースを継承するのではなく、配信先に合わせて16:9、9:16、1:1、4:3、3:4を選択。
ネイティブ音声 + 4K
同期音声とリップシンクしたセリフを同じパスで生成し、最大4Kで出力。
使い方
参照素材から一貫したショットまで3ステップ。
参照をアップロード
キャラクター、製品、シーンの画像を1〜12枚追加。任意で音声/ボイス参照も。
プロンプトでタグ付け
ショット内容を記述し、@image-1、@image-2などで参照を指定。アスペクト比、長さ(3〜16秒)、最大4Kの解像度を設定。
生成して反復
送信し、ワークベンチで結果を確認。参照やプロンプトを調整して次のショットへ。
参照から動画 vs 画像から動画
Vidu Q4の両モードは画像起点。参照モードはマルチ素材の一貫性制御を追加します。
| 参照から動画 | 画像から動画 | ||
|---|---|---|---|
| 入力 | 画像1〜12枚 + 音声参照最大3つ | 開始画像1枚 | |
| アスペクト比 | 16:9、9:16、1:1、4:3、3:4から選択 | ソース画像に準拠 | |
| 一貫性の目的 | 新ショットでも同じキャラ/製品 | フレーム内をアニメーション化 | |
| 向いている用途 | シリーズ、広告、固定キャラクター | 単発のクイックアニメ |
両モードとも最大4K・3〜16秒のクリップを生成し、ネイティブ音声は任意です。
クリエイターの活用例
固定キャラクター
マスコットや主人公をエピソードやキャンペーン全体で同一に保つ。
製品広告
参照ショットで製品の見た目を固定し、プロンプトで新シーンに配置。
絵コンテからショットへ
キャラクターシートやセット参照を再撮影なしで動くショットに変換。
音声主導のシーン
音声参照を添付し、生成されるセリフを同じ話者の声に。
知っておくべき制限
公開されているVidu Q4 Preview仕様に基づく正直な制約。
画像12枚、音声3つ
本サイトでは現在、1回の生成につき参照画像最大12枚・音声参照最大3つまで対応しています。
プロンプトのタグが重要
各参照は明示的に(@image-1、@image-2)指定してください。タグなし参照は無視される場合があります。
クリップ長は3〜16秒
ショットは短い設計です。シーケンスはエディタでクリップを連結して構築します。
クレジット課金
生成コストは長さと解像度に応じて変わります。ワークベンチが送信前に正確なクレジット数を表示。プランとパックは料金ページへ。
参照から動画のよくある質問
参照画像は何枚まで?
1回の生成につき最大12枚。キャラクター、物体、シーンの参照を組み合わせられます。
どの画像が誰かVidu Q4にどう伝えますか?
アップロード順に@image-1、@image-2のようなタグでプロンプト内から参照します。明示的なタグが曖昧さを防ぎます。
音声や音楽の参照は追加できますか?
はい。音声参照は最大3つまで対応。キャラクターの声の一貫性維持に有効です。
アスペクト比はどれが選べますか?
参照から動画は16:9、9:16、1:1、4:3、3:4から選択可能。画像から動画のようにソース画像に従う方式ではありません。
これはVidu公式サイトですか?
いいえ。vidu-q4.comはVidu Q4 Preview向けの独立したサードパーティワークベンチで、ViduやShengShu Technologyとは無関係です。