会話中心の短いシーン
演技、環境音、カメラを同期した会話を作ります。
Open Soraの完全版動画ワークスペースを統合し、初期モデルとしてVidu Q3を選択しています。他の設定を保ったまま、バリエーション比較やモデル変更も可能です。
生成にはアカウントが必要で、モデル、バリエーション、長さ、解像度などの設定に応じてクレジットを使用します。失敗したタスクは自動返還されます。
参照素材、プロンプト、最終解像度の生成に時間を使う前に、Vidu Q3がどこに適しているか確認します。
Vidu Q3は、音声を含む物語生成、開始/終了フレーム、Reference Mixを組み合わせます。ProとTurboを使い分け、会話、環境音、音楽、効果音を備えた最大16秒のシーンを作れます。
ストーリーテラー、代理店、ブランド、コンテンツチーム、会話シーンのクリエイターにとっての実用的な利点は、単一のベンチマークではありません。Vidu Q3がテキスト、画像、開始/終了フレーム、参照画像から動画化とテキストと最大7枚の参照画像またはフレームをどう組み合わせるかが重要です。この組み合わせにより、準備した映像方針を維持できるか、言葉だけから大部分を作る必要があるかが決まります。
このページでは調査と制作を一つの流れで行えます。公式仕様とソース素材を確認し、プロンプト構成を使って統合ジェネレーターで制作してください。初期モデルはVidu Q3で、Open Soraのアップロード、進捗、履歴、再利用、ダウンロードも利用できます。
生成前に、公式機能を基に入力、形式、長さ、制作モードを計画できます。
最大解像度だけで選ばず、モデルの強い制御機能が実務上の利点になる用途から始めましょう。
演技、環境音、カメラを同期した会話を作ります。
Reference Mixで商品と人物を一貫して見せます。
声、音楽、効果音を使い、モバイル向けの短い物語を描きます。
2つの構図をつなぎ、その間の変化をコントロールします。
この公式メディアは開発元のローンチ/製品素材からダウンロードし、このページで素早く再生できるよう最適化しています。
公式ソース素材: モデル製品ページからダウンロードしたVidu Q3の公式サンプルです。
このモデルページを離れずに、アイデアから設定済みのVidu Q3生成へ進めます。
被写体、動作、環境、カメラ、スタイル、時間、音を記述します。参照素材がある場合はアップロードし、各素材の役割を説明します。
Vidu Q3を選択したまま、バリエーション、モード、長さ、アスペクト比、解像度、音声を設定し、表示されるクレジットを確認します。
タスクを開始し、結果パネルで進行状況を確認します。完成動画を確認し、設定を別テイクに再利用するか、ファイルをダウンロードします。
Vidu Q3の演出、参照、動き、音、出力を特徴付ける主な機能です。
声、音楽、環境音、効果音をシーンの一部として生成します。
高い忠実度と素早い反復を制作段階に応じて選べます。
複数画像から人物、商品、環境、スタイルを制御します。
ショットや転換の入り口と出口を設計します。
短い効果、会話、小さな物語に合わせて長さを調整します。
構図、レンズ、移動、映像リズムの指示を解釈します。
優れたVidu Q3プロンプトは、被写体、順序立てた動作、カメラ計画、アートディレクション、音響を含む簡潔な制作指示として機能します。
被写体 + 順序立てた動作 + 環境 + カメラ + 照明 + 映像スタイル + 時間 + 会話と音 + 一貫性の条件
“12秒の映画的シーン。雨の駅前で二人の友人が再会する。彼女は小声で「来ないと思った」と言い、彼は答える前に微笑む。カメラはゆっくり寄り、夜の反射と雨を映す。親密な会話、遠い交通音、控えめな音楽をネイティブ生成。”
人物の開始時の感情と、ショット中の変化を説明します。
台詞、声の調子、距離、空間の音を指定します。
人物、衣装、商品、環境、スタイルを明確に分けます。
制作段階に合わせて品質と形式を選びます。ドラフト設定はショットを探すため、プレミアム設定は有効な方向性を仕上げるために使います。
| 機能 | Vidu Q3の対応状況 |
|---|---|
| バリエーション | Pro、Turbo、Reference、Reference Mix |
| 生成モード | テキスト、画像、開始/終了フレーム、参照画像から動画化 |
| 入力 | テキストと最大7枚の参照画像またはフレーム |
| 参照制御 | 開始フレーム、終了フレーム、または最大7枚の画像 |
| 長さ | 1〜16秒 |
| 解像度 | 540p、720p、1080p |
| アスペクト比 | 16:9、9:16、1:1、4:3、3:4 |
| 音声 | 会話、音楽、環境音、同期効果音をネイティブ生成 |
AI動画は、各ショットに読み取りやすい視覚アイデアが一つあると安定します。公開前に重要な細部を確認し、最初の生成を改善可能な演出テイクとして扱ってください。
複数人物の複雑な動作、速い遮蔽、読める文字、ロゴ、手、正確な物体数はテイクごとに変化する場合があります。明確な参照を使い、密な動作を簡略化し、フレーム単位で連続性を確認します。
高解像度はアートディレクションの代わりにはなりません。まず手頃な設定で物語、構図、動き、音を固め、最も良い方向性を高品質な設定へ移します。
Open Soraのモデルライブラリで、動き、参照、音声、速度、長さ、解像度の異なる組み合わせを比較できます。
ネイティブの会話・効果音、開始/終了フレーム制御、最大4K出力に対応した映画品質のAI動画を生成します。
Veo 3.1を開くSeedance 2.5は、より長く参照素材の多い映像演出に向けたByteDanceの次世代モデルです。30秒の連続出力、最大50件のマルチモーダル参照、タイムライン制御、部分編集が発表されています。
Seedance 2.5を開くテキスト、画像、動画、音声を参照し、ネイティブステレオ音声付きのマルチショット動画を精密に演出します。
Seedance 2.0を開くリアルな動き、物理的な因果関係、同期した会話、表現豊かな音を備えた高精細動画を生成します。
Sora 2を開くVidu Q3はViduのAI動画生成モデルです。Vidu Q3は、音声を含む物語生成、開始/終了フレーム、Reference Mixを組み合わせます。ProとTurboを使い分け、会話、環境音、音楽、効果音を備えた最大16秒のシーンを作れます。 Open Soraでは完全版ジェネレーターをこのページに統合しているため、別の作業画面を開かずに調査から制作へ進めます。
Vidu Q3はテキスト、画像、開始/終了フレーム、参照画像から動画化に対応しています。文章のアイデアから始める、画像で冒頭を導く、構図・人物・動きをより厳密にするため参照素材を使う、といった制作が可能です。
1〜16秒の動画を540p、720p、1080pで生成できます。素早い検討には低い解像度を使い、細部の確認や納品時には目的に合う最高設定を選びます。
Vidu Q3は会話、音楽、環境音、同期効果音をネイティブ生成に対応しています。会話、環境音、音楽、効果音を意図的にプロンプトへ含め、映像の動きと感情のリズムを音で支えます。
モデルはテキストと最大7枚の参照画像またはフレームを受け付けます。参照ワークフローは開始フレーム、終了フレーム、または最大7枚の画像に対応しています。各素材が人物、スタイル、構図、動きのどれを制御するかプロンプトで明示してください。
Vidu Q3はストーリーテラー、代理店、ブランド、コンテンツチーム、会話シーンのクリエイターに適しています。最適な選択はショット次第です。このページの仕様、機能、例、プロンプトガイドで制御性、速度、解像度、音、参照機能を比較してください。
良いプロンプトには、被写体、動作、場所、カメラ、照明、映像スタイル、時間、音を含めます。出来事を時系列に並べ、台詞は正確に引用し、維持する要素を指定します。アップロードした参照素材は一つずつ明示してください。
はい。完全版Vidu Q3ジェネレーターは、このページのHero直下にあります。テキスト、画像、フレーム、参照素材を選び、設定と表示されたクレジットを確認して、ガイドを離れずに生成できます。