音声付き AI 動画 / 対応時のみサウンドあり

対応する音声オプションで AI 動画を作る

管理された音声を含む、または音声トグルを備えた RedVideo のモデルを選び、目に見える動作と音の指示をひとつのリクエストで組み立てましょう。音声対応はモデルとワークフローごとに異なり、設計上まったく無音の動画を返すルートもあります。

内容の検証

方法: モデルとワークフローの仕様は RedVideo の現在の構成カタログに基づいています。提供状況、対応設定、生成見積もりは変わることがあるため、生成前にスタジオでご確認ください。

ライブカタログの事実

モデルと機能

以下の仕様は RedVideo に現在設定されているワークフローに基づいています。提供状況と生成見積もりはスタジオで常に確認できます。

動画モデル

Wan 2.6 Flash

より速い Wan 画像モーション。生成音声は任意。

このページのワークフロー
画像から動画
長さ
5s · 10s · 15s
出力
720p · 1080p
音声
対応する場合は任意
モデルを開く
動画モデル

Wan 2.7

テキストまたは 1 枚の開始フレームに対応する最新の Wan ルート。

このページのワークフロー
画像から動画
長さ
5s · 10s · 15s
出力
720p · 1080p
音声
モデルが管理
モデルを開く
動画モデル

Veo 3.1 Fast

高速な Veo 生成。固定 8 秒出力で、テキスト・フレーム・参照画像による誘導に対応。

このページのワークフロー
画像から動画
長さ
8s
出力
モデルが管理
音声
モデルが管理
モデルを開く
動画モデル

Kling 3.0 Standard

Kling 3.0 の画質フルレンジ:Standard、Pro、4K。

このページのワークフロー
画像から動画
長さ
3s · 4s · 5s · 6s · 7s · 8s · 9s · 10s · 11s · 12s · 13s · 14s · 15s
出力
STD · PRO · 4K
音声
対応する出力設定では任意
モデルを開く
動画モデル

Seedance 2.0 Standard

ネイティブ 4K を含むフル解像度の Seedance 2.0。

このページのワークフロー
画像から動画
長さ
4s · 5s · 6s · 7s · 8s · 9s · 10s · 11s · 12s · 13s · 14s · 15s
出力
480p · 720p · 1080p · 4k
音声
対応する場合は任意
モデルを開く
音声のモード

管理・任意・無音のルートを見分ける

RedVideo のモデルには、生成の一部として音声を管理するもの、ユーザーが操作できる音声トグルを出すもの、生成音なしの動画を返すものがあります。現在の挙動はモデル セレクターと有効なコントロールに表示されます。

Wan 2.6 Flash は現在、画像から動画で任意の音声設定に対応します。ほかの対応する Wan、Veo、Kling、Seedance、Core、HappyHorse のルートはそれぞれ独自の音声ルールを適用し、画質やワークフローによって変わることもあります。

シーンをプロンプトにする

目に見える動作と関連する音の手がかりをまとめて書く

モデルが生成音声に対応している場合は、そのカットに関わる音の情報だけを書きましょう。環境音、動作の合図、短いせりふ、あるいは邪魔な音がないこと、などです。音声の細部がシーン描写を押しのけないよう、映像の指示も明確に保ってください。

生成される音は確率的です。せりふ、同期、発音、音楽、環境音はプロンプトどおりにならないことがあり、使用前の確認が必要です。

  • 重要な音の発生源が画面のどこにあるかを示す
  • モデルが対応している場合はせりふを簡潔にする
  • 同期と意図しない音のノイズを確認する
音声はひとつの機能ではない

生成音声とアップロードした参照音声を切り分ける

音声トグルは、対応モデルに音を生成または付与するよう求めるものであり、そのワークフローがアップロードした音声ファイルを受け付けることを意味しません。参照音声は別の入力で、参照音声の枠を明示的に備えたワークフローでのみ使えます。

現在の Seedance 2 の参照から動画のルートは、対応する音声参照を提供できます。参照ワークフローを選び、元音声をアップロードする前に長さ、形式、合計時間の検証を確認してください。

費用と納品

送信前に音声の条件を確認する

音声は生成の見積もりに影響することもあれば、特定のアクセス形態では別途課金されることもあります。たとえば、本来対象となる 無制限 Core の実行でも、任意の自動音声にはクレジットがかかることがあります。

スタジオには有効な音声コントロール、モデルのアクセス、現在の見積もりが表示されます。サウンドトラックが実際に聞かれる端末やプラットフォームで、完成した動画を書き出して確認しましょう。

よくある疑問

よくある質問

RedVideo は音声付きの AI 動画を生成できますか?
対応するモデルとワークフローでは可能です。自動的に音声を管理するルート、音声トグルを提供するルート、無音の動画を生成するルートがあります。スタジオの有効なコントロールが基準です。
すべての AI 動画モデルに音が付きますか?
いいえ。音声対応はモデル、ワークフロー、場合によっては画質によって異なります。たとえば Kling のモーション制御と Kling の 4K 画質は現在、生成音声を提供しません。
自分の音声トラックをアップロードできますか?
参照音声の入力があるワークフローだけが、音声をガイドとして受け付けます。これは音声生成のトグルとは別です。完成したサウンドトラックが必要な場合は、生成した動画と許諾済みの音声を編集工程で合わせる必要があるかもしれません。
生成されたせりふはプロンプトどおりになりますか?
いいえ。せりふの内容、発音、タイミング、口の動きの同期、声の質感は変わることがあります。正確さが重要な場合は、生成されたせりふをすべて確認し、差し替えるか編集してください。
音声を付けるとクレジットを多く使いますか?
使う場合があります。クレジットの扱いは選んだモデルとアクセス形態によって決まり、任意の音声には別途課金があり得ます。生成を送信する前に表示されるライブ見積もりをご確認ください。
REDVIDEO を開く

最初の生成を始める

アイデアに合うモデルとワークフローを選び、ライブ設定と見積もりを確認してから生成を始めましょう。