AIツール · オーディオ · 動画 · 画像 · Seedance 2.0 · Nano Banana
テーマ、文書、リンク、画像、撮影済み映像、完成した台本から始められます。音声を使うツールは ListenHub のボイスライブラリを共有し、動画ページには入力形式に対応するモデルだけが表示されます。
AIポッドキャストはテーマ・資料・リンクから台本と音声まで仕上げ、1人でも2人の掛け合いでも作れます。書いた文章をそのまま読ませるならテキスト読み上げで、原文どおりの読み上げと、話し言葉に整えてからの読み上げを選べます。会話台本を役ごとに読み分けるならマルチスピーカー音声、トーンや感情、間の取り方まで指定したいならAIボイスです。いずれも音声ファイルとSRT字幕を書き出せます(AIボイスは音声のみ)。
迷ったらAI動画から。台本でも静止画でも参考映像でも起点にでき、モデルは同じエディター内で切り替えられます。何かを分かりやすく伝えたいなら、画面とナレーションを一緒に組み立てる解説動画。用途がはっきりしているなら広告動画・プロモ動画・モーション転写・リップシンクへ直接どうぞ。この4ページはモデルが固定で、それぞれ1つの仕事だけをこなします。
AI画像生成は文章か参考画像(最大5枚)から作り、直したい部分は範囲を選んで変更内容を書くと、そこだけが描き直されます。編集は元の画像を置き換えず、別バージョンとして残ります。スライドは資料を、1ページずつ内容とナレーション台本のある構成に組み立て、PPTXとPDF、ナレーションを付ければ動画・音声・SRT字幕も書き出せます。
ボイスクローンで25〜35秒のサンプルを録音するかアップロードすると、その声がAIポッドキャスト、テキスト読み上げ、スライド、解説動画のボイス一覧に並び、AIボイスとマルチスピーカー音声でも選べます。動画ツールはクローン音声を受け付けません。
ツールは出力形式ごとにカテゴリ分けされています。オーディオはAIポッドキャスト、テキスト読み上げ、ボイスクローン、AIボイス、マルチスピーカー音声。動画はAI動画、解説動画、テキストから動画、画像から動画、参照から動画、広告動画、プロモ動画、モーション転写、リップシンク。画像はAI画像生成とスライドです。
ボイスクローンで作った声は、AIポッドキャスト、テキスト読み上げ、スライド、解説動画のボイス一覧に並び、AIボイスとマルチスピーカー音声でも選べます。動画ツールはクローン音声を受け付けません。ボイスライブラリは読み上げを行うツール全体で共通で、どの声も無料で試聴できます。
テキスト読み上げ、マルチスピーカー音声、AIボイス、ボイスクローンは12言語です(英語、中国語(標準語)、日本語、スペイン語、ポルトガル語、フランス語、ドイツ語、トルコ語、韓国語、イタリア語、タイ語、ベトナム語)。AIポッドキャスト、スライド、解説動画は英語、中国語(標準語)、日本語で生成します。
手元の素材で決まります。文章だけならテキストから動画。静止画を最初のフレームにするなら画像から動画で、2枚目を最後のフレームに指定すると、その間の動きが生成されてトランジションになります。人物・商品・スタイルを参照で固定し、プロンプトでカメラの動きを決めるなら参照から動画で、参照画像とフレーム指定はページが分かれています。この3ページは最長15秒です。広告動画は既定30秒、プロモ動画は既定20秒で15秒と30秒も選べ、モーション転写とリップシンクはアップロードした素材の長さに従います。
動画はSeedance 2.0 Pro、Seedance 2.0 Fast、PixVerse、HappyHorseを同じエディターで切り替えます。各ページはその入力に対応したモデルだけを表示し、モデルごとに対応する尺と画面比率だけが選べます。Seedance 2.5 は現在モデルメニューに表示されていません。広告動画はPixVerse広告エージェント、プロモ動画はPixVerseプロモエージェント、モーション転写とリップシンクはPixVerseです。画像は同じエディターでNano Banana、GPT-Image-2、Seedream 5.0 Proを、AIボイスはseed-audioを使います。
読み上げを行うツールは音声ファイルとSRT字幕を書き出せます(AIボイスは音声のみ)。スライドはPPTXとPDF、ナレーションを付ければ動画・音声・SRT字幕も書き出せます。動画ツールは完成した動画を、AI画像生成は元画像をダウンロードできます。費用はクレジット制で、モデル・尺・画質によって決まり、正確な消費量は生成ボタンの横に表示されてから確定します。