ホーム
オーディオ5
動画9
画像2
すべてのツール
アセット
ボイスライブラリ
開発者ドキュメント
ブログ
日本語
ログイン
アプリをダウンロード

AIツール · オーディオ · 動画 · 画像 · Seedance 2.0 · Nano Banana

AI音声・動画・画像の生成ツール

出力形式からツールを選択

テーマ、文書、リンク、画像、撮影済み映像、完成した台本から始められます。音声を使うツールは ListenHub のボイスライブラリを共有し、動画ページには入力形式に対応するモデルだけが表示されます。

  • ポッドキャスト、ナレーション、クローン音声
  • テキスト・画像・参考映像から動画
  • PixVerseエージェントによる広告・プロモ動画
  • 画像を生成し、範囲を選んで描き直す
  • ナレーション付きスライドと解説動画
オーディオ動画画像
オーディオ5
AI ポッドキャスト

資料を一人語り/複数人のポッドキャストに。

テキスト読み上げ

テキストを音声に。多彩な音声と言語に対応

ボイスクローン

自分の声をクローンし、さまざまな場面で使い回せます

シーン

AI ボイス

ひとつの台本で、話者ごとに別の声を当てる。

マルチスピーカー音声

会話台本を貼れば、話者ごとに別の声で読み上げ

動画9
AI 動画

台本・写真・参考動画から動画を生成。

解説動画オーディオ

ひとつのテーマから、映像とナレーションを一緒に。

AI 動画 · 素材から選ぶ

テキストから動画

一文書けば、動画が返ってくる

画像から動画

Seedance フル性能、人物の最初のフレームに対応

参照から動画

Seedance 2.0 フル性能、人物参考に対応

AI 動画 · その他の用途

広告動画

商品写真を入れて、縦型広告を受け取る

プロモ動画

手持ちの写真と実写素材を、1本のプロモに

モーション転写

自分のキャラクターが、その動きを演じる

リップシンクオーディオ

画面の中の人に、新しいセリフを

画像2
AI 画像生成

画像を言葉で作り、気になる部分だけ直せます

スライド動画

解説音声も付けられるスライドを生成。

こちらかもしれません

  • AI画像から動画生成
  • AI参考から動画生成
  • AI動画生成

どのツールを選べばいいか

聴かせたいとき

AIポッドキャストはテーマ・資料・リンクから台本と音声まで仕上げ、1人でも2人の掛け合いでも作れます。書いた文章をそのまま読ませるならテキスト読み上げで、原文どおりの読み上げと、話し言葉に整えてからの読み上げを選べます。会話台本を役ごとに読み分けるならマルチスピーカー音声、トーンや感情、間の取り方まで指定したいならAIボイスです。いずれも音声ファイルとSRT字幕を書き出せます(AIボイスは音声のみ)。

見せたいとき

迷ったらAI動画から。台本でも静止画でも参考映像でも起点にでき、モデルは同じエディター内で切り替えられます。何かを分かりやすく伝えたいなら、画面とナレーションを一緒に組み立てる解説動画。用途がはっきりしているなら広告動画・プロモ動画・モーション転写・リップシンクへ直接どうぞ。この4ページはモデルが固定で、それぞれ1つの仕事だけをこなします。

画像やスライドが要るとき

AI画像生成は文章か参考画像(最大5枚)から作り、直したい部分は範囲を選んで変更内容を書くと、そこだけが描き直されます。編集は元の画像を置き換えず、別バージョンとして残ります。スライドは資料を、1ページずつ内容とナレーション台本のある構成に組み立て、PPTXとPDF、ナレーションを付ければ動画・音声・SRT字幕も書き出せます。

自分の声で読ませたいとき

ボイスクローンで25〜35秒のサンプルを録音するかアップロードすると、その声がAIポッドキャスト、テキスト読み上げ、スライド、解説動画のボイス一覧に並び、AIボイスとマルチスピーカー音声でも選べます。動画ツールはクローン音声を受け付けません。

ツール選びのよくある質問

ListenHubにはどんなツールがありますか?

ツールは出力形式ごとにカテゴリ分けされています。オーディオはAIポッドキャスト、テキスト読み上げ、ボイスクローン、AIボイス、マルチスピーカー音声。動画はAI動画、解説動画、テキストから動画、画像から動画、参照から動画、広告動画、プロモ動画、モーション転写、リップシンク。画像はAI画像生成とスライドです。

クローンした声はどのツールで使えますか?

ボイスクローンで作った声は、AIポッドキャスト、テキスト読み上げ、スライド、解説動画のボイス一覧に並び、AIボイスとマルチスピーカー音声でも選べます。動画ツールはクローン音声を受け付けません。ボイスライブラリは読み上げを行うツール全体で共通で、どの声も無料で試聴できます。

対応している言語は?

テキスト読み上げ、マルチスピーカー音声、AIボイス、ボイスクローンは12言語です(英語、中国語(標準語)、日本語、スペイン語、ポルトガル語、フランス語、ドイツ語、トルコ語、韓国語、イタリア語、タイ語、ベトナム語)。AIポッドキャスト、スライド、解説動画は英語、中国語(標準語)、日本語で生成します。

動画はどのページから始めますか。尺はどれくらいですか?

手元の素材で決まります。文章だけならテキストから動画。静止画を最初のフレームにするなら画像から動画で、2枚目を最後のフレームに指定すると、その間の動きが生成されてトランジションになります。人物・商品・スタイルを参照で固定し、プロンプトでカメラの動きを決めるなら参照から動画で、参照画像とフレーム指定はページが分かれています。この3ページは最長15秒です。広告動画は既定30秒、プロモ動画は既定20秒で15秒と30秒も選べ、モーション転写とリップシンクはアップロードした素材の長さに従います。

どのモデルが動いていますか?

動画はSeedance 2.0 Pro、Seedance 2.0 Fast、PixVerse、HappyHorseを同じエディターで切り替えます。各ページはその入力に対応したモデルだけを表示し、モデルごとに対応する尺と画面比率だけが選べます。Seedance 2.5 は現在モデルメニューに表示されていません。広告動画はPixVerse広告エージェント、プロモ動画はPixVerseプロモエージェント、モーション転写とリップシンクはPixVerseです。画像は同じエディターでNano Banana、GPT-Image-2、Seedream 5.0 Proを、AIボイスはseed-audioを使います。

書き出せる形式と費用は?

読み上げを行うツールは音声ファイルとSRT字幕を書き出せます(AIボイスは音声のみ)。スライドはPPTXとPDF、ナレーションを付ければ動画・音声・SRT字幕も書き出せます。動画ツールは完成した動画を、AI画像生成は元画像をダウンロードできます。費用はクレジット制で、モデル・尺・画質によって決まり、正確な消費量は生成ボタンの横に表示されてから確定します。