首页
音频5
视频9
图片2
全部工具
资产
音色库
开发者文档
博客
简体中文
登录
下载应用

AI 工具 · 音频 · 视频 · 图片 · Seedance 2.0 · Nano Banana

全部 AI 创作工具

按输出类型选择工具

可以从话题、文档、链接、图片、实拍素材或现成脚本开始。需要语音的工具共用 ListenHub 音色库;视频页面只显示支持当前输入类型的模型。

  • 播客、配音和克隆音色
  • 文字、图片或参考素材生成视频
  • PixVerse Agent 做广告片和营销成片
  • 生成图片,还能框选局部重画
  • 带旁白的 PPT 和解说视频
音频视频图片
音频5
AI 播客

把一份资料做成一期单人/多人播客。

文字转语音

把文字转成语音,支持多种音色和语言

音色克隆

克隆自己的声音,可以在不同场景复用

场景

AI 声音

同一段稿子里,给每个角色分配不同音色。

多角色配音

粘贴对话剧本,给每个说话人配一个声音

视频9
AI 视频

按脚本、照片、参考生成视频。

解说视频音频

从一个主题出发,画面和讲解一起生成。

AI 视频 · 按素材起点

文生视频

一句话,就能出一条视频

图生视频

Seedance 满血版,支持人像首帧

参考生视频

Seedance 满血版,支持人像参考

AI 视频 · 更多玩法

广告大片

一张商品图,做成一条广告

营销成片

商品图加实拍素材,剪成一条成片

动作模仿

让你的角色照着这段动作演

口型同步音频

让视频里的人说你给的话

图片2
AI 生图

描述一张图,不满意的地方可以单独修改

PPT视频

生成一套可以配上讲解的PPT。

也许你要的是这些

  • AI 图生视频
  • AI 参考生视频
  • AI 视频生成器

哪件事用哪个工具

想要能听的

AI 播客把话题、文档或链接写成脚本再配音,单人或双人主持,出来就是一期完整节目。稿子已经写好用文字转语音,可以原文照读,也可以先开 AI 润色改成口语。对话剧本用多角色配音,每个角色配一个音色;在意语气、情绪和节奏怎么演的用 AI 声音。这些工具都能导出音频加 SRT 字幕,AI 声音只导音频。

想要能看的

拿不准就从 AI 视频开始,脚本、图片、参考素材都能当起点,模型也在同一个编辑器里换。要把一件事讲明白用解说视频,画面和旁白一起生成。需求已经很具体的,直接去广告大片、营销成片、动作模仿或口型同步,这几页各只做一件事,模型是固定的。

想要图片或 PPT

AI 生图用一句话或最多五张参考图出图,哪块不对就框住那块、写清楚要改成什么,只重画那一块,改动单独存成一个版本,不覆盖原图。PPT 会把资料做成每页都有内容和讲稿的演示文稿,导出 PPTX 和 PDF,开了旁白还能导出视频、音频和 SRT 字幕。

想用自己的声音

在音色克隆里录一段或传一段 25-35 秒的样本,这个音色就会出现在 AI 播客、文字转语音、PPT 和解说视频的音色列表里,AI 声音和多角色配音里也能选到它。视频工具不支持克隆音色。

AI 工具常见问题

ListenHub 一共有哪些工具?

工具页按输出类型分组。音频:AI 播客、文字转语音、音色克隆、AI 声音、多角色配音。视频:AI 视频、解说视频、文生视频、图生视频、参考生视频、广告大片、营销成片、动作模仿、口型同步。图片:AI 生图和 PPT。

克隆的音色能在哪些工具里用?

在音色克隆里做好的音色,会出现在 AI 播客、文字转语音、PPT 和解说视频的音色列表里,AI 声音和多角色配音里也能选到它。视频工具不支持克隆音色。音色库是所有会说话的工具共用的,里面每个音色都能免费试听。

支持哪些输出语言?

分两档。文字转语音、多角色配音、AI 声音和音色克隆支持 12 种语言:英语、中文(普通话)、日语、西班牙语、葡萄牙语、法语、德语、土耳其语、韩语、意大利语、泰语、越南语。AI 播客、PPT 和解说视频生成英语、中文(普通话)和日语。

做视频该从哪一页开始?片子能多长?

看你手上有什么。只有一段文字用文生视频。有一张图想让它动起来用图生视频,这张图当首帧,再加一张当尾帧就变成转场。想让人物、产品或风格照着参考走用参考生视频,提示词负责画面怎么动;参考图和首尾帧分在不同页面。这三页最长 15 秒。广告大片默认 30 秒,营销成片默认 20 秒、另有 15 秒和 30 秒可选,动作模仿和口型同步的时长跟着你上传的素材走。

有哪些模型可以选?

视频这边是 Seedance 2.0 Pro、Seedance 2.0 Fast、PixVerse 和 HappyHorse,在同一个编辑器里随时换,每一页只列出支持这种素材的模型,每个模型也只显示自己支持的时长和画面比例。Seedance 2.5 目前未出现在模型菜单中。广告大片跑 PixVerse 广告 Agent,营销成片跑 PixVerse 营销 Agent,动作模仿和口型同步跑 PixVerse。生图在同一个编辑器里有 Nano Banana、GPT-Image-2 和 Seedream 5.0 Pro,AI 声音用的是 seed-audio。

能导出什么?生成一次要花多少?

会说话的工具导出音频加 SRT 字幕,AI 声音只导音频。PPT 导出 PPTX 和 PDF,开了旁白还能导视频、音频和 SRT。视频工具直接下载成片,AI 生图可以下载原图。生成按积分计费,具体多少跟模型、时长和画质有关,确认之前会显示在生成按钮旁边。