AI 工具 · 音频 · 视频 · 图片 · Seedance 2.0 · Nano Banana
可以从话题、文档、链接、图片、实拍素材或现成脚本开始。需要语音的工具共用 ListenHub 音色库;视频页面只显示支持当前输入类型的模型。
AI 播客把话题、文档或链接写成脚本再配音,单人或双人主持,出来就是一期完整节目。稿子已经写好用文字转语音,可以原文照读,也可以先开 AI 润色改成口语。对话剧本用多角色配音,每个角色配一个音色;在意语气、情绪和节奏怎么演的用 AI 声音。这些工具都能导出音频加 SRT 字幕,AI 声音只导音频。
拿不准就从 AI 视频开始,脚本、图片、参考素材都能当起点,模型也在同一个编辑器里换。要把一件事讲明白用解说视频,画面和旁白一起生成。需求已经很具体的,直接去广告大片、营销成片、动作模仿或口型同步,这几页各只做一件事,模型是固定的。
AI 生图用一句话或最多五张参考图出图,哪块不对就框住那块、写清楚要改成什么,只重画那一块,改动单独存成一个版本,不覆盖原图。PPT 会把资料做成每页都有内容和讲稿的演示文稿,导出 PPTX 和 PDF,开了旁白还能导出视频、音频和 SRT 字幕。
在音色克隆里录一段或传一段 25-35 秒的样本,这个音色就会出现在 AI 播客、文字转语音、PPT 和解说视频的音色列表里,AI 声音和多角色配音里也能选到它。视频工具不支持克隆音色。
工具页按输出类型分组。音频:AI 播客、文字转语音、音色克隆、AI 声音、多角色配音。视频:AI 视频、解说视频、文生视频、图生视频、参考生视频、广告大片、营销成片、动作模仿、口型同步。图片:AI 生图和 PPT。
在音色克隆里做好的音色,会出现在 AI 播客、文字转语音、PPT 和解说视频的音色列表里,AI 声音和多角色配音里也能选到它。视频工具不支持克隆音色。音色库是所有会说话的工具共用的,里面每个音色都能免费试听。
分两档。文字转语音、多角色配音、AI 声音和音色克隆支持 12 种语言:英语、中文(普通话)、日语、西班牙语、葡萄牙语、法语、德语、土耳其语、韩语、意大利语、泰语、越南语。AI 播客、PPT 和解说视频生成英语、中文(普通话)和日语。
看你手上有什么。只有一段文字用文生视频。有一张图想让它动起来用图生视频,这张图当首帧,再加一张当尾帧就变成转场。想让人物、产品或风格照着参考走用参考生视频,提示词负责画面怎么动;参考图和首尾帧分在不同页面。这三页最长 15 秒。广告大片默认 30 秒,营销成片默认 20 秒、另有 15 秒和 30 秒可选,动作模仿和口型同步的时长跟着你上传的素材走。
视频这边是 Seedance 2.0 Pro、Seedance 2.0 Fast、PixVerse 和 HappyHorse,在同一个编辑器里随时换,每一页只列出支持这种素材的模型,每个模型也只显示自己支持的时长和画面比例。Seedance 2.5 目前未出现在模型菜单中。广告大片跑 PixVerse 广告 Agent,营销成片跑 PixVerse 营销 Agent,动作模仿和口型同步跑 PixVerse。生图在同一个编辑器里有 Nano Banana、GPT-Image-2 和 Seedream 5.0 Pro,AI 声音用的是 seed-audio。
会说话的工具导出音频加 SRT 字幕,AI 声音只导音频。PPT 导出 PPTX 和 PDF,开了旁白还能导视频、音频和 SRT。视频工具直接下载成片,AI 生图可以下载原图。生成按积分计费,具体多少跟模型、时长和画质有关,确认之前会显示在生成按钮旁边。