首页
资产
我的作品
模型
音色库
开发者
博客
简体中文
价格
登录

模型

ListenHub 接入的全部生成模型。选中进对应工具开始,或拿模型 ID 走 API。

API 文档
视频首选Seedance 2.0 Pro唯一同时支持参考视频和原生音频图片首选Nano Banana Pro文字渲染和多图一致性都稳,日常默认语音首选LFlowSpeech播客、配音、多角色对白共用这一套引擎

能力:参考视频 · 首尾帧 · 原生音频 · 多图参考 · 精确编辑 · 多角色 · 情绪 / 语气 · 流式
入口:有工具页 · 仅 API

ByteDance: Seedance 2.0 Pro热门

文生 / 图生 / 首尾帧,支持参考视频驱动运镜与节奏;多主体一致性目前最稳的一档,1080p 成片首选。

6 种比例输入:文本 · 图片 · 视频计费:按分辨率 × 时长,生成前实时估价工具:ai-video
LListenHub: FlowSpeech热门

全部出声工具共用的语音合成引擎。标准音色走自有引擎,Pro 音色接 ElevenLabs,音色是它下面的一层。

输入:文本计费:按音频时长,约 4 积分 / 分钟工具:text-to-speech · podcast · multi-speaker-tts
Google: Nano Banana Pro

画质与文字渲染都稳,多图参考一致性好;日常出图的默认选择。

1K / 2K / 4K · 10 种比例输入:文本 · 图片计费:按张计费,随尺寸档变化工具:ai-image
Google: Nano Banana Flash

同系列的快档,出图快、比例支持面最宽,含 1:4 / 8:1 这类极端画幅。

1K / 2K / 4K · 14 种比例输入:文本 · 图片计费:按张计费,随尺寸档变化工具:ai-image
OpenAI: GPT-Image-2

指令跟随强,改图和局部替换听得懂话;参考图最多 4 张。

1K / 2K / 4K · 10 种比例 · 参考图最多 4 张输入:文本 · 图片计费:按张计费,随尺寸档变化工具:ai-image
OpenAI: GPT-Image-2.5 Flare
1K / 2K / 4K · 10 种比例 · 参考图最多 4 张输入:文本 · 图片计费:按张计费,随尺寸档变化API 文档
OpenAI: GPT-Image-2.5 Sunburst
1K / 2K / 4K · 10 种比例 · 参考图最多 4 张输入:文本 · 图片计费:按张计费,随尺寸档变化API 文档
OpenAI: GPT-Image-2 Pro

官方通道,多一档质量选项;高质量与 4K 需要订阅。

1K / 2K / 4K · 10 种比例 · 参考图最多 4 张输入:文本 · 图片计费:按张计费,随尺寸档与质量变化工具:ai-image
Alibaba: Wan 2.7 Image Pro

中文场景与版式理解好,参考图最多 9 张。

1K / 2K / 4K · 5 种比例 · 参考图最多 9 张输入:文本 · 图片计费:按张计费,随尺寸档变化工具:ai-image
Alibaba: Wan 2.7 Image

同系列标准档,1K / 2K 出图,成本更低。

1K / 2K · 5 种比例 · 参考图最多 9 张输入:文本 · 图片计费:按张计费,随尺寸档变化工具:ai-image
ByteDance: Seedream 5.0 Pro

精确编辑见长,参考图最多 10 张;比例走像素反算,画幅几乎不受限。

1K / 2K · 14 种比例 · 参考图最多 10 张输入:文本 · 图片计费:按张计费,随尺寸档变化工具:ai-image
ByteDance: Seedance 2.0 Fast

同一模型的低延迟通道,草稿、批量出片和快速试镜头用它;不支持 1080p。

6 种比例输入:文本 · 图片 · 视频计费:按分辨率 × 时长,生成前实时估价工具:ai-video
PPixVerse

按首尾帧生成,不吃参考图;口型同步与动作模仿两个玩法跑在它上面。

5 种比例输入:文本 · 图片计费:按秒计费,分辨率越高越贵,生成前实时估价工具:lip-sync
Alibaba: Wan 3.0

Wan 3.0 的标准档。时长与分辨率上限和 Prime 相同,区别在端到端速度。

5 种比例输入:文本 · 图片计费:按秒计费,分辨率越高越贵,生成前实时估价工具:ai-video
Alibaba: Wan 3.0 Prime

人物动作与镜头运动稳定,带原生音频输出;不接受视频输入。

5 种比例输入:文本 · 图片计费:按秒计费,分辨率越高越贵,生成前实时估价工具:ai-video
MiniMax: MiniMax H3

镜头语言丰富,适合叙事片段与运镜明显的画面。

6 种比例输入:文本 · 图片计费:按秒计费,分辨率越高越贵,生成前实时估价工具:ai-video
ByteDance: Seed Audio

语音演绎模型,按秒计费;工具页叫「AI 声音」。

输入:文本计费:0.5 积分 / 秒,最低 1 积分工具:ai-voice
LListenHub: Voice Clone

用一段录音克隆你自己的声音,结果作为「我的音色」出现在 FlowSpeech 里。

输入:文本 · 音频计费:见定价说明工具:voice-cloning
Mureka仅 API

给定歌词唱出成品,配套换词重唱、续写和音轨分离;歌已经在了、还要再加工时用它。

输入:文本计费:见 API 文档API 文档
Suno仅 API

一句风格描述就能出整首,歌词可给可不给;加一个开关就是纯音乐。

输入:文本计费:见 API 文档API 文档