首页
音色库
音频
AI 声音New
文字转语音
AI 播客
音色克隆
视觉
AI 生图
AI 视频
解说视频
PPT
简体中文
登录

ListenHub 官方音色库

AI 音色库

写稿之前,先把声音定下来

ListenHub 的 909 个官方音色覆盖 12 种语言,都能在这里试听。听到合适的,直接带去做文字转语音。

  • 12 种语言 · 中文 491 · 英语 142 · 日语 35
  • 免登录试听
  • 场景 / 风格筛选
  • 带着音色进编辑器
英语142中文491日语35西班牙语65葡萄牙语86法语10德语5土耳其语2韩语53意大利语5泰语7越南语8
全部女声男声
场景
风格

2 个音色中匹配 1 个

清空筛选

Calm Woman

女声 · 土耳其语

一位宁静的青年女性土耳其语声音,非常适合有声读物。

  • 有声书
  • 自然平实
  • calm
用它读稿子Skills 文档

怎么挑音色

  1. 1

    先定语言

    12 种语言各有一套独立的音色,中文这 491 个不是英文那套翻译过来的。先按你要发布的语言选。

  2. 2

    再按用途筛

    场景标签说的是这个声音适合什么内容——播客、有声书、纪录片、儿童内容;风格标签说的是它怎么说话。两个条件叠起来,几百个就剩下几十个。

  3. 3

    挨着听几个

    每张卡片播的是同一段试听内容,比的是声音本身,不是它正好在念什么。

  4. 4

    带进工具接着做

    点「用它读稿子」,文字转语音打开时音色已经选好。原有三种语言的音色仍保留播客和 AI Voice 快捷入口。

给你的 Agent 用

每个音色都有一个 speakerId,ListenHub 的 Skills、MCP、命令行和 API 都靠它认声音。从卡片上复制一个,粘给你的 AI 助手,它生成出来的音频就是这个声音。

  1. 1

    装上 Skills

    在你的项目里跑一行命令。Claude Code、Cursor、Windsurf、OpenCode 这些支持 Agent Skills 的工具都认。

    npx skills add marswaveai/skills
  2. 2

    配一次 API Key

    创建一个 lh_sk_ 开头的 key。AI 第一次用到时会问你要,粘进去就存下来了。

    去创建 API Key
  3. 3

    复制音色,粘指令

    在上面任意一张卡片点「复制 Agent 指令」,拿到的句子里音色名和 speakerId 都已经写好。后面接上你要它读的内容或链接,发过去就行。

复制出来是这样一句

用 ListenHub 的「Calm Woman」音色(speakerId: minimax-official-turkish-calmwoman-f7dd55e879)把下面的内容做成音频:

换成任意一张卡片的音色,句子结构一样。

其他接入方式

  • 命令行→

    listenhub tts create --speaker-id <id>

    播客、解说视频、PPT 也是同一个参数。

常见的挑选场景

双人节目的两个声音

双人播客要的是两个听起来像不同人的声音,而不是同一个人说了两遍。定下这一对之前,先放在一起听一遍。

要听很久的内容

有声书和长稿子,成败在于听到第四十分钟还舒不舒服。这种场合,耐听比好听重要。

课程和讲解旁白

教学内容要的是清楚,不是有个性。这类声音大多挂在纪录片和知识科普两个标签下面。

配音和角色

视频配音和角色演绎要的是有戏,不是中性。筛「角色扮演」和「多情感」两个风格,能演的声音都在这两类里。

音色库常见问题

试听要登录吗?

不用。这一页所有音色都能点开就听。要自己生成音频时才需要账号。

一共有多少个音色?

现在是 909 个,覆盖 12 种语言,其中中文 491 个、英语 142 个、日语 35 个。这一页的数字跟着库里的实际数量走。

这些音色免费吗?

试听免费。生成音频会消耗套餐里的积分,消耗多少取决于格式和时长;少数标着「订阅可用」的音色可以在这里试听,但要订阅之后才能用来生成。

场景标签和风格标签是什么意思?

场景说的是这个声音适合什么内容——播客、有声书、新闻播报、冥想助眠;风格说的是它怎么说话——自然平实、口语聊天、角色扮演、多情感。这套标签和 App 里选音色时用的是同一套,所以在这儿看中的声音,进编辑器还是那个样子。

一期节目能用两个不同的音色吗?

可以。双人播客本来就是写给两位主持人的,两个音色都由你挑——所以更值得先把它们放在一起试听。

能用我自己的声音吗?

可以,走音色克隆:25–35 秒干净的录音,你的声音就出现在自己的音色列表里。克隆支持和文字转语音相同的 12 种语言。克隆出来的音色只属于你的账号,不会出现在这个公开音色库里。

标签和文字描述分别怎么看?

每个发布画像都有场景或风格标签和文字描述。先用标签筛范围,再看描述了解用途,最后点试听判断声音本身。

也许你要的是这些

  • AI 播客生成器

    想要两个人对着聊,而不是一个声音从头念到尾,去这里。

  • 文字转语音

    稿子已经写好了,只差把它读出来,去这里。

  • AI 语音生成器

    在意「怎么说」的时候去这里:一次给多个音色,或者一句话要带着情绪说出来。

  • 音色克隆

    音色库里没有那个「你」的时候:录 30 秒,用自己的声音。

  • MCP Server→

    在 Claude Desktop、Cursor、Zed 里,把选音色和生成挂成工具调用。

  • OpenAPI→

    自己发请求时,ID 放进 scripts[].speakerId,或者 voice 字段。

  • 全量音色清单→

    所有音色的 ID、语言和标签,一次抓完,不用翻页。

    https://listenhub.ai/voices.txt