コア機能
ListenHub MCP server でできること — ポッドキャストと FlowSpeech の生成、話者の検索、アカウントの確認。
ListenHub MCP server は、ListenHub の音声生成機能を MCP ツールとして公開します。各ツールは公開されている OpenAPI エンドポイントをラップしているため、ここでできることは OpenAPI を直接呼び出しても同じように実現できます。ツールの正確な名称、入力、レスポンス構造は利用可能なツールを参照してください。
ポッドキャスト生成
トピックや素材を、複数話者のポッドキャスト(台本 + 音声)に変換します。
- 1 回の呼び出しで完全生成(台本 + 音声)。台本を先に確認したい場合はテキストのみの生成も可能です。
- 話者は 1 〜 2 人。
debateモードは 2 人のホスト形式で、2 つの speaker ID が必要です。 - 3 つのモード:
quick、deep、debate。 - 台本先行ワークフロー:まず台本を生成し、編集したうえで、その台本から音声を生成します。
- コンテンツソース:
queryプロンプト、テキスト、URL(queryとsourcesは組み合わせて使えます)。 - ステータスのポーリングでは、タイトル、アウトライン、カバー画像、音声 URL、字幕、話者ごとの台本、クレジット消費量が返ります。
言語は zh または en です。
FlowSpeech 生成
テキストまたは URL を、単一話者のナレーションに変換します。
smartモードは元の内容に AI による推敲を加え、directモードは内容をそのまま読み上げます。- ソースは
text(10 文字以上)またはurl。 - 話者はちょうど 1 人です。
- ステータスのポーリングでは、タイトル、アウトライン、カバー画像、音声 URL、字幕、ナレーション台本、クレジット消費量が返ります。
話者の検索
生成する前にボイスライブラリを確認できます。
- 利用可能な話者を一覧表示し、言語で絞り込むこともできます。
- 各話者は
speakerId、名前、言語、性別、デモ音声リンク、ボイスプロファイル(音の高さ、速度、特徴、スタイル、シーン、アクセント)を持ちます。 - 返ってきた
speakerIdを、生成ツールのspeakerIds/speakerIdの入力に使用します。
アカウントとクレジット
生成する前にサブスクリプションと残高を確認します。
- プランの詳細、更新ステータス、サブスクリプションの開始日 / 有効期限。
- 月次・永久・期間限定の区分ごとの利用可能クレジットと総クレジット、および
totalAvailableCredits。
クレジットの消費量はツールごとに固定ではありません。生成前にコストを見積もるには、OpenAPI リファレンス の該当する */estimate-credits エンドポイントを使用し、get_user_subscription ツールで現在の残高を確認してください。
トランスポート
server はデフォルトで stdio で動作します — すべての MCP クライアント(Claude Desktop、Cursor など)が標準で使用するモードです。リモート環境や共有環境では HTTP モードで実行でき、ストリーミング対応の HTTP エンドポイント(/mcp)と Server-Sent Events エンドポイント(/sse)の両方を公開します。詳しくはトランスポートモードを参照してください。