ListenHub MCP

コア機能

ListenHub MCP server でできること — ポッドキャストと FlowSpeech の生成、話者の検索、アカウントの確認。

ListenHub MCP server は、ListenHub の音声生成機能を MCP ツールとして公開します。各ツールは公開されている OpenAPI エンドポイントをラップしているため、ここでできることは OpenAPI を直接呼び出しても同じように実現できます。ツールの正確な名称、入力、レスポンス構造は利用可能なツールを参照してください。

ポッドキャスト生成

トピックや素材を、複数話者のポッドキャスト(台本 + 音声)に変換します。

  • 1 回の呼び出しで完全生成(台本 + 音声)。台本を先に確認したい場合はテキストのみの生成も可能です。
  • 話者は 1 〜 2 人。debate モードは 2 人のホスト形式で、2 つの speaker ID が必要です。
  • 3 つのモード:quickdeepdebate
  • 台本先行ワークフロー:まず台本を生成し、編集したうえで、その台本から音声を生成します。
  • コンテンツソース:query プロンプト、テキスト、URL(querysources は組み合わせて使えます)。
  • ステータスのポーリングでは、タイトル、アウトライン、カバー画像、音声 URL、字幕、話者ごとの台本、クレジット消費量が返ります。

言語は zh または en です。

FlowSpeech 生成

テキストまたは URL を、単一話者のナレーションに変換します。

  • smart モードは元の内容に AI による推敲を加え、direct モードは内容をそのまま読み上げます。
  • ソースは text(10 文字以上)または url
  • 話者はちょうど 1 人です。
  • ステータスのポーリングでは、タイトル、アウトライン、カバー画像、音声 URL、字幕、ナレーション台本、クレジット消費量が返ります。

話者の検索

生成する前にボイスライブラリを確認できます。

  • 利用可能な話者を一覧表示し、言語で絞り込むこともできます。
  • 各話者は speakerId、名前、言語、性別、デモ音声リンク、ボイスプロファイル(音の高さ、速度、特徴、スタイル、シーン、アクセント)を持ちます。
  • 返ってきた speakerId を、生成ツールの speakerIds / speakerId の入力に使用します。

アカウントとクレジット

生成する前にサブスクリプションと残高を確認します。

  • プランの詳細、更新ステータス、サブスクリプションの開始日 / 有効期限。
  • 月次・永久・期間限定の区分ごとの利用可能クレジットと総クレジット、および totalAvailableCredits

クレジットの消費量はツールごとに固定ではありません。生成前にコストを見積もるには、OpenAPI リファレンス の該当する */estimate-credits エンドポイントを使用し、get_user_subscription ツールで現在の残高を確認してください。

トランスポート

server はデフォルトで stdio で動作します — すべての MCP クライアント(Claude Desktop、Cursor など)が標準で使用するモードです。リモート環境や共有環境では HTTP モードで実行でき、ストリーミング対応の HTTP エンドポイント(/mcp)と Server-Sent Events エンドポイント(/sse)の両方を公開します。詳しくはトランスポートモードを参照してください。

次のステップ

このページの内容