OpenAPI コマンド
すべての `listenhub openapi` コマンドのリファレンス — スクリプトと CI 向けの API キーのネームスペース。
listenhub openapi ネームスペースでは、すべてのコマンドが OAuth ログインではなく API キーで認証されます。環境を自分で管理でき、対話的なブラウザフローよりも長期間有効な認証情報が欲しいサーバーや CI で使ってください。
始める前に、キーを利用できるようにします — LISTENHUB_API_KEY を設定するか、listenhub openapi config set-key で保存します。認証情報の保存場所と CLI の解決順序は 認証 を参照してください。
export LISTENHUB_API_KEY="lh_sk_..."
listenhub openapi speakers list --language en本ページの共通仕様
このネームスペースのすべてのコマンドは、同じ挙動を共有します:
- 出力。 デフォルトは人が読める形式のテキストです。
--json/-jは機械可読な JSON をstdoutに出力します(エラーはstderr)。JSON はjqにパイプできます。 - 非同期の作成。 生成を開始するコマンドはジョブを送信したあと、終了状態に達するまでポーリングし、スピナーを表示します。ポーリングの間隔は 10 秒です。
--no-waitは ID を即座に返して0で終了します。--timeout <seconds>は待機時間の上限を決めます(デフォルトはコマンドごとに異なり、以下の各グループに記載しています)。 - 終了コード。
0成功、1エラー、2認証、3タイムアウト。 - クレジット。 生成はクレジットを消費します。作成する前に該当する
estimateコマンドを使い、残高はlistenhub openapi subscriptionで確認してください。固定のコストを前提にしないでください。
すべてのコマンドが --help / -h を受け付けます。listenhub openapi <group> <command> --help を実行すると、インストール済みのバージョンにおける正確なフラグを確認できます。
config
保存された API キーを管理します。CLI はまず LISTENHUB_API_KEY を読み、次に set-key が書き込んだファイルを読みます。
| コマンド | 説明 |
|---|---|
config set-key | キーの入力を求め、~/.config/listenhub/openapi.json(モード 0600)に保存します。キーは lh_sk_ で始まる必要があります。 |
config show | 設定済みのキー(マスク済み)とその取得元(env または file)を表示します。--json を追加できます。何も設定されていない場合は 1 で終了します。 |
config clear | 保存されたキーのファイルを削除します。 |
listenhub openapi config set-key
listenhub openapi config show --jsonspeakers
アカウントで利用できるボイスを一覧します。ID 列が、作成系コマンドに渡す speakerId です。
| コマンド | オプション | 説明 |
|---|---|---|
speakers list | --language <lang>、--json | スピーカーを一覧します。言語で絞り込めます。 |
listenhub openapi speakers list --language enName、ID、Gender、Language のテーブルを表示します。
tts、audio-speech、speech
テキストを音声に変換する 3 つの方法です。最初の 2 つはバイナリ音声をファイルにストリーミングし、3 つ目はホストされた音声 URL を返します。
| コマンド | 説明 |
|---|---|
tts | テキスト読み上げ。ローカルファイルにストリーミングします。 |
audio-speech | tts と同じ機能を、OpenAI の /v1/audio/speech 互換のルートで提供します。 |
speech | 音声を作成し、ホストされた audioUrl を返します(あわせて再生時間、クレジット、利用できる場合は字幕も返します)。 |
tts と audio-speech は以下のオプションを共有します:
| オプション | デフォルト | 説明 |
|---|---|---|
--text <text> | 必須 | 変換するテキスト。 |
--voice <speakerId> | 必須 | スピーカー ID。 |
--output <file> | 必須 | 出力ファイルのパス。 |
--format <format> | mp3 | mp3、opus、aac、flac、wav、pcm のいずれか。 |
speech のオプション:
| オプション | 説明 |
|---|---|
--script <content> | スクリプトのテキスト(必須)。 |
--speaker-id <id> | スピーカー ID(必須)。 |
--json、-j | JSON で出力します。 |
# Stream an MP3 to disk
listenhub openapi tts \
--text "Welcome to ListenHub." \
--voice <speaker-id> \
--output welcome.mp3
# Get a hosted audio URL instead
listenhub openapi speech --script "Welcome to ListenHub." --speaker-id <speaker-id>flow-speech
Flow Speech は、参照ソースやスクリプトをナレーション付きのエピソードに変換します。作成系コマンドは processStatus が success になるまでポーリングします。--timeout のデフォルトは 300 秒です。
| コマンド | 説明 |
|---|---|
flow-speech create | --source-url / --source-text からエピソードを作成します。 |
flow-speech get <episodeId> | エピソードの詳細を取得します。 |
flow-speech tts | スクリプトから直接エピソードを作成します(ソース抽出は行いません)。 |
flow-speech text-stream <episodeId> | 生成されたテキストを SSE でストリーミングします。 |
flow-speech create のオプション:
| オプション | デフォルト | 説明 |
|---|---|---|
--source-url <url> | — | 参照 URL。繰り返し可。 |
--source-text <text> | — | 参照テキスト。繰り返し可。 |
--speaker-id <id> | 必須 | スピーカー ID。繰り返し可。少なくとも 1 つ必要です。 |
--mode <mode> | smart | smart または direct。 |
--lang <lang> | 自動 | 言語コード。 |
--no-wait | — | ポーリングせずにエピソード ID を返します。 |
--timeout <seconds> | 300 | ポーリングのタイムアウト。 |
--json、-j | — | JSON で出力します。 |
--source-url か --source-text が少なくとも 1 つ必要です。
flow-speech tts のオプション:
| オプション | デフォルト | 説明 |
|---|---|---|
--script <content> | 必須 | スクリプトの内容。繰り返し可。少なくとも 1 つ必要です。 |
--speaker-id <id> | 必須 | スピーカー ID。繰り返し可。少なくとも 1 つ必要です。 |
--title <title> | — | エピソードのタイトル。 |
--no-wait、--timeout <seconds>(300)、--json | — | 上記と同じ。 |
スクリプトとスピーカーは位置で対応づけられます。最初の --script は最初の --speaker-id を使い、以降も同様です。スクリプトがスピーカーより多い場合は、最初のスピーカーが再利用されます。
flow-speech text-stream <episodeId> には --event <event> が必要で、値は script または outline です。生の SSE ストリームを stdout に書き出します。
# From a source URL, two voices
listenhub openapi flow-speech create \
--source-url "https://example.com/article" \
--speaker-id <host-id> \
--speaker-id <guest-id>
# Directly from scripts
listenhub openapi flow-speech tts \
--script "Hello and welcome." --speaker-id <host-id> \
--script "Glad to be here." --speaker-id <guest-id> \
--title "Episode 1"listenhub-voice
listenhub-voice-1.0 によるエンドツーエンドの音声生成です — 素のナレーション、効果音、シングルボイスの読み上げ、複数話者の対話、ボイスクローン、画像からの音声生成に対応します。generate はタスクを作成し、status が success になるまでポーリングします(--timeout のデフォルトは 300 秒)。task と tasks は既存のタスクを確認します。
| コマンド | 説明 |
|---|---|
listenhub-voice generate | テキストのスクリプトから音声を生成します。 |
listenhub-voice tasks | 自分のタスクを新しい順に一覧します。 |
listenhub-voice task <taskId> | タスクの詳細を取得します。完了までポーリングすることもできます。 |
listenhub-voice generate のオプション:
| オプション | デフォルト | 説明 |
|---|---|---|
--text <text> | 必須 | スクリプトのテキスト。最大 1400 文字。マルチボイスでは @音频1 / @音频2 で台詞を割り当てます。 |
--voice <spec...> | — | 1–3 個のボイス。それぞれ speaker:<voiceType>(組み込みのプリセット、シングルボイスのみ)または reference:<url>(カスタムの参考音声)です。繰り返すか、スペース区切りで指定すると複数話者の対話になります。--image-url とは排他です。 |
--image-url <url> | — | 画像から音声を生成する際の参考画像 URL。--voice とは排他です。 |
--speech-rate <n> | — | 話速。-50–100。 |
--loudness-rate <n> | — | 音量。-50–100。 |
--pitch-rate <n> | — | ピッチ。-12–12。 |
--format <fmt> | mp3 | 出力形式:mp3、wav、pcm、ogg_opus。 |
--duration-hint <seconds> | — | 目標の長さ。1–110。 |
--watermark | オフ | 音声に電子透かしを追加します。 |
--no-wait、--timeout <seconds>(300)、--json | — | 標準の非同期フラグ。 |
listenhub-voice tasks のオプション:--page <n>(デフォルト 1)、--page-size <n>(デフォルト 20、最大 100)、--status <status>(pending、generating、uploading、success、failed のいずれか)、--keyword <text>、--json。
listenhub-voice task <taskId> は --wait(終了状態までポーリング)、--timeout <seconds>(300)、--json を受け付けます。
# Single built-in voice
listenhub openapi listenhub-voice generate \
--text "Welcome to ListenHub. Here is your daily briefing." \
--voice "speaker:zh_female_warm" \
--duration-hint 20
# Two-voice dialogue (@音频N assigns lines in order)
listenhub openapi listenhub-voice generate \
--text "@音频1 Hi there! @音频2 Hello, how can I help?" \
--voice "reference:https://example.com/host.mp3" \
--voice "speaker:zh_male_calm"
# Image to audio
listenhub openapi listenhub-voice generate \
--text "Describe this scene as a short narrated clip." \
--image-url "https://example.com/scene.jpg"voice-clone
参考音声からボイスをクローンし、そこで生成されたプライベート音声を管理します。create は 1–6 個のローカル音声ファイルをアップロードし、クローンが完了するまでポーリングします。confirm は完了したタスクを再利用可能なボイスに変換し、そのスピーカー ID は tts、speech、audio-speech でそのまま使えます。アップロードモードのみ対応で、対話的な録音フローは Web アプリ側にあります。
クローンには、クローンされる本人の同意が必要です。--consent は同意を得ていることのあなたの宣言であり、これを付けない作成リクエストは API が拒否します。確定はプランの期間ごとのクォータ内であれば無料です。それを超えると 1 回の確定につき 300 クレジットかかり、--use-credits を渡したときにのみ実行されます。
| コマンド | 説明 |
|---|---|
voice-clone create | 参考音声をアップロードし、クローンタスクを作成します。 |
voice-clone get <taskId> | タスクを取得します。--auto-confirm 付きで作成された場合は確定も行います。 |
voice-clone confirm | 完了したタスクをプライベート音声として確定します。 |
voice-clone speakers | プライベート音声を、クォータと残りの確定回数とあわせて一覧します。 |
voice-clone speaker <speakerId> | プライベート音声を 1 件取得します。 |
voice-clone update <speakerId> | ボイスの名前を変更する、または性別を変更します。 |
voice-clone delete <speakerId> | ボイスを削除し、枠を 1 つ解放します。 |
voice-clone create のオプション:
| オプション | デフォルト | 説明 |
|---|---|---|
--file <path...> | 必須 | 1–6 個のローカル参考音声ファイル。 |
--lang <lang> | 必須 | zh、en、ja のいずれか。 |
--consent | オフ | 必須。クローンされる本人の同意を得ていることを宣言します。 |
--auto-confirm | オフ | クローンが完了し次第、ボイスを確定します。--name と --gender が必要です。 |
--name <name> | — | ボイスの名前。最大 50 文字。--auto-confirm と併用する場合は必須。 |
--gender <gender> | — | male、female、other のいずれか。--auto-confirm と併用する場合は必須。 |
--use-credits | オフ | クォータを使い切ったあとの 300 クレジットの課金を承認します。 |
--no-wait、--timeout <seconds>(600)、--json | — | 標準の非同期フラグ。 |
voice-clone confirm は --task-id <id>、--name <name>、--gender <gender>、および任意の --use-credits を受け付けます。voice-clone update <speakerId> は --name と --gender のいずれか(少なくとも 1 つ)を受け付けます。
ポーリングは次の 3 つの状態のいずれかで終わります:クローン失敗(エラーコードとメッセージ)、クローン済みだが未確定(プレビュー URL。自動確定が保存できなかった場合は確定エラーも)、確定済み(スピーカー ID)。
# Two-step: clone, listen, then confirm
listenhub openapi voice-clone create --file ./reference.mp3 --lang en --consent
listenhub openapi voice-clone confirm \
--task-id 6915bde9cca4d3c8ecb3eaf5 --name "My API Voice" --gender female
# One-shot: clone and confirm in the same flow
listenhub openapi voice-clone create \
--file ./part-1.mp3 --file ./part-2.mp3 --lang ja \
--consent --auto-confirm --name "My API Voice" --gender female --use-credits
# Speak with the cloned voice
listenhub openapi speech --script "Hello from my own voice." \
--speaker-id voice-clone-6915bde9cca4d3c8ecb3eaf5
# Manage private voices
listenhub openapi voice-clone speakers
listenhub openapi voice-clone delete 6915c0a2cca4d3c8ecb3eb01podcast
ポッドキャストのエピソードを生成します。テキストと音声を 1 ステップで作ることも、2 つに分けることもできます。分ける場合は、まずテキストコンテンツを生成し、確認またはストリーミングしてから音声を生成します。作成系コマンドの --timeout はデフォルト 300 秒です。
| コマンド | 説明 |
|---|---|
podcast create | --query や参照ソースから、エピソード全体(テキスト + 音声)を生成します。 |
podcast get <episodeId> | エピソードの詳細を取得します。 |
podcast text-content | スクリプトのみを生成し、音声は生成しません。contentStatus が text-success になるまでポーリングします。 |
podcast generate-audio <episodeId> | 既存のテキストエピソードの音声を生成します。contentStatus が audio-success になるまでポーリングします。 |
podcast text-stream <episodeId> | 生成されたテキストを SSE でストリーミングします。 |
podcast create のオプション:
| オプション | デフォルト | 説明 |
|---|---|---|
--query <text> | — | エピソードのトピックまたはプロンプト。 |
--source-url <url> | — | 参照 URL。繰り返し可。 |
--source-text <text> | — | 参照テキスト。繰り返し可。 |
--speaker-id <id> | 必須 | スピーカー ID。繰り返し可。少なくとも 1 つ必要です。2 つ以上渡すとマルチボイスのエピソードになります。 |
--mode <mode> | — | 生成モード。 |
--lang <lang> | 自動 | 言語コード。 |
--no-wait、--timeout <seconds>(300)、--json | — | 標準の非同期フラグ。 |
podcast text-content は同じ参照ソースとスピーカーのオプション(--query、--source-url、--source-text、--speaker-id、--mode)に加えて、非同期フラグを受け付けます。--query、--source-url、--source-text のうち少なくとも 1 つが必要です。
podcast text-stream <episodeId> には --event <event> が必要で、値は script または outline です。
# One-shot: text + audio
listenhub openapi podcast create \
--query "AI agent trends in 2026" \
--speaker-id <host-id> \
--mode quick
# Two-step: text first, then audio
ID=$(listenhub openapi podcast text-content \
--query "Weekly recap" --speaker-id <host-id> --no-wait -j | jq -r '.episodeId')
listenhub openapi podcast text-stream "$ID" --event script
listenhub openapi podcast generate-audio "$ID"storybook
Storybook は解説エピソードとスライドエピソードを、任意で動画付きで生成します。作成は processStatus が success になるまでポーリングします。--timeout のデフォルトは 300 秒です。
| コマンド | 説明 |
|---|---|
storybook create | 参照ソースからエピソードを作成します。 |
storybook get <episodeId> | エピソードの詳細を取得します。 |
storybook generate-video <episodeId> | エピソードの動画生成を開始します。 |
storybook create のオプション:
| オプション | デフォルト | 説明 |
|---|---|---|
--source-url <url> | — | 参照 URL。繰り返し可。 |
--source-text <text> | — | 参照テキスト。繰り返し可。 |
--speaker-id <id> | — | スピーカー ID。繰り返し可。任意。 |
--skip-audio | オフ | 音声なしで生成します。 |
--style <style> | — | Storybook のスタイル。 |
--mode <mode> | info | info、story、slides のいずれか。 |
--lang <lang> | 自動 | 言語コード。 |
--no-wait、--timeout <seconds>(300)、--json | — | 標準の非同期フラグ。 |
listenhub openapi storybook create \
--source-url "https://example.com/explainer" \
--mode slides --skip-audioimage
プロンプトから AI 画像を生成します。参考画像を条件として与えることもできます。--reference はローカルのファイルパスと URL の両方を受け付けます。ローカルファイルは読み込まれてインラインで送信され、URL は参照として渡されます。
| オプション | 説明 |
|---|---|
--prompt <text> | 画像の説明(必須)。 |
--provider <provider> | プロバイダー名(必須)。 |
--model <model> | モデル名。 |
--size <size> | 1K、2K、4K のいずれか。 |
--ratio <ratio> | 16:9、4:3、1:1、3:4、9:16、21:9 のいずれか。 |
--reference <path-or-url> | 参考画像。ローカルパスまたは URL。繰り返し可。 |
--json、-j | JSON で出力します。 |
listenhub openapi image create \
--provider <provider> \
--prompt "A neon-lit city skyline at dusk" \
--ratio 16:9 --size 2Kvideo
AI による動画生成です。このグループには 2 つのインターフェースがあります。汎用の video コマンド(テキスト / 画像 / 参照素材で駆動)と、video pixverse サブコマンド(PixVerse の capability API)です。どちらも status が success になるまでポーリングし、--timeout のデフォルトは 1200 秒で、24 文字の 16 進数のタスク ID を受け取ります。
| コマンド | 説明 |
|---|---|
video create | 生成タスクを作成します。 |
video get <taskId> | タスクの詳細を取得します。 |
video list | タスクを一覧します。 |
video estimate | 作成前にクレジットを見積もります。 |
video pixverse generate | PixVerse のタスクを作成します。 |
video pixverse estimate | PixVerse タスクのクレジットを見積もります。 |
video create
プロンプトは必須で、それ以外のオプションは入力モードを選ぶためのものです。フレームモード(--first-frame / --last-frame)と参照モード(--reference-image / --reference-video / --reference-audio)は排他です。
| オプション | デフォルト | 説明 |
|---|---|---|
--prompt <text> | 必須 | 動画の説明 / プロンプト。 |
--first-frame <url> | — | 先頭フレームの画像 URL。 |
--last-frame <url> | — | 末尾フレームの画像 URL。--first-frame が必要です。 |
--reference-image <url> | — | 参考画像 URL。繰り返し可、最大 9。 |
--reference-video <url> | — | 参考動画 URL。繰り返し可、最大 3。--input-video-duration が必要です。 |
--reference-audio <url> | — | 参考音声 URL。繰り返し可、最大 3。--reference-image または --reference-video が必要です。 |
--input-video-duration <seconds> | — | 入力動画の長さ。2–15。--reference-video と併用する場合は必須。 |
--model <model> | — | モデル名。例:doubao-seedance-2-pro。 |
--resolution <res> | — | 480p、720p、1080p のいずれか。 |
--ratio <ratio> | — | 16:9、4:3、1:1、3:4、9:16、21:9 のいずれか。 |
--duration <seconds> | — | 出力の長さ。4–15。 |
--no-generate-audio | 音声オン | 音声生成を無効にします。 |
--seed <number> | — | 乱数シード。-1 から 4294967295。 |
--no-wait、--timeout <seconds>(1200)、--json | — | 標準の非同期フラグ。 |
# Text to video
listenhub openapi video create \
--prompt "A timelapse of clouds over a mountain range" \
--model doubao-seedance-2-pro \
--resolution 1080p --duration 8
# First/last frame interpolation
listenhub openapi video create \
--prompt "Smooth morph between the two frames" \
--first-frame "https://example.com/a.jpg" \
--last-frame "https://example.com/b.jpg"video list と estimate
video list のオプション:--page <n>(デフォルト 1)、--page-size <n>(デフォルト 20)、--status <status>(pending、generating、uploading、success、failed のいずれか)、--json。
video estimate には --model、--resolution、--duration が必要で、--ratio、--has-video-input、--input-video-duration(--has-video-input を設定した場合は必須)を受け付けます:
listenhub openapi video estimate \
--model doubao-seedance-2-pro --resolution 1080p --duration 8video pixverse
PixVerse は、細かい単位の生成機能(capability)に加えてマーケティング agent を提供します。--capability でいずれかを選びます:
| Capability | 内容 |
|---|---|
text_to_video | テキストプロンプトから生成します。 |
image_to_video | 静止画を動かします。 |
transition | 2 つの素材の間をトランジションします。 |
multi_transition | 複数の素材をまたいでトランジションします。 |
fusion | 複数の入力を 1 つのクリップに融合します。 |
restyle | 既存の PixVerse 動画のスタイルを変更します。 |
mimic | 参考素材の動き / スタイルを模倣します。 |
lip_sync | 音声または TTS から口の動きを駆動します。 |
agent | マーケティング agent(ad_master、promo_mix)。 |
共通の列挙値:
- Model(
--model):pixverse、v6、v5、v4.5(デフォルトpixverse)。 - Language / リージョン(
--language):zh、en(デフォルトen)。 - Quality(
--quality):360p、540p、720p、1080p(デフォルト720p)。 - Aspect ratio(
--aspect-ratio):9:16、16:9、1:1、4:3、3:4(デフォルト16:9)。 - Agent type(
--agent-type、--capability agentと併用):ad_master、promo_mix。
video pixverse generate のオプション:
| オプション | デフォルト | 説明 |
|---|---|---|
--capability <capability> | 必須 | 上記の capability のいずれか。 |
--model <model> | pixverse | モデル。 |
--language <lang> | en | サービスのリージョン。 |
--prompt <text> | — | プロンプト。最大 2048 文字。 |
--quality <quality> | 720p | 出力の品質。 |
--aspect-ratio <ratio> | 16:9 | アスペクト比。 |
--duration <seconds> | 5 | 整数 1–60。 |
--source-task-id <id> | — | 成功済みの過去の PixVerse タスクを再利用します(restyle / lip_sync 用)。 |
--image <url[:duration]> | — | 画像アセット。末尾に任意で :duration を付けられます。繰り返し可、最大 10。 |
--video <url[:duration]> | — | 動画アセット。末尾に任意で :duration を付けられます。繰り返し可、最大 2。 |
--audio <url[:duration]> | — | 音声アセット。末尾に任意で :duration を付けられます。繰り返し可、最大 1。 |
--agent-type <type> | — | ad_master または promo_mix(--capability agent と併用)。 |
--source-video-id <id> | — | PixVerse のソース動画 id(restyle)。 |
--restyle-id <id> | — | PixVerse の restyle id(restyle)。 |
--lip-sync-tts | オフ | リップシンク TTS を有効にします(--capability lip_sync)。 |
--lip-sync-speaker-id <id> | — | リップシンク TTS のスピーカー id。 |
--lip-sync-content <text> | — | リップシンク TTS の内容。 |
--pixverse-json <json> | — | エスケープハッチ:ネストされた pixverse オブジェクトの生の JSON。フラグ由来のフィールドとマージされ、フラグが優先されます。 |
--no-wait、--timeout <seconds>(1200)、--json | — | 標準の非同期フラグ。 |
アセット系のフラグは、末尾に任意で :duration(秒)を付けられます。例:https://example.com/clip.mp4:5。末尾の :<integer> だけが長さとして扱われるため、コロンを含む URL でも問題ありません。
# Lip-sync from TTS
listenhub openapi video pixverse generate \
--capability lip_sync \
--video "https://example.com/face.mp4" \
--lip-sync-tts \
--lip-sync-speaker-id <speaker-id> \
--lip-sync-content "Hi, here's our product update."
# Marketing agent
listenhub openapi video pixverse generate \
--capability agent \
--agent-type ad_master \
--prompt "30-second ad for a noise-cancelling headset" \
--image "https://example.com/product.jpg"video pixverse estimate は --capability(必須)に加えて、--model、--language、--quality、--duration、--agent-type を受け付けます:
listenhub openapi video pixverse estimate \
--capability text_to_video --quality 1080p --duration 5music
Mureka を基盤にした AI 音楽生成です。非同期のコマンド(generate、remix、instrumental、soundtrack、track)は status が success になるまでポーリングします。--timeout のデフォルトは 600 秒です。分析系のコマンド(recognize、describe、stem)は同期的に実行されます。
| コマンド | 説明 |
|---|---|
music generate | プロンプトや歌詞から生成します。 |
music remix [audio] | 既存の曲を新しい歌詞でリミックスします。 |
music instrumental | 単独のインストゥルメンタルを生成します。 |
music soundtrack | 画像または動画から音楽を生成します。 |
music track [audio] | 単一の楽器またはボーカルのトラックを生成します。 |
music recognize | 音声からタイムスタンプ付きの歌詞を認識します。 |
music describe | 音声を分析します:説明、タグ、ジャンル、楽器。 |
music stem | 音声をステムに分離し、ダウンロード URL を返します。 |
music list | 音楽タスクを一覧します。 |
music get <taskId> | タスクの詳細を取得します。 |
生成系コマンド全体で使えるモデルの値:auto、mureka-7.6、mureka-8、mureka-9、mureka-o2。
music generate のオプション:
| オプション | 説明 |
|---|---|
--prompt <text> | 音楽の説明。--prompt と --lyrics のうち少なくとも 1 つが必要です。 |
--lyrics <text> | 曲の歌詞。 |
--style <text> | 音楽のスタイル / 雰囲気。 |
--title <text> | トラックのタイトル。 |
--model <model> | 上記のモデルの値のいずれか。 |
--instrumental | インストゥルメンタルのみ、ボーカルなし。 |
--vocal-id <id> | 再利用可能なボーカル id。 |
--no-wait、--timeout <seconds>(600)、--json | 標準の非同期フラグ。 |
music remix [audio] は、音声を位置引数のファイル、--audio-url <url>、--provider-song-id <id> のいずれかちょうど 1 つで受け取ります。--lyrics と --prompt が必要です。
music instrumental は --prompt か --reference-audio <file>(mp3/m4a、最大 10MB)のちょうど 1 つが必要で、--model を受け付けます。
music soundtrack は --image <file> か --video <file> のちょうど 1 つが必要で、--prompt と --model を受け付けます。
music track [audio] は、音声を位置引数のファイルか --provider-song-id <id>(ちょうど 1 つ)で受け取ります。--generate-type(Vocals、Instrumental、Drums、Bass、Guitar、…)と --prompt が必要で、--generate-type が Vocals の場合は --lyrics も必要です。任意で --vocal-gender <male|female>、--generate-start <seconds>、--generate-end <seconds> を指定できます。
music recognize、music describe、music stem はいずれも --audio <file>(mp3/m4a、最大 10MB)が必要です。music stem はさらに --model(audio-separation-1 または audio-separation-2)を受け付けます。
music list のオプション:--page <n>(デフォルト 1)、--page-size <n>(デフォルト 20)、--status <status>(pending、generating、uploading、success、failed)、--json。
# Generate from a prompt
listenhub openapi music generate \
--prompt "Upbeat synthwave with a driving bassline" --title "Night Drive"
# Separate an mp3 into stems
listenhub openapi music stem --audio track.mp3content
URL から読みやすいコンテンツを抽出します。任意で要約もできます。非同期で、status が completed になるまでポーリングし、--timeout のデフォルトは 300 秒です。
| コマンド | 説明 |
|---|---|
content extract | URL からコンテンツを抽出します。 |
content get <taskId> | 抽出結果を取得します。 |
content extract のオプション:
| オプション | デフォルト | 説明 |
|---|---|---|
--url <url> | 必須 | 抽出元の URL。 |
--summarize | オフ | 抽出したコンテンツを要約します。 |
--max-length <n> | — | コンテンツの最大長。 |
--no-wait、--timeout <seconds>(300)、--json | — | 標準の非同期フラグ。 |
listenhub openapi content extract --url "https://example.com/article" --summarizesubscription
サブスクリプションのプランとクレジット残高を表示します — 利用可能なクレジットの合計、月次配分の使用量 / 総量、永久クレジット、プラン名、有効期限。
| コマンド | オプション | 説明 |
|---|---|---|
subscription | --json | サブスクリプションとクレジットの情報を表示します。 |
listenhub openapi subscription --json