ListenHubSkills

AI 音楽

Mureka による AI 音楽の生成・リミックス・延長・解析 — 楽曲、インストゥルメンタル、サウンドトラック、ステム、歌詞。

プロンプトや歌詞からオリジナルの AI 音楽を生成し、既存の楽曲をリミックスし、画像や動画に音楽を付け、単一トラックを分離し、音声を解析します — すべて listenhub music CLI を通じて Mureka プロバイダーが処理します。

トリガー

/music でこの Skill を呼び出すか、次のいずれかのフレーズを使用します:

フレーズ言語
music / generate music / compose英語
create a song / cover / remix英語
instrumental / soundtrack / stem英語
recognize lyrics / extend英語
音乐 / 生成音乐 / 作曲 / 做一首歌中国語
翻唱 / 混音 / 续写 / 纯音乐中国語
配乐 / 分轨 / 识别歌词中国語

ListenHub Skills のインストールが必要です — はじめに を参照してください。

この Skill は話者を使用しません — 音楽生成に話者の選択はありません。

簡単な例

Make a song about a summer evening by the sea

AI が使用する機能とパラメータをあなたと確認したうえでジョブを送信し、トラックが完成したら通知します。再生リンク、長さ、クレジット消費が得られ、出力モードが download または both に設定されている場合はローカルへのダウンロードも行われます。

機能

この Skill は 2 つのグループに分かれます:生成コマンドは非同期で実行され、ポーリング用のタスクを返します。解析コマンドは同期で実行され、同じ呼び出しの中で結果を返します。

generate — テキストや歌詞から新しい楽曲を生成します。promptlyrics の少なくとも一方が必須です。styletitlemodel、インストゥルメンタルの切り替え、クローンした vocal-id は任意です。非同期。

remix — 既存の楽曲と新しい歌詞から、作り直した楽曲を生成します。入力ソースはちょうど 1 つ指定します:音声ファイル、音声 URL、または Mureka の provider-song-id です。lyricsprompt はどちらも必須です。styletitlemodel は任意です。非同期。

instrumental — ボーカルなしの純粋なインストゥルメンタルを生成します。prompt または reference-audio ファイルのうち、ちょうど 1 つを指定します。titlemodel は任意です。非同期。

soundtrack — 画像または動画に合わせた音楽を生成します。image または video のうち、ちょうど 1 つを指定します。prompttitlemodel は任意です。非同期。

track — 楽曲から単一の楽器トラックやボーカルトラックを分離、または生成します。入力ソース(音声ファイルまたは provider-song-id)をちょうど 1 つと、generate-type を指定します。タイプが Vocals の場合は lyrics が必須です。promptvocal-gender、および秒単位の generate-start/generate-end の範囲は任意です。非同期。

extend — 既存の楽曲を長くします。入力ソース(音声ファイルまたは provider-song-id)を 1 つ指定します。どのように続けるかを説明する promptmodel は任意です。非同期。

recognize — 音声ファイルから、行単位のタイムスタンプ付きで歌詞を抽出します。同期 — 結果はすぐに返ります。

describe — 音声ファイルを解析し、説明、タグ、ジャンル、楽器を返します。同期 — 結果はすぐに返ります。

stem — 楽曲を分離したステムに分割し、ZIP のダウンロード URL を返します。分離モデル(audio-separation-1 または audio-separation-2)を選択します。同期 — 結果はすぐに返ります。

cover という機能も存在しますが非推奨です — 旧来の cover フローが特に必要でない限り、代わりに remix を使ってください。

タスク管理用のコマンドは 2 つ、いつでも利用できます:list は最近のタスクを表示し、get <taskId> は単一タスクのステータスまたは結果を返します。

モデル

生成コマンドは model パラメータを受け付けます。デフォルトは auto で、サービス側がモデルを選択します。

モデル備考
autoデフォルト — サービスがモデルを選択
mureka-7.6Mureka 7.6
mureka-8Mureka 8
mureka-9Mureka 9
mureka-o2Mureka o2

解析は異なります。stem コマンドは代わりに分離モデル — audio-separation-1 または audio-separation-2 — を受け取ります。recognizedescribe コマンドはモデルを受け取りません。

パラメータ

パラメータは機能ごとに適用されます。各コマンドが必要とするものだけを指定してください。AI が必須の入力を尋ね、任意の項目を提案します。

パラメータ対象備考
promptgenerate, remix, instrumental, soundtrack, track, extend音楽や方向性を説明する自由記述テキスト
lyricsgenerate, remix, track(Vocals のみ)楽曲の歌詞
stylegenerate, remixジャンルやムード(例:city pop
titlegenerate, remix, instrumental, soundtrackトラックのタイトル。省略時は自動生成
model生成コマンド上記モデルのいずれか。デフォルトは auto
instrumentalgenerateボーカルをオフにする
vocal-idgenerateクローンしたボイスの id
audio / audio-url / provider-song-idremix, track, extend入力する楽曲。ちょうど 1 つを指定
reference-audioinstrumental参考音声ファイル(prompt の代替)
image / videosoundtrackソースメディア。ちょうど 1 つを指定
generate-typetrackVocalsInstrumentalDrumsBassGuitarKeyboardPercussionStringsSynthFXBrassWoodwinds のいずれか
vocal-gendertrackmale または female
generate-start / generate-endtrack単位の時間範囲

ファイル制限

入力ファイルはすべて 10 MB が上限です。タイプごとの対応フォーマット:

タイプフォーマット
音声mp3m4atrack コマンドは wav にも対応)
画像jpgjpegpngwebp
動画mp4movavimkvwebm

コマンドが対応している場合は、ローカルファイルの代わりに URL を渡すこともできます。CLI が送信時に検証します。

音楽生成には時間がかかります — 1 トラックあたりおよそ 5〜10 分を見込んでください。AI はバックグラウンドでジョブを送信し、完了時に通知します。タスク id しか手元にない場合は、listenhub music get <taskId> --json で進捗を確認するか、listenhub music list --json で一覧を参照してください。

出力

出力の挙動は、設定時に指定した outputMode に従います:

  • inline または both — 音声 URL がクリック可能な再生リンクとして、タイトル、長さ、クレジット消費と併せて表示されます。
  • download または both — ファイルはカレントディレクトリにも、トピックに基づいた分かりやすい名前(例:summer-breeze.mp3)で保存されます。名前の重複は自動的に回避されます。

stem の場合、結果は 1 つ以上の ZIP ダウンロード URL です。download または both モードでは、それらがカレントディレクトリに取得されます。recognizedescribe の場合、結果は会話内にそのまま表示されます。

完了した各タスクは creditCost を報告します。クレジットを見積もる、または確認するには、Music API リファレンス のクレジットに関する記載を参照してください。残高は GET /v1/user/subscription で確認できます。

CLI コマンド

この Skill は listenhub music コマンドグループを実行します。基本的な形は次のとおりです:

# Generate a song (async — polls until ready)
listenhub music generate --prompt "upbeat summer pop about the sea" --json

# Remix an existing file with new lyrics
listenhub music remix --audio demo.mp3 --lyrics "..." --prompt "rework as city pop" --json

# Pure instrumental
listenhub music instrumental --prompt "electronic track for a game intro" --json

# Soundtrack for a video
listenhub music soundtrack --video clip.mp4 --prompt "tense, suspenseful score" --json

# Analyze audio (sync)
listenhub music recognize --audio song.mp3 --json
listenhub music describe  --audio song.mp3 --json
listenhub music stem      --audio track.mp3 --model audio-separation-2 --json

# Task management
listenhub music list --json
listenhub music get <taskId> --json

グローバルフラグも利用できます:機械可読な出力には --json / -j、ポーリングを省略するには --no-wait、その上限時間を指定するには --timeout <s> を使います。

API リファレンス

エンドポイントのパス、リクエストパラメータ、レスポンスフィールド、クレジットの扱いについては Music API リファレンス を参照してください。

このページの内容