AI 音楽
Mureka による AI 音楽の生成・リミックス・延長・解析 — 楽曲、インストゥルメンタル、サウンドトラック、ステム、歌詞。
プロンプトや歌詞からオリジナルの AI 音楽を生成し、既存の楽曲をリミックスし、画像や動画に音楽を付け、単一トラックを分離し、音声を解析します — すべて listenhub music CLI を通じて Mureka プロバイダーが処理します。
トリガー
/music でこの Skill を呼び出すか、次のいずれかのフレーズを使用します:
| フレーズ | 言語 |
|---|---|
music / generate music / compose | 英語 |
create a song / cover / remix | 英語 |
instrumental / soundtrack / stem | 英語 |
recognize lyrics / extend | 英語 |
音乐 / 生成音乐 / 作曲 / 做一首歌 | 中国語 |
翻唱 / 混音 / 续写 / 纯音乐 | 中国語 |
配乐 / 分轨 / 识别歌词 | 中国語 |
ListenHub Skills のインストールが必要です — はじめに を参照してください。
この Skill は話者を使用しません — 音楽生成に話者の選択はありません。
簡単な例
Make a song about a summer evening by the seaAI が使用する機能とパラメータをあなたと確認したうえでジョブを送信し、トラックが完成したら通知します。再生リンク、長さ、クレジット消費が得られ、出力モードが download または both に設定されている場合はローカルへのダウンロードも行われます。
機能
この Skill は 2 つのグループに分かれます:生成コマンドは非同期で実行され、ポーリング用のタスクを返します。解析コマンドは同期で実行され、同じ呼び出しの中で結果を返します。
generate — テキストや歌詞から新しい楽曲を生成します。prompt と lyrics の少なくとも一方が必須です。style、title、model、インストゥルメンタルの切り替え、クローンした vocal-id は任意です。非同期。
remix — 既存の楽曲と新しい歌詞から、作り直した楽曲を生成します。入力ソースはちょうど 1 つ指定します:音声ファイル、音声 URL、または Mureka の provider-song-id です。lyrics と prompt はどちらも必須です。style、title、model は任意です。非同期。
instrumental — ボーカルなしの純粋なインストゥルメンタルを生成します。prompt または reference-audio ファイルのうち、ちょうど 1 つを指定します。title、model は任意です。非同期。
soundtrack — 画像または動画に合わせた音楽を生成します。image または video のうち、ちょうど 1 つを指定します。prompt、title、model は任意です。非同期。
track — 楽曲から単一の楽器トラックやボーカルトラックを分離、または生成します。入力ソース(音声ファイルまたは provider-song-id)をちょうど 1 つと、generate-type を指定します。タイプが Vocals の場合は lyrics が必須です。prompt、vocal-gender、および秒単位の generate-start/generate-end の範囲は任意です。非同期。
extend — 既存の楽曲を長くします。入力ソース(音声ファイルまたは provider-song-id)を 1 つ指定します。どのように続けるかを説明する prompt と model は任意です。非同期。
recognize — 音声ファイルから、行単位のタイムスタンプ付きで歌詞を抽出します。同期 — 結果はすぐに返ります。
describe — 音声ファイルを解析し、説明、タグ、ジャンル、楽器を返します。同期 — 結果はすぐに返ります。
stem — 楽曲を分離したステムに分割し、ZIP のダウンロード URL を返します。分離モデル(audio-separation-1 または audio-separation-2)を選択します。同期 — 結果はすぐに返ります。
cover という機能も存在しますが非推奨です — 旧来の cover フローが特に必要でない限り、代わりに remix を使ってください。
タスク管理用のコマンドは 2 つ、いつでも利用できます:list は最近のタスクを表示し、get <taskId> は単一タスクのステータスまたは結果を返します。
モデル
生成コマンドは model パラメータを受け付けます。デフォルトは auto で、サービス側がモデルを選択します。
| モデル | 備考 |
|---|---|
auto | デフォルト — サービスがモデルを選択 |
mureka-7.6 | Mureka 7.6 |
mureka-8 | Mureka 8 |
mureka-9 | Mureka 9 |
mureka-o2 | Mureka o2 |
解析は異なります。stem コマンドは代わりに分離モデル — audio-separation-1 または audio-separation-2 — を受け取ります。recognize と describe コマンドはモデルを受け取りません。
パラメータ
パラメータは機能ごとに適用されます。各コマンドが必要とするものだけを指定してください。AI が必須の入力を尋ね、任意の項目を提案します。
| パラメータ | 対象 | 備考 |
|---|---|---|
prompt | generate, remix, instrumental, soundtrack, track, extend | 音楽や方向性を説明する自由記述テキスト |
lyrics | generate, remix, track(Vocals のみ) | 楽曲の歌詞 |
style | generate, remix | ジャンルやムード(例:city pop) |
title | generate, remix, instrumental, soundtrack | トラックのタイトル。省略時は自動生成 |
model | 生成コマンド | 上記モデルのいずれか。デフォルトは auto |
instrumental | generate | ボーカルをオフにする |
vocal-id | generate | クローンしたボイスの id |
audio / audio-url / provider-song-id | remix, track, extend | 入力する楽曲。ちょうど 1 つを指定 |
reference-audio | instrumental | 参考音声ファイル(prompt の代替) |
image / video | soundtrack | ソースメディア。ちょうど 1 つを指定 |
generate-type | track | Vocals、Instrumental、Drums、Bass、Guitar、Keyboard、Percussion、Strings、Synth、FX、Brass、Woodwinds のいずれか |
vocal-gender | track | male または female |
generate-start / generate-end | track | 秒単位の時間範囲 |
ファイル制限
入力ファイルはすべて 10 MB が上限です。タイプごとの対応フォーマット:
| タイプ | フォーマット |
|---|---|
| 音声 | mp3、m4a(track コマンドは wav にも対応) |
| 画像 | jpg、jpeg、png、webp |
| 動画 | mp4、mov、avi、mkv、webm |
コマンドが対応している場合は、ローカルファイルの代わりに URL を渡すこともできます。CLI が送信時に検証します。
音楽生成には時間がかかります — 1 トラックあたりおよそ 5〜10 分を見込んでください。AI はバックグラウンドでジョブを送信し、完了時に通知します。タスク id しか手元にない場合は、listenhub music get <taskId> --json で進捗を確認するか、listenhub music list --json で一覧を参照してください。
出力
出力の挙動は、設定時に指定した outputMode に従います:
inlineまたはboth— 音声 URL がクリック可能な再生リンクとして、タイトル、長さ、クレジット消費と併せて表示されます。downloadまたはboth— ファイルはカレントディレクトリにも、トピックに基づいた分かりやすい名前(例:summer-breeze.mp3)で保存されます。名前の重複は自動的に回避されます。
stem の場合、結果は 1 つ以上の ZIP ダウンロード URL です。download または both モードでは、それらがカレントディレクトリに取得されます。recognize と describe の場合、結果は会話内にそのまま表示されます。
完了した各タスクは creditCost を報告します。クレジットを見積もる、または確認するには、Music API リファレンス のクレジットに関する記載を参照してください。残高は GET /v1/user/subscription で確認できます。
CLI コマンド
この Skill は listenhub music コマンドグループを実行します。基本的な形は次のとおりです:
# Generate a song (async — polls until ready)
listenhub music generate --prompt "upbeat summer pop about the sea" --json
# Remix an existing file with new lyrics
listenhub music remix --audio demo.mp3 --lyrics "..." --prompt "rework as city pop" --json
# Pure instrumental
listenhub music instrumental --prompt "electronic track for a game intro" --json
# Soundtrack for a video
listenhub music soundtrack --video clip.mp4 --prompt "tense, suspenseful score" --json
# Analyze audio (sync)
listenhub music recognize --audio song.mp3 --json
listenhub music describe --audio song.mp3 --json
listenhub music stem --audio track.mp3 --model audio-separation-2 --json
# Task management
listenhub music list --json
listenhub music get <taskId> --jsonグローバルフラグも利用できます:機械可読な出力には --json / -j、ポーリングを省略するには --no-wait、その上限時間を指定するには --timeout <s> を使います。
API リファレンス
エンドポイントのパス、リクエストパラメータ、レスポンスフィールド、クレジットの扱いについては Music API リファレンス を参照してください。