ガイド
ベストプラクティス
より良い結果を得るためのヒント — プロンプトの書き方、品質の最適化、よくあるパターン。
これらのヒントは、ListenHub Skills からより高品質な結果を得るのに役立ちます。
一般的なヒント
具体的に書く
与えるコンテキストが多いほど、出力は良くなります。
| 曖昧 | 具体的 |
|---|---|
| 「ポッドキャストを作って」 | 「量子コンピューティングについて、英語で、2 人の話者で深掘りするポッドキャストを作って」 |
| 「画像を生成して」 | 「画像を生成して:コーヒーショップ向けのミニマルなロゴデザイン、1:1、2K」 |
| 「これを読んで」 | 「この記事を英語で、direct モードで読み上げて」 |
言語は早めに指定する
特定の言語でコンテンツがほしい場合は、最初に伝えてください。AI は入力から言語を自動判別しますが、明示したほうが確実です。
Make a podcast about AI trends, in English重要なコンテンツには 2 段階生成を使う
大事なコンテンツでは、2 段階生成を使って最終出力の前に確認・調整してください:
- ポッドキャスト:「ポッドキャストを作って、まず台本を確認させて」
- 解説動画:まず「テキストのみ」をリクエストして確認し、そのうえで動画を生成する
ポッドキャストのヒント
- ニュースや要約には Quick モード、教育コンテンツには Deep モード
- Debate モードは、賛否が分かれるトピックや両論あるトピックで最も効果を発揮します
- URL を参考資料として渡すと、より裏付けのある事実に即したコンテンツになります
- 2 段階生成なら、長い台本を圧縮したり、トーンを調整したりできます
画像のヒント
- 最良の結果を得るにはプロンプトを英語で書く(モデルは英語で学習されています)
- スタイルのキーワードを入れる:"photorealistic"、"watercolor"、"minimalist"
- 画質の修飾語を足す:"highly detailed"、"8K"、"cinematic composition"
- 複数回の生成でスタイルを揃えたいときは参考画像を使う
- まずは 2K 解像度から — 画質と生成速度のバランスが取れています
音声合成のヒント
- 体裁の整ったテキスト(記事、準備済みのコンテンツ)には direct モードを使う
- 下書きやメモには smart モードを使う
- 複数話者のスクリプトでは、自然な文の切れ目でセグメントを分ける
- 長いコンテンツではテキスト入力より URL 入力のほうが適しています(10,000 文字の上限を回避できます)
コンテンツ抽出のヒント
- URL は渡す前に整理する — トラッキングパラメータ(
utm_*、vd_source=)を取り除く - Twitter/X のプロフィールでは取得件数を指定する:「直近 50 件のツイートを取得」
- 全文ではなく要点だけが必要なときは
summarizeを有効にする - URL ベースのコンテンツでは、他の Skill の前処理ステップとして使う
トラブルシューティング
| 症状 | 対処 |
|---|---|
| 生成が止まっているように見える | 最大 10 分待つ — 複雑なコンテンツには時間がかかります |
| 音声の品質が良くない | 別の話者ボイスを試す |
| 出力の言語が違う | プロンプトで言語を明示的に指定する |
| API キーのエラー | API キー設定 でキーを確認し直す |
| 画像プロンプトが英語以外 | AI が自動で翻訳するはずです。されない場合は英語で書いてください |
その他の問題については ヘルプと FAQ ページを参照してください。