이미지 생성
텍스트 프롬프트로 AI 이미지를 생성합니다. 참조 이미지는 선택 사항이며, pro와 flash 모델 중에서 고르고 지원되는 화면 비율을 자유롭게 지정할 수 있습니다.
텍스트 설명으로 AI 이미지를 생성합니다. 품질이 더 좋은 pro 모델과 더 빠르고 저렴한 flash 모델
중에서 고르고, 해상도와 화면 비율을 정하고, 원하면 스타일 참고용 참조 이미지를 함께 넘길 수
있습니다. 이미지는 로컬 파일로 반환되거나 대화 안에 인라인으로 표시됩니다.
트리거
/image-gen으로 이 skill을 호출하거나, 다음 문구 중 아무거나 사용하세요:
| 문구 | 언어 |
|---|---|
generate an image / generate image | 영어 |
draw / visualize / create picture | 영어 |
生成图片 / 画一张 | 중국어 |
AI图 / 配图 | 중국어 |
사용하려면 ListenHub Skills가 설치되어 있어야 합니다 — 시작하기를 참고하세요.
빠른 예시
Generate an image: cyberpunk city at night, 16:9, 2KAI가 한 번에 하나씩 질문해 원하는 조건을 수집하고, 확인용으로 요약해 보여 준 다음 이미지를 생성합니다.
파라미터
| 파라미터 | 선택지 | 기본값 |
|---|---|---|
| 모델 | 🍌 pro(gemini-3-pro-image, 품질이 더 좋음, 권장), ⚡️ flash(gemini-3.1-flash-image, 더 빠르고 저렴, 극단적인 비율 사용 가능) | — |
| 해상도 | 1K, 2K(권장), 4K | — |
| 화면 비율 | 16:9, 1:1, 9:16, 2:3, 3:2, 3:4, 4:3, 21:9. flash는 1:4, 4:1, 1:8, 8:1도 지원 | — |
| 참조 이미지 | 최대 5장, 로컬 파일 또는 이미지 URL로 지정 | 없음 |
모델 고르기
두 모델 모두 Google Gemini 이미지 모델입니다. 품질과 속도, 그리고 어떤 화면 비율이 필요한지를 기준으로 고르세요.
| 모델 | 모델 ID | 이럴 때 쓰세요 |
|---|---|---|
🍌 pro | gemini-3-pro-image | 가장 높은 품질과 디테일을 원할 때. 권장 기본값입니다. |
⚡️ flash | gemini-3.1-flash-image | 더 빠르고 저렴한 생성을 원하거나, 극단적인 화면 비율(1:4, 4:1, 1:8, 8:1)이 필요할 때. |
네 가지 극단적인 비율 — 1:4(좁은 세로형), 4:1(넓은 가로형), 1:8(극단적인 세로형),
8:1(파노라마) — 은 flash 모델에서만 쓸 수 있습니다. 여덟 가지 표준 비율은 두 모델 모두에서
동작합니다.
크레딧 비용을 하드코딩하지 마세요 — 모델, 해상도, 계정에 따라 달라집니다. 생성 전에 비용을
확인하려면 estimate-credits 엔드포인트를 참고하세요.
좋은 프롬프트 쓰기
좋은 프롬프트는 다음 요소를 담고 있습니다:
- 주제(Subject) — 이미지에 무엇이 담기는지
- 스타일(Style) — 미술 양식이나 시각적 처리
- 구도(Composition) — 요소들이 어떻게 배치되는지
- 조명/분위기(Lighting/Mood) — 공기감과 시간대
- 품질(Quality) — 디테일 수준과 렌더링 품질
예시
기본:
a cat sitting on a windowsill더 나은 예:
a fluffy orange tabby cat sitting on a sunny windowsill, warm afternoon light, cozy interior, highly detailed, photorealistic스타일 키워드
| 스타일 | 키워드 |
|---|---|
| 사실적 | photorealistic, highly detailed, 8K, professional photography |
| 사이버펑크 | neon lights, futuristic, dystopian, rain-slicked streets |
| 수묵화 | Chinese ink painting, traditional art style, brush strokes |
| 수채화 | watercolor painting, soft edges, flowing colors |
| 애니메이션 | anime style, Japanese animation, cel shading |
| 미니멀 | minimalist, clean lines, simple composition, white space |
프롬프트는 항상 영어로 쓰세요 — 이미지 모델은 영어 설명으로 학습되어 있습니다. 영어가 아닌 언어(한국어 등)로 설명하면 AI가 자동으로 번역합니다.
프롬프트 보강
AI는 기본적으로 프롬프트를 그대로 전달합니다. 다음 조건일 때만 프롬프트 보강을 제안합니다:
- 프롬프트가 아주 짧고(단어 몇 개), 그리고
- 원문 그대로 생성해 달라고 요청하지 않았을 때.
보강을 수락하면 AI가 스타일, 조명, 구도 디테일을 더한 뒤 제출 전에 확장된 프롬프트를 보여 줍니다. 예를 들어 "cyberpunk"는 "neon lights, futuristic, dystopian, rain-slicked streets"가 됩니다.
이미 길거나 자세하거나 구조가 잡힌 프롬프트는 AI가 절대 고쳐 쓰지 않습니다 — 숙련된 사용자로 간주하기 때문입니다. "이 프롬프트를 그대로 써 줘" 같은 말을 하면 프롬프트를 적힌 그대로 둡니다.
참조 이미지
참조 이미지는 내용이 아니라 스타일에 대해 AI를 안내합니다. 이미지에 무엇이 나타날지는 여전히 프롬프트가 결정합니다. 참조는 최대 5장까지 넘길 수 있고, 한 요청 안에서 로컬 파일과 URL을 섞어 써도 됩니다.
지원 포맷: jpg, png, webp, gif. 파일당 최대 10 MB.
로컬 파일 사용하기
이 skill은 로컬 파일 경로를 그대로 받습니다. AI가 참조 이미지를 물어볼 때 경로(예: ./sketch.png)를
알려 주면 AI가 파일을 대신 업로드합니다. 이미지 호스팅은 필요 없습니다.
이미지 URL 사용하기
- 참조 이미지를 이미지 호스팅 서비스에 업로드하세요(imgbb.com, sm.ms, postimages.org)
- 이미지 직접 URL을 복사하세요(
.jpg,.png,.webp,.gif로 끝나는 주소) - AI가 참조 이미지를 물어볼 때 그 URL을 알려 주세요
같은 요청 안에서 로컬 파일과 URL을 섞어 쓸 수 있습니다 — 예를 들어 로컬 스케치 하나에 호스팅된 사진 하나를 더하는 식으로요.
Base64 인라인 데이터 사용하기(API)
이미지 생성 API를 직접 호출할 때는
inlineData 필드를 통해 base64로 인코딩한 데이터 형태로 참조 이미지를 넘길 수도 있습니다 — 이미지
호스팅이 필요 없습니다. 이미지를 이미 메모리에 들고 있는 프로그래밍 워크플로에서 유용합니다.
참조 이미지마다 fileData(URL)와 inlineData(base64) 중 정확히 하나만 써야 하며, 둘 다 지정할 수는
없습니다. 요청 형식과 코드 예시는 API 레퍼런스를
참고하세요.
출력
출력 동작은 설정할 때 지정한 outputMode를 따릅니다:
inline(기본값) — 이미지가 대화 안에 바로 표시됩니다download— 현재 프로젝트의.listenhub/image-gen/YYYY-MM-DD-{id}/에 저장됩니다both— 인라인으로 표시하고 로컬에도 저장합니다
출력 모드는 AI가 현재 설정을 보여 줄 때 "다시 설정해 줘"라고 말하면 언제든 바꿀 수 있습니다.
API 레퍼런스
엔드포인트 상세, 요청 파라미터, provider/model 매트릭스, 코드 예시는 이미지 생성 API 레퍼런스를 참고하세요.