ListenHubSkills

이미지 생성

텍스트 프롬프트로 AI 이미지를 생성합니다. 참조 이미지는 선택 사항이며, pro와 flash 모델 중에서 고르고 지원되는 화면 비율을 자유롭게 지정할 수 있습니다.

텍스트 설명으로 AI 이미지를 생성합니다. 품질이 더 좋은 pro 모델과 더 빠르고 저렴한 flash 모델 중에서 고르고, 해상도와 화면 비율을 정하고, 원하면 스타일 참고용 참조 이미지를 함께 넘길 수 있습니다. 이미지는 로컬 파일로 반환되거나 대화 안에 인라인으로 표시됩니다.

트리거

/image-gen으로 이 skill을 호출하거나, 다음 문구 중 아무거나 사용하세요:

문구언어
generate an image / generate image영어
draw / visualize / create picture영어
生成图片 / 画一张중국어
AI图 / 配图중국어

사용하려면 ListenHub Skills가 설치되어 있어야 합니다 — 시작하기를 참고하세요.

빠른 예시

Generate an image: cyberpunk city at night, 16:9, 2K

AI가 한 번에 하나씩 질문해 원하는 조건을 수집하고, 확인용으로 요약해 보여 준 다음 이미지를 생성합니다.

파라미터

파라미터선택지기본값
모델🍌 pro(gemini-3-pro-image, 품질이 더 좋음, 권장), ⚡️ flash(gemini-3.1-flash-image, 더 빠르고 저렴, 극단적인 비율 사용 가능)
해상도1K, 2K(권장), 4K
화면 비율16:9, 1:1, 9:16, 2:3, 3:2, 3:4, 4:3, 21:9. flash1:4, 4:1, 1:8, 8:1도 지원
참조 이미지최대 5장, 로컬 파일 또는 이미지 URL로 지정없음

모델 고르기

두 모델 모두 Google Gemini 이미지 모델입니다. 품질과 속도, 그리고 어떤 화면 비율이 필요한지를 기준으로 고르세요.

모델모델 ID이럴 때 쓰세요
🍌 progemini-3-pro-image가장 높은 품질과 디테일을 원할 때. 권장 기본값입니다.
⚡️ flashgemini-3.1-flash-image더 빠르고 저렴한 생성을 원하거나, 극단적인 화면 비율(1:4, 4:1, 1:8, 8:1)이 필요할 때.

네 가지 극단적인 비율 — 1:4(좁은 세로형), 4:1(넓은 가로형), 1:8(극단적인 세로형), 8:1(파노라마) — 은 flash 모델에서 쓸 수 있습니다. 여덟 가지 표준 비율은 두 모델 모두에서 동작합니다.

크레딧 비용을 하드코딩하지 마세요 — 모델, 해상도, 계정에 따라 달라집니다. 생성 전에 비용을 확인하려면 estimate-credits 엔드포인트를 참고하세요.

좋은 프롬프트 쓰기

좋은 프롬프트는 다음 요소를 담고 있습니다:

  1. 주제(Subject) — 이미지에 무엇이 담기는지
  2. 스타일(Style) — 미술 양식이나 시각적 처리
  3. 구도(Composition) — 요소들이 어떻게 배치되는지
  4. 조명/분위기(Lighting/Mood) — 공기감과 시간대
  5. 품질(Quality) — 디테일 수준과 렌더링 품질

예시

기본:

a cat sitting on a windowsill

더 나은 예:

a fluffy orange tabby cat sitting on a sunny windowsill, warm afternoon light, cozy interior, highly detailed, photorealistic

스타일 키워드

스타일키워드
사실적photorealistic, highly detailed, 8K, professional photography
사이버펑크neon lights, futuristic, dystopian, rain-slicked streets
수묵화Chinese ink painting, traditional art style, brush strokes
수채화watercolor painting, soft edges, flowing colors
애니메이션anime style, Japanese animation, cel shading
미니멀minimalist, clean lines, simple composition, white space

프롬프트는 항상 영어로 쓰세요 — 이미지 모델은 영어 설명으로 학습되어 있습니다. 영어가 아닌 언어(한국어 등)로 설명하면 AI가 자동으로 번역합니다.

프롬프트 보강

AI는 기본적으로 프롬프트를 그대로 전달합니다. 다음 조건일 때만 프롬프트 보강을 제안합니다:

  • 프롬프트가 아주 짧고(단어 몇 개), 그리고
  • 원문 그대로 생성해 달라고 요청하지 않았을 때.

보강을 수락하면 AI가 스타일, 조명, 구도 디테일을 더한 뒤 제출 전에 확장된 프롬프트를 보여 줍니다. 예를 들어 "cyberpunk"는 "neon lights, futuristic, dystopian, rain-slicked streets"가 됩니다.

이미 길거나 자세하거나 구조가 잡힌 프롬프트는 AI가 절대 고쳐 쓰지 않습니다 — 숙련된 사용자로 간주하기 때문입니다. "이 프롬프트를 그대로 써 줘" 같은 말을 하면 프롬프트를 적힌 그대로 둡니다.

참조 이미지

참조 이미지는 내용이 아니라 스타일에 대해 AI를 안내합니다. 이미지에 무엇이 나타날지는 여전히 프롬프트가 결정합니다. 참조는 최대 5장까지 넘길 수 있고, 한 요청 안에서 로컬 파일과 URL을 섞어 써도 됩니다.

지원 포맷: jpg, png, webp, gif. 파일당 최대 10 MB.

로컬 파일 사용하기

이 skill은 로컬 파일 경로를 그대로 받습니다. AI가 참조 이미지를 물어볼 때 경로(예: ./sketch.png)를 알려 주면 AI가 파일을 대신 업로드합니다. 이미지 호스팅은 필요 없습니다.

이미지 URL 사용하기

  1. 참조 이미지를 이미지 호스팅 서비스에 업로드하세요(imgbb.com, sm.ms, postimages.org)
  2. 이미지 직접 URL을 복사하세요(.jpg, .png, .webp, .gif로 끝나는 주소)
  3. AI가 참조 이미지를 물어볼 때 그 URL을 알려 주세요

같은 요청 안에서 로컬 파일과 URL을 섞어 쓸 수 있습니다 — 예를 들어 로컬 스케치 하나에 호스팅된 사진 하나를 더하는 식으로요.

Base64 인라인 데이터 사용하기(API)

이미지 생성 API를 직접 호출할 때는 inlineData 필드를 통해 base64로 인코딩한 데이터 형태로 참조 이미지를 넘길 수도 있습니다 — 이미지 호스팅이 필요 없습니다. 이미지를 이미 메모리에 들고 있는 프로그래밍 워크플로에서 유용합니다.

참조 이미지마다 fileData(URL)와 inlineData(base64) 중 정확히 하나만 써야 하며, 둘 다 지정할 수는 없습니다. 요청 형식과 코드 예시는 API 레퍼런스를 참고하세요.

출력

출력 동작은 설정할 때 지정한 outputMode를 따릅니다:

  • inline(기본값) — 이미지가 대화 안에 바로 표시됩니다
  • download — 현재 프로젝트의 .listenhub/image-gen/YYYY-MM-DD-{id}/에 저장됩니다
  • both — 인라인으로 표시하고 로컬에도 저장합니다

출력 모드는 AI가 현재 설정을 보여 줄 때 "다시 설정해 줘"라고 말하면 언제든 바꿀 수 있습니다.

API 레퍼런스

엔드포인트 상세, 요청 파라미터, provider/model 매트릭스, 코드 예시는 이미지 생성 API 레퍼런스를 참고하세요.

이 페이지의 내용