홈
오디오5
비디오9
이미지2
전체 도구
애셋
보이스 라이브러리
개발자 문서
블로그
한국어
로그인
앱 다운로드

AI 도구 · 오디오 · 비디오 · 이미지 · Seedance 2.0 · Nano Banana

AI 오디오·영상·이미지 제작 도구

결과물 유형에 따라 도구 선택

주제, 문서, 링크, 이미지, 촬영한 영상 또는 완성된 대본에서 시작할 수 있습니다. 음성 도구는 ListenHub 보이스 라이브러리를 공유하며, 각 영상 페이지에는 해당 입력 형식을 지원하는 모델만 표시됩니다.

  • 팟캐스트, 더빙, 클로닝한 보이스
  • 텍스트·이미지·참고 영상으로 만드는 영상
  • PixVerse 에이전트가 만드는 광고와 홍보 영상
  • 이미지 생성 후 영역만 다시 그리기
  • 내레이션 슬라이드와 해설 영상
오디오비디오이미지
오디오5
AI 팟캐스트

자료를 1인 또는 여러 명이 진행하는 팟캐스트로.

텍스트 음성 변환

텍스트를 음성으로. 다양한 음색과 언어 지원

보이스 클로닝

내 목소리를 복제해 여러 곳에서 다시 사용

시나리오

AI 보이스

같은 대본에서 화자마다 다른 목소리를 배정합니다.

멀티 보이스 더빙

대화 대본을 붙여넣고 화자마다 다른 목소리를 지정하세요

비디오9
AI 영상

대본, 사진, 참고 영상으로 영상을 생성합니다.

해설 영상오디오

하나의 주제에서 장면과 내레이션을 같이 만듭니다.

AI 영상 · 소재별

텍스트로 영상

한 줄만 적으면 영상이 나와요

이미지로 영상

Seedance 풀 성능, 인물 첫 프레임 지원

참조로 영상

Seedance 2.0 풀 성능, 인물 참고 지원

AI 영상 · 다른 목적

광고 생성

제품 사진을 넣으면 세로 광고가 나와요

홍보 영상

내 사진과 내 촬영 소재를 한 편으로

모션 트랜스퍼

내 캐릭터가 그 동작을 그대로 해요

립싱크오디오

화면 속 인물이 새 대사를 말해요

이미지2
AI 이미지

이미지를 설명하고 마음에 들지 않는 부분만 따로 수정

슬라이드비디오

해설을 붙일 수 있는 슬라이드를 생성합니다.

필요한 건 이쪽일지도 몰라요

  • AI 이미지 영상 생성기
  • AI 참고 영상 생성
  • AI 영상 생성기

어떤 도구를 고를까

들려주고 싶다면

AI 팟캐스트는 주제, 문서, 링크를 대본과 음성까지 완성해 한 편으로 만들고 진행자는 한 명 또는 두 명으로 고릅니다. 이미 써 둔 글을 읽히려면 텍스트 음성 변환을 쓰고, 원문 그대로 읽기와 구어체로 다듬어 읽기 중에서 고를 수 있습니다. 대화 대본을 배역별로 나누려면 멀티 보이스 더빙, 톤과 감정, 속도까지 지시하려면 AI 보이스입니다. 모두 오디오 파일과 SRT 자막으로 내보내며 AI 보이스는 오디오만 나옵니다.

보여주고 싶다면

어디서 시작할지 모르겠으면 AI 영상부터 보세요. 대본, 사진, 참고 영상 어느 것이든 출발점이 되고 모델도 같은 편집기에서 바꿉니다. 무언가를 이해시키는 게 목적이면 화면과 내레이션을 함께 짜는 해설 영상이 맞습니다. 목적이 뚜렷하면 광고 생성, 홍보 영상, 모션 트랜스퍼, 립싱크로 바로 가면 됩니다. 이 네 페이지는 모델이 하나로 고정되어 각각 한 가지 일만 합니다.

이미지나 슬라이드가 필요하다면

AI 이미지는 문장이나 참고 이미지(최대 5장)로 만들고, 마음에 들지 않는 부분은 영역을 지정해 바꿀 내용을 적으면 그 자리만 다시 그립니다. 수정본은 원본을 덮어쓰지 않고 별도 버전으로 남습니다. 슬라이드는 자료를 페이지마다 내용과 내레이션 대본이 있는 구성으로 만들고 PPTX와 PDF로, 내레이션을 켜면 영상·오디오·SRT 자막까지 내보냅니다.

내 목소리로 읽히고 싶다면

보이스 클로닝에서 25-35초 샘플을 녹음하거나 올리면 그 보이스가 AI 팟캐스트, 텍스트 음성 변환, 슬라이드, 해설 영상의 보이스 목록에 나타나고 AI 보이스와 멀티 보이스 더빙에서도 고를 수 있습니다. 영상 도구는 클로닝한 보이스를 받지 않습니다.

도구 선택 자주 묻는 질문

ListenHub에는 어떤 도구가 있나요?

도구는 결과물 유형에 따라 분류됩니다. 오디오는 AI 팟캐스트, 텍스트 음성 변환, 보이스 클로닝, AI 보이스, 멀티 보이스 더빙. 비디오는 AI 영상, 해설 영상, 텍스트로 영상, 이미지로 영상, 참조로 영상, 광고 생성, 홍보 영상, 모션 트랜스퍼, 립싱크. 이미지는 AI 이미지와 슬라이드입니다.

클로닝한 보이스는 어떤 도구에서 쓸 수 있나요?

보이스 클로닝으로 만든 보이스는 AI 팟캐스트, 텍스트 음성 변환, 슬라이드, 해설 영상의 보이스 목록에 나타나고 AI 보이스와 멀티 보이스 더빙에서도 고를 수 있습니다. 영상 도구는 클로닝한 보이스를 받지 않습니다. 보이스 라이브러리는 말하는 도구가 함께 쓰며 모든 보이스를 무료로 들어볼 수 있습니다.

지원 언어는 어떻게 되나요?

두 갈래입니다. 텍스트 음성 변환, 멀티 보이스 더빙, AI 보이스, 보이스 클로닝은 12개 언어를 지원합니다(영어, 중국어(표준어), 일본어, 스페인어, 포르투갈어, 프랑스어, 독일어, 튀르키예어, 한국어, 이탈리아어, 태국어, 베트남어). AI 팟캐스트, 슬라이드, 해설 영상은 영어, 중국어(표준어), 일본어로 생성합니다.

영상은 어느 페이지에서 시작하고 길이는 얼마나 되나요?

가진 소재가 정합니다. 글만 있으면 텍스트로 영상. 사진을 첫 프레임으로 쓰려면 이미지로 영상이고, 두 번째 사진을 마지막 프레임으로 넣으면 그 사이 움직임이 만들어져 전환이 됩니다. 인물, 제품, 스타일을 참조로 고정하고 프롬프트로 카메라 움직임을 정하려면 참조로 영상이며, 참조 이미지와 프레임 지정은 페이지가 나뉘어 있습니다. 이 세 페이지는 최대 15초입니다. 광고 생성은 기본 30초, 홍보 영상은 기본 20초에 15초와 30초 선택이 있고, 모션 트랜스퍼와 립싱크는 올린 소재의 길이를 따릅니다.

어떤 모델이 쓰이나요?

영상은 Seedance 2.0 Pro, Seedance 2.0 Fast, PixVerse, HappyHorse를 같은 편집기에서 바꿔 씁니다. 페이지마다 그 입력을 받는 모델만 보이고, 모델마다 지원하는 길이와 화면 비율만 고를 수 있습니다. Seedance 2.5는 현재 모델 메뉴에 표시되지 않습니다. 광고 생성은 PixVerse 광고 에이전트, 홍보 영상은 PixVerse 홍보 에이전트, 모션 트랜스퍼와 립싱크는 PixVerse가 맡습니다. 이미지는 한 편집기에서 Nano Banana, GPT-Image-2, Seedream 5.0 Pro를 쓰고 AI 보이스는 seed-audio로 돌아갑니다.

무엇을 내보낼 수 있고 비용은 어떻게 되나요?

말하는 도구는 오디오 파일과 SRT 자막을 내보내고 AI 보이스는 오디오만 나옵니다. 슬라이드는 PPTX와 PDF, 내레이션을 켜면 영상·오디오·SRT 자막까지 나옵니다. 영상 도구는 완성본을 내려받고 AI 이미지는 원본 파일을 내려받습니다. 비용은 크레딧으로 계산하며 모델과 길이, 화질에 따라 달라지고 정확한 소모량이 생성 버튼 옆에 표시된 뒤 확정됩니다.