Ferramentas de IA · Áudio · Vídeo · Imagem · Seedance 2.0 · Nano Banana
Comece com um tema, documento, link, imagem, gravação ou roteiro pronto. As ferramentas com voz compartilham a biblioteca da ListenHub, e cada página de vídeo mostra apenas os modelos compatíveis com o tipo de entrada.
Gere vídeo a partir de um roteiro, uma foto ou um clipe de referência.
Vídeo explicativoÁudioCenas e narração construídas juntas a partir de um tema.
Descreva uma imagem e edite só o que não gostou
SlidesVídeoGere uma apresentação, com narração se quiser.
O Podcast IA transforma um tema, um documento ou um link em um episódio pronto, com um apresentador ou dois. Se o texto já está escrito, o Texto para voz lê como está ou depois de reescrever em linguagem falada. Vozes múltiplas divide um roteiro de diálogo e dá uma voz a cada personagem, e a Voz IA é a página para quando o que importa é o tom, a emoção e o ritmo. Todas exportam áudio com legendas SRT; a Voz IA exporta só áudio.
Na dúvida, comece pelo Vídeo IA: ele aceita um roteiro, uma imagem parada ou material de referência e troca de modelo no mesmo editor. O Vídeo explicativo é a escolha quando é preciso explicar algo, porque as cenas e a narração são construídas juntas. Gerador de anúncios, Vídeo promocional, Transferência de movimento e Sincronia labial fazem uma coisa só cada um, com modelo fixo.
A Imagem IA gera a partir de uma descrição ou de até cinco imagens de referência; quando algo sai errado, você seleciona aquela área, descreve a mudança e só ali é refeito, e o resultado fica salvo como uma versão nova sem apagar a anterior. Slides monta a apresentação com conteúdo e roteiro de narração em cada página e exporta PPTX e PDF, além de vídeo, áudio e SRT quando a narração está ligada.
Grave ou envie uma amostra de 25 a 35 segundos na Clonagem de voz e essa voz passa a aparecer no seletor de Podcast IA, Texto para voz, Slides e Vídeo explicativo, e também pode ser escolhida em Voz IA e Vozes múltiplas. As ferramentas de vídeo não usam voz clonada.
As ferramentas são agrupadas por tipo de resultado. Áudio: Podcast IA, Texto para voz, Clonagem de voz, Voz IA e Vozes múltiplas. Vídeo: Vídeo IA, Vídeo explicativo, Texto para vídeo, Imagem para vídeo, Referência para vídeo, Gerador de anúncios, Vídeo promocional, Transferência de movimento e Sincronia labial. Imagem: Imagem IA e Slides.
Uma voz criada na Clonagem de voz aparece no seletor de Podcast IA, Texto para voz, Slides e Vídeo explicativo, e também pode ser escolhida em Voz IA e Vozes múltiplas. As ferramentas de vídeo não usam voz clonada. A biblioteca de vozes é a mesma em tudo que fala e cada voz pode ser ouvida de graça.
São dois níveis. Texto para voz, Vozes múltiplas, Voz IA e Clonagem de voz funcionam em 12 idiomas: inglês, mandarim, japonês, espanhol, português, francês, alemão, turco, coreano, italiano, tailandês e vietnamita. Podcast IA, Slides e Vídeo explicativo geram em inglês, mandarim e japonês.
Depende do que você já tem. Texto para vídeo parte só do que você escreve. Imagem para vídeo usa uma foto como quadro inicial, e uma segunda foto como quadro final vira uma transição. Referência para vídeo serve quando a referência precisa definir a pessoa, o produto ou o estilo, e o prompt decide como a câmera se move; referências e quadros ficam em páginas separadas. Essas três chegam a 15 segundos. O Gerador de anúncios começa em 30 segundos, o Vídeo promocional em 20, com opções de 15 e 30, e Transferência de movimento e Sincronia labial seguem a duração do clipe enviado.
No vídeo dá para alternar Seedance 2.0 Pro, Seedance 2.0 Fast, PixVerse e HappyHorse no mesmo editor: cada página lista só os modelos que aceitam aquele material e cada modelo mostra só as durações e proporções que suporta. O Seedance 2.5 não aparece atualmente no menu de modelos. O Gerador de anúncios usa o agente de anúncios PixVerse, o Vídeo promocional o agente promocional PixVerse, e Transferência de movimento e Sincronia labial usam PixVerse. A Imagem IA reúne Nano Banana, GPT-Image-2 e Seedream 5.0 Pro em um editor, e a Voz IA roda em seed-audio.
As ferramentas que falam exportam áudio com legendas SRT, e a Voz IA só áudio. Slides exporta PPTX e PDF, além de vídeo, áudio e SRT quando a narração está ligada. As de vídeo baixam o clipe pronto e a Imagem IA baixa o arquivo original. Paga-se em créditos: o custo depende do modelo, da duração e da qualidade, e o número exato aparece ao lado do botão de gerar antes de você confirmar.