Inicio
Audio5
Vídeo9
Imagen2
Todas las herramientas
Recursos
Biblioteca de voces
Documentación para desarrolladores
Blog
Español
Iniciar sesión
Descargar la app

Herramientas de IA · Audio · Vídeo · Imagen · Seedance 2.0 · Nano Banana

Herramientas de IA para audio, vídeo e imagen

Elige la herramienta según el resultado

Puedes partir de un tema, documento, enlace, imagen, metraje grabado o un guion terminado. Las herramientas con voz comparten la biblioteca de ListenHub y cada página de vídeo muestra solo los modelos compatibles con su tipo de entrada.

  • Podcasts, locuciones y voz clonada
  • Vídeo desde texto, imagen o referencia
  • Anuncios y promos con los agentes de PixVerse
  • Imágenes que corriges por zonas
  • Diapositivas narradas y vídeos explicativos
AudioVídeoImagen
Audio5
Podcast IA

Convierte un documento en un episodio de pódcast, en solitario o a varias voces.

Texto a voz

Convierte texto en voz, con muchas voces e idiomas

Clonación de voz

Clona tu voz y reutilízala en distintos proyectos

Escenarios

Voz IA

Asigna una voz distinta a cada personaje del mismo guion.

Voces múltiples

Pega tu guion de diálogo y dale a cada personaje su propia voz

Vídeo9
Vídeo IA

Genera vídeo a partir de un guion, una foto o un clip de referencia.

Vídeo explicativoAudio

Escenas y narración, construidas juntas a partir de un tema.

Vídeo IA · Por material

Texto a vídeo

Escribe una frase y sale un vídeo

Imagen a vídeo

Seedance a pleno rendimiento, con primeros fotogramas de personas

Referencia a vídeo

Seedance 2.0 a pleno rendimiento, con referencias de personas

Vídeo IA · Más objetivos

Generador de anuncios

Entran fotos de producto, sale un anuncio vertical

Vídeo promocional

Tus fotos y tu metraje, montados en una sola pieza

Transferencia de movimiento

Tu personaje, haciendo ese movimiento

Sincronización labialAudio

Dale una frase nueva a la persona en pantalla

Imagen2
Imagen IA

Describe una imagen y edita solo lo que no te convenza

DiapositivasVídeo

Genera una presentación, con narración si quieres.

Quizá buscas otra herramienta

  • Generador de vídeo IA a partir de imagen
  • Vídeo IA a partir de referencias
  • Generador de vídeo IA

Cómo elegir la herramienta

Para escuchar

Podcast IA convierte un tema, un documento o un enlace en un episodio terminado, con un presentador o dos. Si el texto ya está escrito, Texto a voz lo lee tal cual o tras reescribirlo en lenguaje hablado. Voces múltiples reparte un guion de diálogo y da una voz a cada personaje, y Voz IA es la página cuando lo que importa es el tono, la emoción y el ritmo. Todas exportan audio con subtítulos SRT; Voz IA exporta solo audio.

Para ver

Si no lo tienes claro, empieza por Vídeo IA: acepta un guion, una imagen fija o metraje de referencia y permite cambiar de modelo en el mismo editor. Vídeo explicativo es la opción cuando hay que explicar algo, porque las escenas y la narración se construyen juntas. Generador de anuncios, Vídeo promocional, Transferencia de movimiento y Sincronización labial hacen una sola cosa cada uno, con un modelo fijo.

Para una imagen o una presentación

Imagen IA genera a partir de una descripción o de hasta cinco imágenes de referencia; si algo falla, seleccionas esa zona, describes el cambio y solo se rehace ahí, y el resultado se guarda como versión nueva sin borrar la anterior. Diapositivas arma una presentación donde cada página tiene contenido y guion de narración, y exporta PPTX y PDF, más vídeo, audio y SRT cuando la narración está activada.

Con tu propia voz

Graba o sube una muestra de 25 a 35 segundos en Clonación de voz y esa voz aparecerá en el selector de Podcast IA, Texto a voz, Diapositivas y Vídeo explicativo, y también podrás elegirla en Voz IA y Voces múltiples. Las herramientas de vídeo no usan voces clonadas.

Preguntas frecuentes sobre las herramientas

¿Qué herramientas hay en ListenHub?

Las herramientas se agrupan por tipo de resultado. Audio: Podcast IA, Texto a voz, Clonación de voz, Voz IA y Voces múltiples. Vídeo: Vídeo IA, Vídeo explicativo, Texto a vídeo, Imagen a vídeo, Referencia a vídeo, Generador de anuncios, Vídeo promocional, Transferencia de movimiento y Sincronización labial. Imagen: Imagen IA y Diapositivas.

¿Puedo usar mi voz clonada en varias herramientas?

Una voz creada en Clonación de voz aparece en el selector de Podcast IA, Texto a voz, Diapositivas y Vídeo explicativo, y también puedes elegirla en Voz IA y Voces múltiples. Las herramientas de vídeo no usan voces clonadas. La biblioteca de voces es la misma para todo lo que habla y cada voz se puede escuchar gratis.

¿En qué idiomas puedo generar?

Hay dos niveles. Texto a voz, Voces múltiples, Voz IA y Clonación de voz trabajan en 12 idiomas: inglés, chino mandarín, japonés, español, portugués, francés, alemán, turco, coreano, italiano, tailandés y vietnamita. Podcast IA, Diapositivas y Vídeo explicativo generan en inglés, chino mandarín y japonés.

¿Por qué página de vídeo empiezo y cuánto puede durar el clip?

Depende de lo que ya tengas. Texto a vídeo parte solo de lo que escribes. Imagen a vídeo toma una imagen fija como primer fotograma, y si añades una segunda como último fotograma obtienes una transición. Referencia a vídeo sirve cuando la referencia debe fijar la persona, el producto o el estilo, y el prompt decide cómo se mueve el plano; referencias y fotogramas viven en páginas distintas. Esas tres llegan a 15 segundos. Generador de anuncios parte de 30 segundos, Vídeo promocional de 20 con opciones de 15 y 30, y Transferencia de movimiento y Sincronización labial toman la duración del clip que subes.

¿Qué modelos hay detrás?

En vídeo puedes alternar Seedance 2.0 Pro, Seedance 2.0 Fast, PixVerse y HappyHorse en el mismo editor: cada página muestra solo los modelos que aceptan su material y cada modelo, solo las duraciones y proporciones que admite. Seedance 2.5 no aparece actualmente en el menú de modelos. Generador de anuncios usa el agente de anuncios de PixVerse, Vídeo promocional el agente promocional de PixVerse, y Transferencia de movimiento y Sincronización labial, PixVerse. Imagen IA reúne Nano Banana, GPT-Image-2 y Seedream 5.0 Pro en un editor, y Voz IA se apoya en seed-audio.

¿Qué puedo exportar y cómo se paga cada generación?

Las herramientas que hablan exportan audio con subtítulos SRT, y Voz IA solo audio. Diapositivas exporta PPTX y PDF, más vídeo, audio y SRT si la narración está activada. Las de vídeo descargan el clip terminado y Imagen IA descarga el archivo original. Se paga en créditos: el coste depende del modelo, la duración y la calidad, y la cifra exacta aparece junto al botón de generar antes de confirmar.