Herramientas de IA · Audio · Vídeo · Imagen · Seedance 2.0 · Nano Banana
Puedes partir de un tema, documento, enlace, imagen, metraje grabado o un guion terminado. Las herramientas con voz comparten la biblioteca de ListenHub y cada página de vídeo muestra solo los modelos compatibles con su tipo de entrada.
Genera vídeo a partir de un guion, una foto o un clip de referencia.
Vídeo explicativoAudioEscenas y narración, construidas juntas a partir de un tema.
Describe una imagen y edita solo lo que no te convenza
DiapositivasVídeoGenera una presentación, con narración si quieres.
Podcast IA convierte un tema, un documento o un enlace en un episodio terminado, con un presentador o dos. Si el texto ya está escrito, Texto a voz lo lee tal cual o tras reescribirlo en lenguaje hablado. Voces múltiples reparte un guion de diálogo y da una voz a cada personaje, y Voz IA es la página cuando lo que importa es el tono, la emoción y el ritmo. Todas exportan audio con subtítulos SRT; Voz IA exporta solo audio.
Si no lo tienes claro, empieza por Vídeo IA: acepta un guion, una imagen fija o metraje de referencia y permite cambiar de modelo en el mismo editor. Vídeo explicativo es la opción cuando hay que explicar algo, porque las escenas y la narración se construyen juntas. Generador de anuncios, Vídeo promocional, Transferencia de movimiento y Sincronización labial hacen una sola cosa cada uno, con un modelo fijo.
Imagen IA genera a partir de una descripción o de hasta cinco imágenes de referencia; si algo falla, seleccionas esa zona, describes el cambio y solo se rehace ahí, y el resultado se guarda como versión nueva sin borrar la anterior. Diapositivas arma una presentación donde cada página tiene contenido y guion de narración, y exporta PPTX y PDF, más vídeo, audio y SRT cuando la narración está activada.
Graba o sube una muestra de 25 a 35 segundos en Clonación de voz y esa voz aparecerá en el selector de Podcast IA, Texto a voz, Diapositivas y Vídeo explicativo, y también podrás elegirla en Voz IA y Voces múltiples. Las herramientas de vídeo no usan voces clonadas.
Las herramientas se agrupan por tipo de resultado. Audio: Podcast IA, Texto a voz, Clonación de voz, Voz IA y Voces múltiples. Vídeo: Vídeo IA, Vídeo explicativo, Texto a vídeo, Imagen a vídeo, Referencia a vídeo, Generador de anuncios, Vídeo promocional, Transferencia de movimiento y Sincronización labial. Imagen: Imagen IA y Diapositivas.
Una voz creada en Clonación de voz aparece en el selector de Podcast IA, Texto a voz, Diapositivas y Vídeo explicativo, y también puedes elegirla en Voz IA y Voces múltiples. Las herramientas de vídeo no usan voces clonadas. La biblioteca de voces es la misma para todo lo que habla y cada voz se puede escuchar gratis.
Hay dos niveles. Texto a voz, Voces múltiples, Voz IA y Clonación de voz trabajan en 12 idiomas: inglés, chino mandarín, japonés, español, portugués, francés, alemán, turco, coreano, italiano, tailandés y vietnamita. Podcast IA, Diapositivas y Vídeo explicativo generan en inglés, chino mandarín y japonés.
Depende de lo que ya tengas. Texto a vídeo parte solo de lo que escribes. Imagen a vídeo toma una imagen fija como primer fotograma, y si añades una segunda como último fotograma obtienes una transición. Referencia a vídeo sirve cuando la referencia debe fijar la persona, el producto o el estilo, y el prompt decide cómo se mueve el plano; referencias y fotogramas viven en páginas distintas. Esas tres llegan a 15 segundos. Generador de anuncios parte de 30 segundos, Vídeo promocional de 20 con opciones de 15 y 30, y Transferencia de movimiento y Sincronización labial toman la duración del clip que subes.
En vídeo puedes alternar Seedance 2.0 Pro, Seedance 2.0 Fast, PixVerse y HappyHorse en el mismo editor: cada página muestra solo los modelos que aceptan su material y cada modelo, solo las duraciones y proporciones que admite. Seedance 2.5 no aparece actualmente en el menú de modelos. Generador de anuncios usa el agente de anuncios de PixVerse, Vídeo promocional el agente promocional de PixVerse, y Transferencia de movimiento y Sincronización labial, PixVerse. Imagen IA reúne Nano Banana, GPT-Image-2 y Seedream 5.0 Pro en un editor, y Voz IA se apoya en seed-audio.
Las herramientas que hablan exportan audio con subtítulos SRT, y Voz IA solo audio. Diapositivas exporta PPTX y PDF, más vídeo, audio y SRT si la narración está activada. Las de vídeo descargan el clip terminado y Imagen IA descarga el archivo original. Se paga en créditos: el coste depende del modelo, la duración y la calidad, y la cifra exacta aparece junto al botón de generar antes de confirmar.