Trang chủ
Âm thanh5
Video9
Hình ảnh2
Tất cả công cụ
Tài nguyên
Thư viện giọng nói
Tài liệu nhà phát triển
Blog
Tiếng Việt
Đăng nhập
Tải ứng dụng

Công cụ AI · Âm thanh · Video · Hình ảnh · Seedance 2.0 · Nano Banana

Công cụ AI tạo nội dung

Chọn công cụ theo loại đầu ra

Bạn có thể bắt đầu từ chủ đề, tài liệu, liên kết, hình ảnh, tư liệu đã quay hoặc kịch bản hoàn chỉnh. Các công cụ có giọng nói dùng chung thư viện giọng ListenHub; mỗi trang video chỉ hiển thị các mô hình hỗ trợ loại đầu vào tương ứng.

  • Podcast, lồng tiếng và nhân bản giọng nói
  • Video từ văn bản, ảnh hoặc tham chiếu
  • Video quảng cáo và quảng bá từ tác nhân PixVerse
  • Tạo ảnh và sửa đúng vùng chưa ưng
  • Slide và video giải thích có thuyết minh
Âm thanhVideoHình ảnh
Âm thanh5
Podcast AI

Biến một tài liệu thành một tập podcast, một người hoặc nhiều người.

Văn bản thành giọng nói

Chuyển văn bản thành giọng nói, nhiều chất giọng và ngôn ngữ

Nhân bản giọng nói

Nhân bản giọng của bạn và dùng lại ở nhiều nơi

Kịch bản

Giọng nói AI

Trong cùng một kịch bản, giao cho mỗi nhân vật một giọng riêng.

Lồng tiếng nhiều vai

Dán kịch bản hội thoại, mỗi người nói một giọng riêng

Video9
Video AI

Tạo video từ kịch bản, ảnh hoặc video tham chiếu.

Video giải thíchÂm thanh

Hình ảnh và lời dẫn dựng cùng nhau, từ một chủ đề.

Video AI · Theo chất liệu

Văn bản thành video

Viết một câu, nhận về một video

Ảnh thành video

Seedance đầy đủ sức mạnh, hỗ trợ khung đầu là người

Tham chiếu thành video

Seedance 2.0 đầy đủ sức mạnh, hỗ trợ tham chiếu người

Video AI · Thêm mục đích

Tạo quảng cáo

Đưa ảnh sản phẩm vào, nhận video quảng cáo dọc

Video quảng bá

Ảnh của bạn và tư liệu của bạn, dựng thành một video

Chuyển động mô phỏng

Nhân vật của bạn, diễn đúng động tác đó

Khớp khẩu hìnhÂm thanh

Cho người trên màn hình một lời thoại mới

Hình ảnh2
Ảnh AI

Mô tả một tấm ảnh, chỗ nào chưa ưng thì sửa riêng chỗ đó

SlideVideo

Tạo một bộ slide, có thể kèm lời thuyết minh.

Có thể bạn đang cần công cụ khác

  • Tạo video từ ảnh bằng AI
  • Tạo video từ tham chiếu
  • Trình tạo video AI

Việc nào thì dùng công cụ nào

Muốn có thứ để nghe

Podcast AI biến một chủ đề, tài liệu hay liên kết thành tập hoàn chỉnh cả kịch bản lẫn giọng đọc, chọn một hoặc hai người dẫn. Nếu bài đã viết xong, Chuyển văn bản thành giọng nói sẽ đọc nguyên văn hoặc viết lại theo văn nói rồi mới đọc. Kịch bản hội thoại cần tách vai thì dùng Lồng tiếng nhiều vai, còn khi điều quan trọng là cách thoại được nói ra thì dùng Giọng nói AI để chỉnh tông, cảm xúc và nhịp. Tất cả đều xuất tệp âm thanh kèm phụ đề SRT, riêng Giọng nói AI chỉ xuất âm thanh.

Muốn có thứ để xem

Chưa biết bắt đầu từ đâu thì vào Video AI: nhận kịch bản, ảnh tĩnh hoặc tư liệu tham chiếu, và đổi mô hình ngay trong cùng một trình chỉnh. Nếu mục đích là giảng giải cho người xem hiểu, hãy chọn Video giải thích vì hình và lời thuyết minh được dựng cùng nhau. Video quảng cáo, Video quảng bá, Chuyển động tác và Khớp khẩu hình thì mỗi trang chỉ làm một việc, với mô hình cố định.

Muốn có ảnh hoặc slide

Ảnh AI dựng ảnh từ mô tả hoặc tối đa năm ảnh tham chiếu; chỗ nào chưa đạt thì khoanh vùng đó, viết rõ muốn đổi thành gì, hệ thống chỉ vẽ lại phần ấy và lưu thành phiên bản mới chứ không đè lên ảnh cũ. Tạo slide sắp tài liệu thành bộ trình chiếu mà mỗi trang đều có nội dung và lời thuyết minh, xuất PPTX và PDF, bật thuyết minh thì có thêm video, tệp âm thanh và phụ đề SRT.

Muốn đọc bằng chính giọng mình

Thu hoặc tải lên một mẫu dài 25-35 giây ở Nhân bản giọng nói, giọng đó sẽ xuất hiện trong danh sách giọng của Podcast AI, Chuyển văn bản thành giọng nói, Tạo slide và Video giải thích, đồng thời chọn được trong Giọng nói AI và Lồng tiếng nhiều vai. Các công cụ video không nhận giọng nhân bản.

Câu hỏi thường gặp về công cụ AI

ListenHub có những công cụ nào?

Các công cụ được nhóm theo loại đầu ra. Âm thanh gồm Podcast AI, Chuyển văn bản thành giọng nói, Nhân bản giọng nói, Giọng nói AI và Lồng tiếng nhiều vai. Video gồm Video AI, Video giải thích, Video từ văn bản, Video từ ảnh, Video từ tham chiếu, Video quảng cáo, Video quảng bá, Chuyển động tác và Khớp khẩu hình. Hình ảnh gồm Ảnh AI và Tạo slide.

Giọng nhân bản dùng được ở những công cụ nào?

Giọng tạo ở Nhân bản giọng nói sẽ xuất hiện trong danh sách giọng của Podcast AI, Chuyển văn bản thành giọng nói, Tạo slide và Video giải thích, đồng thời chọn được trong Giọng nói AI và Lồng tiếng nhiều vai. Các công cụ video không nhận giọng nhân bản. Thư viện giọng dùng chung cho mọi công cụ có giọng nói và mọi giọng đều nghe thử miễn phí.

Hỗ trợ những ngôn ngữ nào?

Có hai mức. Chuyển văn bản thành giọng nói, Lồng tiếng nhiều vai, Giọng nói AI và Nhân bản giọng nói hỗ trợ 12 ngôn ngữ: tiếng Anh, tiếng Trung phổ thông, tiếng Nhật, tiếng Tây Ban Nha, tiếng Bồ Đào Nha, tiếng Pháp, tiếng Đức, tiếng Thổ Nhĩ Kỳ, tiếng Hàn, tiếng Ý, tiếng Thái và tiếng Việt. Podcast AI, Tạo slide và Video giải thích tạo nội dung bằng tiếng Anh, tiếng Trung phổ thông và tiếng Nhật.

Nên bắt đầu từ trang video nào và clip dài được bao lâu?

Tùy chất liệu bạn đang có. Chỉ có chữ thì vào Video từ văn bản. Muốn lấy một tấm ảnh làm khung hình đầu thì vào Video từ ảnh, thêm ảnh thứ hai làm khung hình cuối sẽ thành một đoạn chuyển cảnh. Muốn tham chiếu quyết định người, sản phẩm hay phong cách còn câu lệnh quyết định máy quay di chuyển ra sao thì vào Video từ tham chiếu; ảnh tham chiếu và khung hình nằm ở hai trang riêng. Ba trang này cho clip dài tới 15 giây. Video quảng cáo mặc định 30 giây, Video quảng bá mặc định 20 giây với tùy chọn 15 và 30 giây, còn Chuyển động tác và Khớp khẩu hình lấy độ dài theo clip bạn tải lên.

Đằng sau các công cụ là những mô hình nào?

Mảng video đổi qua lại Seedance 2.0 Pro, Seedance 2.0 Fast, PixVerse và HappyHorse trong cùng một trình chỉnh: mỗi trang chỉ liệt kê mô hình nhận được chất liệu của trang đó, mỗi mô hình chỉ hiện những độ dài và tỉ lệ khung hình mà nó hỗ trợ. Seedance 2.5 hiện chưa có trong menu mô hình. Video quảng cáo chạy trên tác nhân quảng cáo PixVerse, Video quảng bá trên tác nhân quảng bá PixVerse, Chuyển động tác và Khớp khẩu hình dùng PixVerse. Mảng ảnh có Nano Banana, GPT-Image-2 và Seedream 5.0 Pro trong cùng một trình chỉnh, còn Giọng nói AI chạy trên seed-audio.

Xuất được những gì và chi phí tính thế nào?

Các công cụ có giọng nói xuất tệp âm thanh kèm phụ đề SRT, riêng Giọng nói AI chỉ xuất âm thanh. Tạo slide xuất PPTX và PDF, bật thuyết minh thì có thêm video, âm thanh và SRT. Công cụ video tải về clip đã hoàn thiện, còn Ảnh AI tải về tệp gốc. Chi phí tính bằng credit: phụ thuộc mô hình, độ dài và chất lượng, con số chính xác hiện ngay cạnh nút tạo để bạn xem trước khi xác nhận.