Công cụ AI · Âm thanh · Video · Hình ảnh · Seedance 2.0 · Nano Banana
Bạn có thể bắt đầu từ chủ đề, tài liệu, liên kết, hình ảnh, tư liệu đã quay hoặc kịch bản hoàn chỉnh. Các công cụ có giọng nói dùng chung thư viện giọng ListenHub; mỗi trang video chỉ hiển thị các mô hình hỗ trợ loại đầu vào tương ứng.
Tạo video từ kịch bản, ảnh hoặc video tham chiếu.
Video giải thíchÂm thanhHình ảnh và lời dẫn dựng cùng nhau, từ một chủ đề.
Mô tả một tấm ảnh, chỗ nào chưa ưng thì sửa riêng chỗ đó
SlideVideoTạo một bộ slide, có thể kèm lời thuyết minh.
Podcast AI biến một chủ đề, tài liệu hay liên kết thành tập hoàn chỉnh cả kịch bản lẫn giọng đọc, chọn một hoặc hai người dẫn. Nếu bài đã viết xong, Chuyển văn bản thành giọng nói sẽ đọc nguyên văn hoặc viết lại theo văn nói rồi mới đọc. Kịch bản hội thoại cần tách vai thì dùng Lồng tiếng nhiều vai, còn khi điều quan trọng là cách thoại được nói ra thì dùng Giọng nói AI để chỉnh tông, cảm xúc và nhịp. Tất cả đều xuất tệp âm thanh kèm phụ đề SRT, riêng Giọng nói AI chỉ xuất âm thanh.
Chưa biết bắt đầu từ đâu thì vào Video AI: nhận kịch bản, ảnh tĩnh hoặc tư liệu tham chiếu, và đổi mô hình ngay trong cùng một trình chỉnh. Nếu mục đích là giảng giải cho người xem hiểu, hãy chọn Video giải thích vì hình và lời thuyết minh được dựng cùng nhau. Video quảng cáo, Video quảng bá, Chuyển động tác và Khớp khẩu hình thì mỗi trang chỉ làm một việc, với mô hình cố định.
Ảnh AI dựng ảnh từ mô tả hoặc tối đa năm ảnh tham chiếu; chỗ nào chưa đạt thì khoanh vùng đó, viết rõ muốn đổi thành gì, hệ thống chỉ vẽ lại phần ấy và lưu thành phiên bản mới chứ không đè lên ảnh cũ. Tạo slide sắp tài liệu thành bộ trình chiếu mà mỗi trang đều có nội dung và lời thuyết minh, xuất PPTX và PDF, bật thuyết minh thì có thêm video, tệp âm thanh và phụ đề SRT.
Thu hoặc tải lên một mẫu dài 25-35 giây ở Nhân bản giọng nói, giọng đó sẽ xuất hiện trong danh sách giọng của Podcast AI, Chuyển văn bản thành giọng nói, Tạo slide và Video giải thích, đồng thời chọn được trong Giọng nói AI và Lồng tiếng nhiều vai. Các công cụ video không nhận giọng nhân bản.
Các công cụ được nhóm theo loại đầu ra. Âm thanh gồm Podcast AI, Chuyển văn bản thành giọng nói, Nhân bản giọng nói, Giọng nói AI và Lồng tiếng nhiều vai. Video gồm Video AI, Video giải thích, Video từ văn bản, Video từ ảnh, Video từ tham chiếu, Video quảng cáo, Video quảng bá, Chuyển động tác và Khớp khẩu hình. Hình ảnh gồm Ảnh AI và Tạo slide.
Giọng tạo ở Nhân bản giọng nói sẽ xuất hiện trong danh sách giọng của Podcast AI, Chuyển văn bản thành giọng nói, Tạo slide và Video giải thích, đồng thời chọn được trong Giọng nói AI và Lồng tiếng nhiều vai. Các công cụ video không nhận giọng nhân bản. Thư viện giọng dùng chung cho mọi công cụ có giọng nói và mọi giọng đều nghe thử miễn phí.
Có hai mức. Chuyển văn bản thành giọng nói, Lồng tiếng nhiều vai, Giọng nói AI và Nhân bản giọng nói hỗ trợ 12 ngôn ngữ: tiếng Anh, tiếng Trung phổ thông, tiếng Nhật, tiếng Tây Ban Nha, tiếng Bồ Đào Nha, tiếng Pháp, tiếng Đức, tiếng Thổ Nhĩ Kỳ, tiếng Hàn, tiếng Ý, tiếng Thái và tiếng Việt. Podcast AI, Tạo slide và Video giải thích tạo nội dung bằng tiếng Anh, tiếng Trung phổ thông và tiếng Nhật.
Tùy chất liệu bạn đang có. Chỉ có chữ thì vào Video từ văn bản. Muốn lấy một tấm ảnh làm khung hình đầu thì vào Video từ ảnh, thêm ảnh thứ hai làm khung hình cuối sẽ thành một đoạn chuyển cảnh. Muốn tham chiếu quyết định người, sản phẩm hay phong cách còn câu lệnh quyết định máy quay di chuyển ra sao thì vào Video từ tham chiếu; ảnh tham chiếu và khung hình nằm ở hai trang riêng. Ba trang này cho clip dài tới 15 giây. Video quảng cáo mặc định 30 giây, Video quảng bá mặc định 20 giây với tùy chọn 15 và 30 giây, còn Chuyển động tác và Khớp khẩu hình lấy độ dài theo clip bạn tải lên.
Mảng video đổi qua lại Seedance 2.0 Pro, Seedance 2.0 Fast, PixVerse và HappyHorse trong cùng một trình chỉnh: mỗi trang chỉ liệt kê mô hình nhận được chất liệu của trang đó, mỗi mô hình chỉ hiện những độ dài và tỉ lệ khung hình mà nó hỗ trợ. Seedance 2.5 hiện chưa có trong menu mô hình. Video quảng cáo chạy trên tác nhân quảng cáo PixVerse, Video quảng bá trên tác nhân quảng bá PixVerse, Chuyển động tác và Khớp khẩu hình dùng PixVerse. Mảng ảnh có Nano Banana, GPT-Image-2 và Seedream 5.0 Pro trong cùng một trình chỉnh, còn Giọng nói AI chạy trên seed-audio.
Các công cụ có giọng nói xuất tệp âm thanh kèm phụ đề SRT, riêng Giọng nói AI chỉ xuất âm thanh. Tạo slide xuất PPTX và PDF, bật thuyết minh thì có thêm video, âm thanh và SRT. Công cụ video tải về clip đã hoàn thiện, còn Ảnh AI tải về tệp gốc. Chi phí tính bằng credit: phụ thuộc mô hình, độ dài và chất lượng, con số chính xác hiện ngay cạnh nút tạo để bạn xem trước khi xác nhận.