Product

การโคลนเสียงแบบสนทนาครั้งแรกของโลก

การอ่านสคริปต์ทำให้ได้เสียงโคลนที่ไม่มีความเป็นคุณ ListenHub จึงโคลนเสียงจากบทสนทนาธรรมดา และเคล็ดลับเหล่านี้ช่วยให้ผลลัพธ์ฟังเป็นธรรมชาติ

ListenHub Teamเผยแพร่ อัปเดต
การ์ดปกไล่เฉดสีม่วงเข้มและบานเย็น มีป้าย PRODUCT หัวเรื่องสีขาวขนาดใหญ่ “The world's first chat voice cloning” และโลโก้ ListenHub กับ listenhub.ai ที่มุมซ้ายล่าง

เสียงโคลนทุกเสียงที่คุณเคยบันทึกน่าจะเริ่มเหมือนกัน สคริปต์ปรากฏบนหน้าจอ คุณอ่านออกเสียง และสิ่งที่ได้กลับมาก็เป็นเสียงของคุณในทางเทคนิค แต่ไม่มีความเป็นคุณอยู่เลย

ListenHub โคลนเสียงของคุณจากบทสนทนาแทน ไม่มีอะไรต้องอ่าน และไม่ต้องแสดง

ทำไมการอ่านสคริปต์จึงไม่เคยฟังเหมือนคุณ

การโคลนจากสคริปต์ขอให้ทำสิ่งที่แทบไม่มีใครทำได้ดี คือแสดงคำของคนอื่นต่อหน้าไมโครโฟนโดยไม่มีการเตรียมตัว

คุณสะดุดจึงเริ่มใหม่ เสียงราบเรียบจึงเริ่มใหม่ ผ่านไปห้าครั้ง เสียงโคลนก็ยังไม่มีชีวิต ไม่ใช่เพราะอ่านแย่ แต่เพราะกำลัง “อ่าน” มันไม่ได้พูด แค่ออกเสียงคำ

เราถามอยู่เรื่อย ๆ ว่าทำไมการบันทึกเสียงเพียงสามสิบวินาทีถึงทำให้ดีได้ยาก คำตอบกลับชัดเจนมาก คนเราหยุดฟังเป็นตัวเองทันทีที่มีข้อความให้อ่าน เสียงจริงของคุณ — จังหวะ การหายใจ และระดับเสียงที่พุ่งขึ้นเมื่อมีอะไรทำให้รำคาญ — จะปรากฏเมื่อคุณกำลังคุยกับใครสักคนเท่านั้น

ดังนั้นในเดือนตุลาคม 2025 เราจึงสร้างทั้งกระบวนการรอบแนวคิดนี้ ไม่ใช่ช่องอัปโหลด แต่เป็นบทสนทนา

ผลิตภัณฑ์ส่วนใหญ่ทำฟีเจอร์นี้ได้ในหนึ่งวัน ขอเสียงบันทึก 10 ถึง 30 วินาที หรือรับไฟล์ที่อัปโหลด ส่วนเราสร้างระบบสนทนาด้วยเสียงแบบโต้ตอบเต็มรูปแบบ ซึ่งตอนนั้นให้ความรู้สึกเหมือนสร้างยานอวกาศเพื่อข้ามถนน

เราทำเช่นนั้นเพราะเสียงของคุณคือสิ่งเดียวใน ListenHub ที่คนอื่นคัดลอกไม่ได้ ไม่ว่าจะนำไปจัดพอดแคสต์ บรรยายแทร็กข้อความเป็นเสียง หรือพากย์วิดีโออธิบาย ทุกอย่างต่อจากนั้นจะรับช่วงความสมจริงของเสียงนี้ หลังพัฒนาสองเดือนและทดสอบเบต้าแบบส่วนตัว การโคลนแบบสนทนาเปิดตัวในเดือนธันวาคม 2025 เท่าที่เราตรวจสอบได้ ยังไม่มีใครทำมาก่อน

โคลนเสียงด้วยการสนทนา

วงจรเดิมคือ อ่าน รอ ผิดหวัง แล้วทำซ้ำ วิธีใหม่นี้มีสามขั้นตอน:

  1. เปิดการโคลนเสียงจากเมนูด้านซ้าย
  2. เริ่มบทสนทนา
  3. พูดเหมือนคุยโทรศัพท์กับเพื่อนเก่า บ่นเรื่องมื้อกลางวัน วางแผนทริปที่คงไม่ได้ไป หรือเถียงกันเรื่องภาพยนตร์ หัวข้อไม่สำคัญ

ขณะที่คุณพูด ระบบไม่ได้เก็บเพียงพยางค์ แต่จับทั้งน้ำเสียง จังหวะการหายใจ และช่วงอารมณ์ที่คุณใช้โดยไม่รู้ตัว สิ่งที่ได้คือเสียงของคุณในเวอร์ชันผ่อนคลาย ไม่ใช่เวอร์ชันที่ยืนอ่านหน้าชั้นเรียน

หากเสียงโคลนแรกไม่เหมือนคุณ วิธีแก้คือคุยอีกครั้ง ไม่ใช่เขียนสคริปต์ให้ดีกว่าเดิม

เตรียมตัวก่อนพูด

การใช้งานเรียบง่าย แต่การเตรียมตัวสองนาทียังเป็นความแตกต่างระหว่างเสียงโคลนที่พอใช้ได้กับเสียงที่ยอดเยี่ยม

ใช้ไมโครโฟนที่ดีที่สุดที่มี

ข้อนี้เป็นเรื่องฟิสิกส์เป็นหลัก ฮาร์ดแวร์ที่ดีกว่าให้สัดส่วนสัญญาณต่อเสียงรบกวนที่ดีกว่า หากมีไมค์พอดแคสต์ ให้ใช้ไมค์นั้น หากต้องเลือกระหว่างแล็ปท็อปเก่ากับโทรศัพท์เครื่องใหม่ในกระเป๋า ให้เลือกโทรศัพท์ — ListenHub ใช้งานบนมือถือได้

โทรศัพท์ที่ถือใกล้ใบหน้าจะจับเนื้อเสียงและลมหายใจซึ่งไมค์แล็ปท็อปที่อยู่ห่างออกไปทิ้งไป ระยะห่างเป็นสิ่งที่แก้ได้ง่ายและถูกที่สุด

หาห้องที่ไม่มีเสียงก้อง

พื้นแข็ง ผนังโล่ง และเพดานสูงทำให้เสียงสะท้อนปนกับเสียงพูด และเสียงโคลนจะเรียนรู้เสียงห้องไปพร้อมกับเสียงคุณ ห้องเล็กปูพรม รถยนต์ หรือมุมที่มีเฟอร์นิเจอร์นุ่ม ๆ ล้วนดีกว่าครัวสวย ๆ ปิดหน้าต่าง ปิดพัดลม และให้สุนัขออกไปข้างนอกก่อน

สองเคล็ดลับที่ฟังดูผิดแต่จริง

พูดให้มีอารมณ์มากกว่าที่รู้สึกเป็นธรรมชาติ

ในชีวิตประจำวัน พวกเราส่วนใหญ่พูดอยู่ในช่วงเสียงที่ค่อนข้างแคบ หากให้ข้อมูลช่วงแคบแก่โมเดล ก็จะได้เสียงโคลนที่ฟังเหนื่อยไม่ว่าจะพูดอะไร

ลองออกจากช่วงเสียงปกติ พูดเหมือนกำลังอัปเดตชีวิตกับเพื่อนที่ไม่ได้เจอมาหลายปี ให้มีขึ้นลงจริง ๆ ยิ่งคุณให้ช่วงกว้าง โมเดลก็ยิ่งสร้างช่วงกว้างได้ภายหลัง ลองพูดเกินจริง เลียนแบบเสียง และสนุกไปกับมัน หลายคนประหลาดใจว่าชอบผลลัพธ์มากเพียงใด

พูดภาษาแม่ แม้จะนำไปสร้างอีกภาษา

ข้อนี้ฟังดูตรงกันข้าม แต่เปลี่ยนผลลัพธ์ได้มากที่สุด

สมมติว่าคุณต้องการเสียงบรรยายภาษาอังกฤษ แต่ภาษาอังกฤษไม่ใช่ภาษาแรก หากโคลนตัวเองด้วยภาษาอังกฤษที่ลังเลและระมัดระวัง โมเดลก็จะเรียนรู้สิ่งนั้นพอดี ทั้งความลังเล ความระวัง และการขาดความมั่นใจ ผลลัพธ์ฟังไม่แน่ใจเพราะข้อมูลต้นทางเป็นเช่นนั้น

สนทนาด้วยภาษาที่คุณคล่องที่สุด โมเดลจะจับโทนเสียง — สิ่งที่ทำให้เสียงนั้นเป็นของคุณ — แล้วนำไปใช้กับภาษาใดก็ตามที่สร้างในภายหลัง คุณจึงได้เสียงของตัวเองในเวอร์ชันที่คล่องและมั่นใจ ซึ่งมักเป็นเวอร์ชันที่ต้องการตั้งแต่แรก

ใช้เสียงโคลนต่อที่ไหน

เสียงที่บันทึกไว้ใช้ได้ทั่ว ListenHub ให้นำไปจัดพอดแคสต์ AI อ่านเอกสารด้วยข้อความเป็นเสียง หรือพากย์วิดีโออธิบาย หากอยากเริ่มจากเสียงสำเร็จรูป สามารถดูแคตตาล็อกเสียง และบทความเรื่อง TTS ที่เปลี่ยนภาษาเขียนเป็นภาษาพูดจะอธิบายว่าเครื่องมือบรรยายทำให้ข้อความกลายเป็นเสียงที่น่าฟังอย่างไร

การโคลนเสียงรวมอยู่ในแผนแบบชำระเงินทุกแผน: Basic หนึ่งเสียง, Pro สี่เสียง และ Max ยี่สิบเสียง รายละเอียดปัจจุบันอยู่ในหน้าราคา

เวอร์ชันที่ดีที่สุดของเสียงคุณไม่เคยอยู่ในการอ่านอย่างระมัดระวัง แต่อยู่ในประโยคที่คุณไม่ได้วางแผนไว้

กลับไปที่บล็อก

บทความที่เกี่ยวข้อง