หน้าแรก
เสียง6
วิดีโอ9
รูปภาพ2
เครื่องมือทั้งหมด
คลังทรัพยากร
คลังเสียง
เอกสารสำหรับนักพัฒนา
บล็อก
ไทย
ราคา
เข้าสู่ระบบ
ดาวน์โหลดแอป
เสียงเสียงเป็นข้อความ
พอดแคสต์ AIข้อความเป็นเสียงเสียงเป็นข้อความโคลนเสียงเสียง AIพากย์หลายเสียง

เสียงเป็นข้อความ · ไฟล์บันทึกและวิดีโอ

เครื่องมือแปลงเสียงเป็นข้อความ

จากไฟล์เสียงหนึ่งไฟล์ เป็นข้อความหนึ่งชุด

อัปโหลดไฟล์เสียงหรือวิดีโอ ระบบตรวจจับภาษาให้เอง เสร็จแล้วคัดลอกข้อความ ดาวน์โหลด TXT หรือส่งออกเป็นซับไตเติล SRT ไฟล์ละไม่เกิน 2 ชั่วโมงหรือ 50 MB

  • ตรวจจับภาษาอัตโนมัติ
  • รองรับเสียงและวิดีโอ 17 รูปแบบ
  • คำศัพท์อ้างอิงช่วยจับชื่อและศัพท์เฉพาะ
  • ส่งออก TXT หรือซับไตเติล SRT

ยังไม่มีข้อความถอดเสียง

โปรเจกต์แปลงเสียงเป็นข้อความล่าสุดของคุณจะแสดงที่นี่

วิธีแปลงเสียงเป็นข้อความ

  1. 1

    อัปโหลดไฟล์บันทึกหนึ่งไฟล์

    ลากไฟล์เสียงหรือวิดีโอเข้ามาได้เลย รองรับ AAC, AMR, AVI, FLAC, FLV, M4A, MKV, MOV, MP3, MP4, MPEG, OGG, OPUS, WAV, WEBM, WMA และ WMV ไฟล์ละไม่เกิน 2 ชั่วโมงหรือ 50 MB โดยจะตรวจรูปแบบ ขนาด และความยาวก่อนเริ่มอัปโหลด

  2. 2

    เพิ่มคำศัพท์อ้างอิง

    ไม่บังคับ แต่คุ้มกับเวลาไม่กี่วินาทีสำหรับคำที่โมเดลทั่วไปไม่เคยได้ยิน เช่น ชื่อคน แบรนด์ ตัวย่อ และศัพท์เฉพาะในองค์กร ใส่ได้สูงสุด 50 รายการ ระบบจำไว้ในเครื่องนี้และใส่ให้อัตโนมัติในครั้งถัดไป

  3. 3

    คัดลอก ดาวน์โหลด หรือทำซับไตเติล

    การถอดเสียงทำงานบนเซิร์ฟเวอร์ของเรา ปิดแท็บแล้วค่อยกลับมาดูได้ หน้าผลลัพธ์จะแสดงความยาวและจำนวนคำไว้เหนือข้อความเต็ม พร้อมให้คัดลอก ดาวน์โหลดเป็น TXT แบบ UTF-8 หรือส่งออกเป็นซับไตเติล SRT

งานที่เหมาะกับการถอดเสียง

ถอดบทสัมภาษณ์

ได้บันทึกบทสัมภาษณ์ที่หยิบไปอ้างอิงได้ และค้นหาประโยคที่จำได้ครึ่งเดียว แทนที่จะไล่ฟังเสียงกลับไปกลับมา

รายงานการประชุม

เปลี่ยนเสียงประชุมเป็นข้อความต่อเนื่องชุดเดียว วางลงในเอกสารโปรเจกต์และส่งต่อให้คนที่ไม่ได้เข้าร่วมได้เลย

บทเรียนและโน้ตอ่านหนังสือ

อ่านทวนคาบเรียนหรือการบรรยายตามจังหวะของตัวเอง และเก็บช่วงที่มีศัพท์เฉพาะเยอะไว้เป็นข้อความที่จดเพิ่มได้

ซับไตเติลสำหรับวิดีโอ

ส่งออกไฟล์ SRT ที่สร้างจากเวลาของแต่ละประโยค แล้วนำเข้าโปรแกรมตัดต่อได้ทันที ไม่ต้องพิมพ์ซับเอง

คำถามเกี่ยวกับการแปลงเสียงเป็นข้อความ

การแปลงเสียงเป็นข้อความคืออะไร

ระบบรู้จำเสียงพูดจะฟังไฟล์บันทึกจนจบแล้วเขียนสิ่งที่พูดออกมาเป็นข้อความ ช่วยแทนการนั่งพิมพ์เองทั้งหมด เสียงความยาวหนึ่งชั่วโมงจึงกลายเป็นเอกสารที่อ่านและค้นหาได้ในเวลาที่สั้นกว่ามาก

รองรับไฟล์รูปแบบใดบ้าง

รองรับเสียงและวิดีโอ 17 รูปแบบ ได้แก่ AAC, AMR, AVI, FLAC, FLV, M4A, MKV, MOV, MP3, MP4, MPEG, OGG, OPUS, WAV, WEBM, WMA และ WMV วิดีโออัปโหลดได้ตามเดิม ไม่ต้องแยกแทร็กเสียงออกมาก่อน

ไฟล์ยาวและใหญ่ได้แค่ไหน

ครั้งละหนึ่งไฟล์ ยาวไม่เกิน 2 ชั่วโมงและขนาดไม่เกิน 50 MB ทั้งสองเงื่อนไขตรวจในเบราว์เซอร์ก่อน ไฟล์ที่เกินจึงถูกปฏิเสธทันที ไม่ใช่หลังจากรออัปโหลดนาน

ต้องเลือกภาษาเองไหม

ไม่ต้อง ระบบตรวจจับภาษาที่พูดจากตัวไฟล์เอง ภาษาของไฟล์จึงไม่จำเป็นต้องตรงกับภาษาที่ใช้แสดงหน้าจอ

นอกจากข้อความ ขอซับไตเติลด้วยได้ไหม

ได้ ทุกประโยคถูกเก็บเวลาเริ่มและเวลาจบไว้ ผลลัพธ์ชุดเดียวกันจึงส่งออกเป็นไฟล์ซับไตเติล SRT ได้ควบคู่กับข้อความถอดเสียงแบบ TXT UTF-8 หากไฟล์นั้นไม่ได้เวลาประโยคที่ใช้งานได้ ระบบจะปิดปุ่ม SRT แทนที่จะเดาเวลาให้

คิดเครดิตอย่างไร

คิด 1 เครดิตต่อทุกนาทีที่เริ่มของเสียงต้นฉบับ ไฟล์ยาว 90 วินาทีจึงคิด 2 เครดิต ยอดที่ประเมินไว้จะขึ้นบนปุ่มส่งก่อนเริ่ม และถ้าถอดเสียงไม่สำเร็จจะไม่มีการหักเครดิต

ผลลัพธ์แม่นยำแค่ไหน

ขึ้นอยู่กับไฟล์บันทึก เสียงที่พูดชัด พูดทีละคน และมีเสียงรบกวนน้อยจะได้ผลดีที่สุด จุดที่มักพลาดคือชื่อคน แบรนด์ และศัพท์เฉพาะทาง ซึ่งเป็นเหตุผลที่มีช่องคำศัพท์อ้างอิงให้ใส่

เครื่องมือที่ใช่อาจอยู่ตรงนี้

  • AI สร้างพอดแคสต์

    เหมาะกับตอนที่อยากให้พิธีกรสองคนคุยเรื่องนั้นกัน ไม่ใช่เสียงเดียวอ่านตั้งแต่ต้นจนจบ

  • แปลงข้อความเป็นเสียง

    ตอนที่สคริปต์เขียนเสร็จแล้ว เหลือแค่ให้เสียงอ่านออกมา