เสียงเป็นข้อความ · ไฟล์บันทึกและวิดีโอ
อัปโหลดไฟล์เสียงหรือวิดีโอ ระบบตรวจจับภาษาให้เอง เสร็จแล้วคัดลอกข้อความ ดาวน์โหลด TXT หรือส่งออกเป็นซับไตเติล SRT ไฟล์ละไม่เกิน 2 ชั่วโมงหรือ 50 MB
ยังไม่มีข้อความถอดเสียง
โปรเจกต์แปลงเสียงเป็นข้อความล่าสุดของคุณจะแสดงที่นี่
ลากไฟล์เสียงหรือวิดีโอเข้ามาได้เลย รองรับ AAC, AMR, AVI, FLAC, FLV, M4A, MKV, MOV, MP3, MP4, MPEG, OGG, OPUS, WAV, WEBM, WMA และ WMV ไฟล์ละไม่เกิน 2 ชั่วโมงหรือ 50 MB โดยจะตรวจรูปแบบ ขนาด และความยาวก่อนเริ่มอัปโหลด
ไม่บังคับ แต่คุ้มกับเวลาไม่กี่วินาทีสำหรับคำที่โมเดลทั่วไปไม่เคยได้ยิน เช่น ชื่อคน แบรนด์ ตัวย่อ และศัพท์เฉพาะในองค์กร ใส่ได้สูงสุด 50 รายการ ระบบจำไว้ในเครื่องนี้และใส่ให้อัตโนมัติในครั้งถัดไป
การถอดเสียงทำงานบนเซิร์ฟเวอร์ของเรา ปิดแท็บแล้วค่อยกลับมาดูได้ หน้าผลลัพธ์จะแสดงความยาวและจำนวนคำไว้เหนือข้อความเต็ม พร้อมให้คัดลอก ดาวน์โหลดเป็น TXT แบบ UTF-8 หรือส่งออกเป็นซับไตเติล SRT
ได้บันทึกบทสัมภาษณ์ที่หยิบไปอ้างอิงได้ และค้นหาประโยคที่จำได้ครึ่งเดียว แทนที่จะไล่ฟังเสียงกลับไปกลับมา
เปลี่ยนเสียงประชุมเป็นข้อความต่อเนื่องชุดเดียว วางลงในเอกสารโปรเจกต์และส่งต่อให้คนที่ไม่ได้เข้าร่วมได้เลย
อ่านทวนคาบเรียนหรือการบรรยายตามจังหวะของตัวเอง และเก็บช่วงที่มีศัพท์เฉพาะเยอะไว้เป็นข้อความที่จดเพิ่มได้
ส่งออกไฟล์ SRT ที่สร้างจากเวลาของแต่ละประโยค แล้วนำเข้าโปรแกรมตัดต่อได้ทันที ไม่ต้องพิมพ์ซับเอง
ระบบรู้จำเสียงพูดจะฟังไฟล์บันทึกจนจบแล้วเขียนสิ่งที่พูดออกมาเป็นข้อความ ช่วยแทนการนั่งพิมพ์เองทั้งหมด เสียงความยาวหนึ่งชั่วโมงจึงกลายเป็นเอกสารที่อ่านและค้นหาได้ในเวลาที่สั้นกว่ามาก
รองรับเสียงและวิดีโอ 17 รูปแบบ ได้แก่ AAC, AMR, AVI, FLAC, FLV, M4A, MKV, MOV, MP3, MP4, MPEG, OGG, OPUS, WAV, WEBM, WMA และ WMV วิดีโออัปโหลดได้ตามเดิม ไม่ต้องแยกแทร็กเสียงออกมาก่อน
ครั้งละหนึ่งไฟล์ ยาวไม่เกิน 2 ชั่วโมงและขนาดไม่เกิน 50 MB ทั้งสองเงื่อนไขตรวจในเบราว์เซอร์ก่อน ไฟล์ที่เกินจึงถูกปฏิเสธทันที ไม่ใช่หลังจากรออัปโหลดนาน
ไม่ต้อง ระบบตรวจจับภาษาที่พูดจากตัวไฟล์เอง ภาษาของไฟล์จึงไม่จำเป็นต้องตรงกับภาษาที่ใช้แสดงหน้าจอ
ได้ ทุกประโยคถูกเก็บเวลาเริ่มและเวลาจบไว้ ผลลัพธ์ชุดเดียวกันจึงส่งออกเป็นไฟล์ซับไตเติล SRT ได้ควบคู่กับข้อความถอดเสียงแบบ TXT UTF-8 หากไฟล์นั้นไม่ได้เวลาประโยคที่ใช้งานได้ ระบบจะปิดปุ่ม SRT แทนที่จะเดาเวลาให้
คิด 1 เครดิตต่อทุกนาทีที่เริ่มของเสียงต้นฉบับ ไฟล์ยาว 90 วินาทีจึงคิด 2 เครดิต ยอดที่ประเมินไว้จะขึ้นบนปุ่มส่งก่อนเริ่ม และถ้าถอดเสียงไม่สำเร็จจะไม่มีการหักเครดิต
ขึ้นอยู่กับไฟล์บันทึก เสียงที่พูดชัด พูดทีละคน และมีเสียงรบกวนน้อยจะได้ผลดีที่สุด จุดที่มักพลาดคือชื่อคน แบรนด์ และศัพท์เฉพาะทาง ซึ่งเป็นเหตุผลที่มีช่องคำศัพท์อ้างอิงให้ใส่