th

แปลงเสียงเป็นข้อความ

แปลงการบันทึกเสียงพูดให้เป็นข้อความ ทำงานในเบราว์เซอร์ล้วนๆ ด้วยการรู้จำเสียงพูดของ AI (Whisper) โดยไม่มีการอัปโหลดเลย

กำลังประมวลผลในเครื่องของคุณ ...

ภาษาของการบันทึก
  • ตรวจจับอัตโนมัติ
  • English
  • 中文
  • Deutsch
  • Español
  • Русский
  • 한국어
  • Français
  • 日本語
  • Português
  • Türkçe
  • Polski
  • Català
  • Nederlands
  • العربية
  • Svenska
  • Italiano
  • Bahasa Indonesia
  • हिन्दी
  • Suomi
  • Tiếng Việt
  • עברית
  • Українська
  • Ελληνικά
  • Bahasa Melayu
  • Čeština
  • Română
  • Dansk
  • Magyar
  • தமிழ்
  • Norsk
  • ไทย
  • اردو
  • Hrvatski
  • Български
  • Lietuvių
  • Latina
  • Māori
  • മലയാളം
  • Cymraeg
  • Slovenčina
  • తెలుగు
  • فارسی
  • Latviešu
  • বাংলা
  • Српски
  • Azərbaycanca
  • Slovenščina
  • ಕನ್ನಡ
  • Eesti
  • Македонски
  • Brezhoneg
  • Euskara
  • Íslenska
  • Հայերեն
  • नेपाली
  • Монгол
  • Bosanski
  • Қазақша
  • Shqip
  • Kiswahili
  • Galego
  • मराठी
  • ਪੰਜਾਬੀ
  • සිංහල
  • ខ្មែរ
  • ChiShona
  • Yorùbá
  • Soomaali
  • Afrikaans
  • Occitan
  • ქართული
  • Беларуская
  • Тоҷикӣ
  • سنڌي
  • ગુજરાતી
  • አማርኛ
  • ייִדיש
  • ລາວ
  • Oʻzbekcha
  • Føroyskt
  • Kreyòl ayisyen
  • پښتو
  • Türkmençe
  • Nynorsk
  • Malti
  • संस्कृतम्
  • Lëtzebuergesch
  • မြန်မာ
  • བོད་སྐད་
  • Tagalog
  • Malagasy
  • অসমীয়া
  • Татарча
  • ʻŌlelo Hawaiʻi
  • Lingála
  • Hausa
  • Башҡортса
  • Basa Jawa
  • Basa Sunda
  • 粵語

กำลังประมวลผลในเครื่องของคุณ ...

0%

ไฟล์ของคุณไม่เคยออกจากอุปกรณ์

    ไฟล์ของฉันถูกอัปโหลดไหม

    ไม่ ทุกอย่างทำงานในเบราว์เซอร์ของคุณ - ไฟล์ของคุณไม่เคยออกจากอุปกรณ์ ตรวจสอบเรื่องนี้ได้อย่างไร

    ไม่ต้องอัปโหลดทำงานในเครื่อง 100%
    เนื้อหายังอยู่กับคุณไม่มีบุคคลที่สามเข้าถึง
    Hosted in GermanyGlobal Content Delivery
    ตรวจสอบโดยอิสระTLS A+ · ส่วนหัว HTTP A+

    บทสัมภาษณ์ การบันทึกเลคเชอร์ หรือบันทึกเสียงไอเดียระหว่างเดินทาง เครื่องมือนี้จะฟังการบันทึกแล้วถอดออกมาเป็นข้อความที่ค้นหาและคัดลอกได้ โมเดลที่ใช้รู้จำเสียงคือ Whisper จาก OpenAI ซึ่งที่นี่คอมไพล์ขึ้นมาเป็น WebAssembly แบบเธรดเดียวโดยเฉพาะ เป็นเทคโนโลยีพื้นฐานเดียวกับที่บริการถอดเสียงชื่อดังใช้ เพียงแต่ที่นี่ทำงานบนอุปกรณ์ของคุณทั้งหมดแทนที่จะเป็นเซิร์ฟเวอร์ของคนอื่น

    ตามค่าเริ่มต้น Whisper จะตรวจจับภาษาที่พูดเองโดยอัตโนมัติ ("ตรวจจับอัตโนมัติ") แต่สำหรับการบันทึกสั้นๆ หรือหลายภาษา ก็สามารถกำหนดภาษาตายตัวได้เช่นกัน ซึ่งอาจช่วยเพิ่มความแม่นยำและความเร็วขึ้นเล็กน้อย ผลลัพธ์จะแสดงเป็นข้อความต่อเนื่องโดยขึ้นย่อหน้าใหม่ตามแต่ละช่วงการพูด สำหรับวิดีโอที่ต้องการไทม์สแตมป์ฝังอยู่ในตัว มีเครื่องมือคู่กัน "วิดีโอเป็นคำบรรยาย" ที่ใช้การรู้จำเสียงแบบเดียวกันแต่ส่งออกเป็นไฟล์ SRT/VTT พร้อมจุดเวลาที่แม่นยำ

    เนื่องจากทำงานโดยไม่มีหน่วยความจำร่วม (ไม่มี cross-origin isolation) การรู้จำเสียงจึงทำงานแบบเธรดเดียวแทนที่จะเป็นหลายเธรด ถูกต้องในทางเทคนิคแต่ช้ากว่าบริการที่ทำงานบนเซิร์ฟเวอร์อย่างเห็นได้ชัด ด้วยเหตุนี้ที่นี่จึงมีขีดจำกัดความยาวที่เข้มงวดกว่าเครื่องมือเสียงอื่นๆ ของเว็บไซต์นี้มาก เพราะช้าแบบตรงไปตรงมาดีกว่าสัญญาความเร็วที่ไม่จริง

    ข้อมูลทางเทคนิค

    ข้อมูลทางเทคนิค
    รูปแบบที่รองรับMP3, WAV, M4A, AAC, OGG, OPUS, FLAC
    การแปลงอัตโนมัติMP4
    รูปแบบผลลัพธ์TXT
    การประมวลผลเป็นชุดไม่รองรับ
    การประมวลผลภายในเบราว์เซอร์ (WebAssembly)
    การอัปโหลดไฟล์ไม่มี

    ใน 3 ขั้นตอน

    1. วางไฟล์เสียงของคุณ
    2. เลือกภาษาหรือปล่อยไว้ที่ "ตรวจจับอัตโนมัติ"
    3. คัดลอกข้อความที่รู้จำได้หรือดาวน์โหลดเป็น TXT

    ข้อจำกัด: ทำงานแบบเธรดเดียว (หน้านี้ไม่มีโหมด cross-origin isolation) จึงช้ากว่าบริการที่ทำงานบนเซิร์ฟเวอร์อย่างเห็นได้ชัด มีขีดจำกัดความยาวต่ออุปกรณ์ที่เข้มงวดกว่ามากที่นี่ (สั้นกว่าเครื่องมือเสียงอื่นๆ) ใช้โมเดลระดับ "tiny" ที่กะทัดรัด เหมาะกับเสียงพูดที่ชัดเจน แต่ทำได้ไม่ดีเท่าโมเดลที่ใหญ่กว่าเมื่อมีเสียงรบกวนพื้นหลังหนักๆ สำเนียงท้องถิ่น หรือศัพท์เฉพาะทาง การรู้จำเสียงไม่ได้แม่นยำร้อยเปอร์เซ็นต์ ควรตรวจสอบผลลัพธ์ โดยเฉพาะชื่อเฉพาะและตัวเลข

    คำถามที่พบบ่อย

    การบันทึกของฉันถูกอัปโหลดหรือไม่

    ไม่ การรู้จำเสียงทำงานในเบราว์เซอร์ล้วนๆ ผ่าน WebAssembly

    รู้จำภาษาอะไรได้บ้าง

    เกือบ 100 ภาษา ไม่ว่าจะตรวจจับอัตโนมัติหรือกำหนดตายตัว

    ทำไมถึงใช้เวลานานกว่าเครื่องมือเสียงอื่นๆ

    การรู้จำเสียงพูดใช้การประมวลผลหนักมาก และที่นี่ทำงานโดยไม่มีหลายเธรด ถูกต้องในทางเทคนิคแต่ตั้งใจให้ช้ากว่าแทนที่จะสัญญาความเร็วที่ไม่จริง

    มีเวอร์ชันที่มีไทม์สแตมป์สำหรับคำบรรยายด้วยหรือไม่

    มี เครื่องมือคู่กัน "วิดีโอเป็นคำบรรยาย" จะส่งออก SRT/VTT พร้อมจุดเวลาที่แม่นยำ

    เครื่องมือที่เกี่ยวข้อง

    วิดีโอเป็นคำบรรยาย · ลบเสียงรบกวน · รูปภาพเป็นข้อความ (OCR) · ภาพรูปคลื่นเสียง · บันทึกเสียง · สลับแชนแนล