ar

تحويل الصوت إلى نص

حوّل تسجيلًا صوتيًا منطوقًا إلى نص مكتوب - محليًا في المتصفح عبر التعرف على الكلام بالذكاء الاصطناعي (Whisper)، دون أي رفع للملفات إطلاقًا.

تتم المعالجة محلياً على جهازك ...

لغة التسجيل
  • كشف تلقائي
  • English
  • 中文
  • Deutsch
  • Español
  • Русский
  • 한국어
  • Français
  • 日本語
  • Português
  • Türkçe
  • Polski
  • Català
  • Nederlands
  • العربية
  • Svenska
  • Italiano
  • Bahasa Indonesia
  • हिन्दी
  • Suomi
  • Tiếng Việt
  • עברית
  • Українська
  • Ελληνικά
  • Bahasa Melayu
  • Čeština
  • Română
  • Dansk
  • Magyar
  • தமிழ்
  • Norsk
  • ไทย
  • اردو
  • Hrvatski
  • Български
  • Lietuvių
  • Latina
  • Māori
  • മലയാളം
  • Cymraeg
  • Slovenčina
  • తెలుగు
  • فارسی
  • Latviešu
  • বাংলা
  • Српски
  • Azərbaycanca
  • Slovenščina
  • ಕನ್ನಡ
  • Eesti
  • Македонски
  • Brezhoneg
  • Euskara
  • Íslenska
  • Հայերեն
  • नेपाली
  • Монгол
  • Bosanski
  • Қазақша
  • Shqip
  • Kiswahili
  • Galego
  • मराठी
  • ਪੰਜਾਬੀ
  • සිංහල
  • ខ្មែរ
  • ChiShona
  • Yorùbá
  • Soomaali
  • Afrikaans
  • Occitan
  • ქართული
  • Беларуская
  • Тоҷикӣ
  • سنڌي
  • ગુજરાતી
  • አማርኛ
  • ייִדיש
  • ລາວ
  • Oʻzbekcha
  • Føroyskt
  • Kreyòl ayisyen
  • پښتو
  • Türkmençe
  • Nynorsk
  • Malti
  • संस्कृतम्
  • Lëtzebuergesch
  • မြန်မာ
  • བོད་སྐད་
  • Tagalog
  • Malagasy
  • অসমীয়া
  • Татарча
  • ʻŌlelo Hawaiʻi
  • Lingála
  • Hausa
  • Башҡортса
  • Basa Jawa
  • Basa Sunda
  • 粵語

تتم المعالجة محلياً على جهازك ...

0%

هل يُرفَع ملفي؟

لا. كل شيء يجري في متصفحك - ملفك لا يغادر جهازك أبداً. كيف يكون ذلك قابلاً للتحقق

دون رفعمحلي 100%
محتواك يبقى لديكلا وصول لأطراف خارجية
Hosted in GermanyGlobal Content Delivery
مدقَّقة خارجيًاTLS A+ · ترويسات A+

مقابلة، تسجيل محاضرة، أو مذكرة صوتية لفكرة خطرت أثناء التنقل: تستمع هذه الأداة إلى التسجيل وتكتبه كنص قابل للبحث والنسخ. نموذج التعرف المستخدم هو Whisper من OpenAI، مُصرَّف هنا خصيصًا كملف WebAssembly أحادي الخيط - وهي نفس التقنية الأساسية التي تستخدمها خدمات النسخ الصوتي المعروفة، إلا أنها هنا تعمل بالكامل على جهازك بدلًا من خادم غريب.

بشكل افتراضي، يتعرف Whisper على اللغة المنطوقة بنفسه ("كشف تلقائي") - لكن بالنسبة للتسجيلات القصيرة أو متعددة اللغات، يمكن أيضًا تحديد اللغة يدويًا، ما قد يحسّن قليلًا من دقة التعرف وسرعته. تظهر النتيجة كنص متصل بفقرة لكل مقطع كلامي؛ أما بالنسبة للفيديوهات التي تحتاج طوابع زمنية مضمَّنة، فهناك الأداة الشقيقة "تحويل الفيديو إلى ترجمة" التي تستخدم نفس تقنية التعرف لكنها تُخرج ملف SRT/VTT بعلامات زمنية دقيقة.

بما أن العمل يجري دون ذاكرة مشتركة (دون عزل المصدر المتقاطع)، فإن التعرف يعمل بخيط واحد بدلًا من خيوط متعددة - وهذا صحيح تقنيًا لكنه أبطأ ملحوظًا من الخدمات التي تعمل على الخادم. لذلك يُطبَّق هنا حد أقصى لطول الملف أشد صرامة بكثير مقارنة بأدوات الصوت الأخرى في هذا الموقع - إذ يُفضَّل بطء صادق على وعد سرعة غير حقيقي.

البيانات التقنية

البيانات التقنية
صيغ الإدخالMP3, WAV, M4A, AAC, OGG, OPUS, FLAC
تحويل تلقائيMP4
صيغة الإخراجTXT
معالجة دفعيةلا
المعالجةمحليًا في المتصفح (WebAssembly)
رفع الملفاتلا يوجد

في 3 خطوات

  1. أفلت ملف الصوت الخاص بك.
  2. اختر لغة أو اتركها على "كشف تلقائي".
  3. انسخ النص المُتعرَّف عليه أو نزّله كملف TXT.

القيود: تعمل الأداة بخيط واحد (لا يوجد وضع عزل المصدر المتقاطع في هذه الصفحة)، لذا فهي أبطأ ملحوظًا من الخدمات التي تعمل على الخادم - يُطبَّق هنا حد أقصى لطول الملف لكل جهاز أشد صرامة بكثير (أقصر من أدوات الصوت الأخرى). تُستخدَم فئة النموذج المضغوطة "tiny": جيدة مع الكلام الواضح، وأضعف مع ضوضاء الخلفية القوية أو اللهجات أو المصطلحات المتخصصة مقارنة بنموذج أكبر. التعرف ليس خاليًا من الأخطاء - راجع النتيجة، خاصة الأسماء الخاصة والأرقام.

الأسئلة الشائعة

هل يتم رفع تسجيلي؟

لا، يتم التعرف بالكامل محليًا في المتصفح عبر WebAssembly.

ما اللغات التي يتم التعرف عليها؟

قرابة 100 لغة؛ إما بالكشف التلقائي أو بالاختيار اليدوي.

لماذا يستغرق هذا وقتًا أطول من أدوات الصوت الأخرى؟

التعرف على الكلام عملية حسابية ثقيلة، وتعمل هنا دون خيوط متعددة - صحيح تقنيًا، لكنه أبطأ عمدًا بدلًا من الوعد بسرعة غير حقيقية.

هل توجد نسخة بطوابع زمنية للترجمة؟

نعم، الأداة الشقيقة "تحويل الفيديو إلى ترجمة" تُخرج ملف SRT/VTT بعلامات زمنية دقيقة.

أدوات ذات صلة

تحويل الفيديو إلى ترجمة · إزالة الضوضاء · صورة إلى نص (OCR) · صورة الشكل الموجي · تسجيل الصوت · تبديل القنوات