Whisper AI

تحويل الصوت إلى نص بالذكاء الاصطناعي (تفريغ صوتي وملفات ترجمة SRT)

حوّل التسجيلات الصوتية، والمقابلات، والملاحظات الصوتية إلى نصوص مكتوبة قابلة للتعديل وملفات ترجمة متزامنة (.srt) مباشرة داخل متصفحك.

يعمل بنموذج Whisper العصبي للتعرف على الصوت محلياً على جهازك عبر WebAssembly وWebGPU. تتم معالجة ملفاتك الصوتية محلياً دون إرسالها إلى أي خادم خارجي.

إعلان
AdSense Slot (top-banner)Pre-allocated container to prevent CLS

طريقة الاستخدام (خطوة بخطوة)

1

1. اختر ملف الصوت

ارفع تسجيلاً صوتياً بصيغة MP3 أو WAV أو M4A أو OGG أو WebM أو FLAC أو AAC (حتى 15 ميجابايت و3 دقائق كحد أقصى).

2

2. حدد اللغة

اختر لغة التسجيل (العربية، الإنجليزية، الإسبانية، الفرنسية، الألمانية) أو اختر التعرف التلقائي.

3

3. انقر على تفريغ الصوت

اضغط على زر التفريغ لبدء محرك الذكاء الاصطناعي ومعالجة الصوت محلياً في المتصفح.

4

4. المراجعة والتصدير

راجع النص المستخرج وعدّله، ثم انسخه للحافظة أو نزّل ملف النص TXT وملف الترجمة المتزامن SRT.

المميزات والفوائد الأساسية

معالجة صوتية محلية 100%

تتم معالجة الصوت داخل ذاكرة متصفحك مباشرة دون رفع أي ملفات صوتية لخوادم خارجية.

توليد ملفات ترجمة SRT متزامنة

يستخرج توقيتات حقيقية لبداية ونهاية كل جملة صوتية لإنشاء ملفات ترجمة جاهزة لمحرري الفيديو.

عزل المعالجة في Web Worker

ينفذ عمليات الذكاء الاصطناعي الثقيلة في مسار خلفي مستقل للحفاظ على سرعة واستجابة واجهة الموقع.

دعم متعدد للغات

دقة عالية في التعرف على الكلام باللغة العربية والإنجليزية والإسبانية والفرنسية والألمانية.

مساحة عمل وتعديل متكاملة

إمكانية تعديل وتصحيح النص المفرغ مع عداد فوري للحروف والكلمات قبل التحميل.

مجاني تماماً وبدون تسجيل

استخدام فوري داخل المتصفح دون الحاجة لإنشاء حساب أو اشتراكات مدفوعة.

إعلان
AdSense Slot (in-content)Pre-allocated container to prevent CLS

الأسئلة الشائعة

كيف تعمل تقنية تحويل الصوت إلى نص داخل المتصفح؟
تستخدم الأداة نموذج Whisper العصبي مفتوح المصدر المترجم إلى WebAssembly وONNX Runtime. يقوم المتصفح بفك تشفير الإشارة الصوتية وتحليلها محلياً على معالج جهازك.
هل يتم رفع تسجيلاتي الصوتية إلى أي خادم؟
لا. تتم معالجة الصوت بالكامل داخل متصفحك محلياً ولا يتم نقل أي ملفات أو نصوص مفرغة إلى خوادم خارجية.
لماذا تم تحديد الحد الأقصى للملف بـ 3 دقائق؟
لأن نماذج التعرف الصوتي تتطلب معالجة حاسوبية مكثفة. وضع حد 3 دقائق (15 ميجابايت) يضمن استقرار وسرعة المتصفح وتفادي استهلاك كامل ذاكرة الهاتف أو الحاسوب.
كيف يتم توليد توقيتات ملف الترجمة SRT؟
يقوم نموذج الذكاء الاصطناعي بتحديد الطوابع الزمنية الدقيقة لبداية ونهاية كل عبارة منطوقة وتحويلها إلى التنسيق القياسي لملفات SRT.
هل يجب عليّ مراجعة النص قبل نشره؟
نعم. يعتمد التعرف على الصوت على الاحتمالات وتتأثر الدقة بوضوح الصوت والضوضاء المحيطة واللهجات، لذا يُنصح دائماً بمراجعة النص وتدقيقه.

أدوات أونلاين ذات صلة