أداة تحويل الفيديو والصوت إلى نص دفعةً واحدة
تعرّف دون اتصال على ملفات الفيديو والصوت دفعةً واحدة وتحويلها إلى نص، مع تصدير بنقرة واحدة إلى صيغ متعددة للترجمات والنصوص مثل TXT وSRT وVTT وJSON وLRC وCSV.
جارٍ تحميل الأداة، يرجى الانتظار...
إذا تعذر تحميل الأداة عبر الإنترنت أو تشغيلها، جرّب أداة سطح المكتب. https://tools.yikeaigc.com/
استخدام الأداة
العودة إلى الإصدار القديمأداة تحويل الفيديو والصوت إلى نص دفعة واحدة(إصدار البرنامج)
نظرًا لأن تحميل نموذج التعرف على الكلام دون اتصال وفك ترميز الصوت والفيديو يستهلكان موارد حوسبة كبيرة، تتوفر هذه الميزة فقط في عميل سطح مكتب Windows لتجربة أكثر استقرارًا وكفاءة.
التعليمات
تعليمات استخدام البرنامج
- إضافة الملفات المراد التعرف عليها: انقر على زر "اختيار ملف" أو "اختيار مجلد" لإضافة ملفات الفيديو أو الصوت التي تحتاج إلى تحويلها إلى نص، ويمكنك أيضًا سحب الملفات أو المجلدات مباشرةً إلى نافذة البرنامج. يدعم الإضافة المجمّعة والمختلطة لتنسيقات الصوت والفيديو الشائعة مثل MP4 وMKV وMOV وAVI وFLV وWebM وMP3 وWAV وFLAC وM4A وغيرها.
- تعيين مجلد الحفظ: اختر موقع حفظ الترجمة والنصوص بعد المعالجة، مع دعم التعيين بالسحب والإفلات. إذا تم تحديد "اجتياز المجلدات الفرعية"، يمكنك أيضًا تحديد "الحفاظ على بنية المسار الأصلية"، وستتطابق ملفات الإخراج مع بنية مجلدات الملفات المصدرية.
- اختيار تنسيق الإخراج:
- TXT: نص عادي، مناسب لترتيب المسودات ومحاضر الاجتماعات
- SRT / VTT: تنسيق ترجمة مصحوب بطوابع زمنية، يمكن إضافته مباشرةً إلى الفيديو واستخدامه
- JSON: بيانات مهيكلة، ملائمة للتطوير الثانوي والمعالجة البرمجية
- LRC: تنسيق كلمات الأغاني، مناسب للموسيقى والكتب الصوتية
- CSV: تنسيق جدولي، يسهّل التحرير والمراجعة في Excel
- تكوين معلمات التعرف:
- مسار النموذج: يستخدم افتراضيًا نموذج التعرف على الصينية Paraformer، واكتشاف النشاط الصوتي FSMN، ونموذج ترقيم CT
- مدة المعالجة الدُفعية: تعيين أطول مدة صوتية للاستدلال في المرة الواحدة
- أقصى مدة للمقطع الواحد في VAD بالمللي ثانية: التحكم في دقة تقسيم المقاطع الصوتية
- قائمة الكلمات الساخنة: أدخل أسماء العلم وأسماء الأشخاص وكلمات العلامات التجارية لتحسين دقة التعرف
- استراتيجية التخطي/الاستبدال: اختر تخطي ملفات الإخراج الموجودة مسبقًا أو استبدالها
- بدء التعرف المجمّع: انقر على زر "بدء التعرف"، وسيقوم البرنامج تلقائيًا باستخراج المسار الصوتي، وتقسيم المقاطع الصوتية، وإجراء الاستدلال والنسخ، ثم إضافة علامات الترقيم. أثناء المعالجة يمكنك عرض التقدم في منطقة السجل، وعند الحاجة إلى الإيقاف انقر على زر "إيقاف".
- عرض النتائج واستخدامها: بعد اكتمال التعرف، انتقل إلى مجلد الحفظ المحدد لعرض الملفات بالتنسيقات المقابلة. يمكن سحب ترجمات SRT/VTT مباشرةً إلى برامج المونتاج أو المشغلات لاستخدامها.
الأسئلة الشائعة
أدوات ذات صلة
أداة إضافة علامة مائية صورية إلى الفيديو
أضف علامات مائية صورية إلى الفيديوهات دفعةً واحدة، مع دعم...
أداة إزالة بدايات ونهايات الفيديوهات دفعة واحدة
إزالة مدة محددة من بداية ونهاية الفيديوهات دفعة واحدة، مع...
أداة تحويل الصور إلى فيديو دفعة واحدة
حوّل الصور دفعةً واحدة إلى فيديوهات MP4، مع دعم تأثيرات ا...
أداة تغليف الترجمات غير المدمجة دفعةً واحدة
تضمين ملفات الترجمة مثل SRT وASS دفعةً واحدة في MP4 أو MK...
أداة إضافة الطوابع الزمنية الديناميكية إلى الفيديوهات دفعةً واحدة
أضف دفعةً واحدة علامات مائية بطوابع زمنية ديناميكية متزاي...
أداة إزالة ترجمات الفيديو دفعة واحدة
إزالة الترجمات المدمجة من الفيديوهات دفعة واحدة بالاعتماد...