فاصل الأصوات بالذكاء الاصطناعي

افصل أي أغنية إلى مسار vocals ومسار instrumental (karaoke) بنقرة واحدة باستخدام نموذج demucs مفتوح المصدر. مجاني بالكامل، بدون علامة مائية، وبدون رفع إلى أطراف ثالثة.

فاصل الأصوات بالذكاء الاصطناعي وصانع الكاريوكي، مجاني. افصل أي أغنية إلى مسار vocals نظيف ومسار instrumental (karaoke) في متصفحك. يعتمد على نموذج demucs مفتوح المصدر من Meta، وهو نفس الذكاء الاصطناعي الذي يستخدمه مهندسو الصوت في إنتاج الموسيقى. لا يلزم تسجيل حساب ولا علامة مائية - تُعالج الملفات الصوتية على خوادمنا، وتُسلَّم المسارات في ملف ZIP واحد.

اسحب وأفلِت الملف هنا، أو انقر للاختيار
تنسيقات مدعومة: MP3, WAV, FLAC, OGG, M4A, AAC, OPUS, WMA, AIFF, M4B
الملف المحدد: -
خصوصية: لا نخزّن ملفاتك الصوتية أو نشاركها. تُحذف تلقائيًا بعد اكتمال المعالجة.
ملاحظة: المعالجة تتم على خادم CPU، وقد تستغرق كل أغنية من دقيقة إلى 3 دقائق.

ما هو فصل الأصوات (vocal separator)؟

ما هو فصل الأصوات؟

فصل الأصوات (المعروف أيضًا باسم إزالة الغناء أو فصل المسارات) هو عملية تقسيم أغنية منتهية إلى جزأين: vocals - الغناء أو الراب أو الكلام - وinstrumental (كل شيء آخر: الطبول، الباس، الغيتارات، لوحات المفاتيح، السينثسايزر). إنها التقنية التي تجعل الكاريوكي ممكنًا دون الحاجة إلى فرقة حية، وتتيح للمنتجين مزج أو إعادة توزيع الأغاني التي لم تُصدر كأغلفة منفصلة.

حتى أواخر العقد الأول من القرن الحادي والعشرين، كان ذلك يتطلب الوصول إلى المقاطع المتعددة الأصلية من الاستوديو (وهو أمر نادر)، أو حيل إلغاء الطور (phase cancellation) التي تعمل فقط على التسجيلات الأحادية. تأخذ نماذج الذكاء الاصطناعي الحديثة مثل demucs أغنية مخلوطة بالكامل كمدخل وتُنتج مسارين نظيفين، حتى على المقاطع ذات صدى قوي، أو الضغط الجانبي، أو vocals خلفية متعددة الطبقات.

كيفية استخدام هذه الأداة

  1. جهّز ملفك الصوتي. تعمل جميع الصيغ الشائعة - MP3 وWAV وFLAC وOGG وM4A وAAC وOPUS وWMA وAIFF وM4B. يتم تطبيع معدل العينة تلقائيًا، مع الحفاظ على عمق البت.
  2. أفلِت الملف في مربع التحميل أعلاه، أو انقر للتصفح. سيظهر اسم الملف المحدد أسفل المربع.
  3. اختر صيغة الإخراج. اختر MP3 للحصول على ملف صغير يمكنك تشغيله على أي جهاز، أو WAV للحصول على نسخة رئيسية غير مضغوطة مناسبة لمزيد من التحرير في DAW.
  4. انقر على فصل. يقوم المتصفح برفع الملف إلى خوادمنا، حيث يعالجه نموذج الذكاء الاصطناعي (htdemucs_ft). يُظهر شريط التقدم خطوة "تحميل نموذج الذكاء الاصطناعي" في المرة الأولى التي تستخدم فيها الأداة، ثم "جاري فصل vocals عن instrumental" أثناء تحليل الأغنية. عادةً ما تستغرق أغنية مدتها 3 دقائق من 60 إلى 180 ثانية.
  5. حمّل ملف ZIP. عند انتهاء المهمة، انقر على تحميل ملف ZIP (vocals + instrumental) لحفظ أرشيف واحد يحتوي على المسارين. يتقاسم كلا المسارين نفس الإيقاع والطبقة الصوتية للملف الأصلي - وهما جاهزان للإدراج مباشرة في مشروع.

نصائح للحصول على أفضل النتائج

  • استخدم أعلى جودة متاحة لديك. التنسيقات ذات الفقد مثل MP3 بمعدل 128 كيلوبت/ثانية تُدخل تشويهات لا يستطيع الذكاء الاصطناعي إزالتها. مصدر 320 كيلوبت/ثانية MP3 أو AAC أو FLAC أو WAV سيبدو دائمًا أنظف بشكل ملحوظ.
  • المقاطع الأقصر تنفصل بشكل أسرع وأفضل. إذا كنت بحاجة فقط إلى اللازمة أو الكوبليه، اقطع المنطقة ذات الصلة في DAW أولاً؛ حيث يحلل النموذج الملف بأكمله.
  • الصوت الأحادي مقبول. معظم أغاني البوب والروك والهيب هوب تُمزج ستيريو، لكن الذكاء الاصطناعي يتعامل مع المصادر الأحادية بشكل جيد تمامًا.
  • الماسترينغ الثقيل عدوّك. المسارات التي خضعت لـ "حرب الإشهار الصوتي" (loudness war) وقُيِّدت بـ brick-wall limiter تُزيل الإشارات المكانية التي يعتمد عليها النموذج. عادةً ما تنفصل أغنية مُمَزَجة بشكل احترافي دون ماسترينغ أفضل بكثير من نفس الأغنية بعد تحديد -8 LUFS.

ماذا تعني "instrumental" في الواقع هنا؟

demucs htdemucs_ft هو محول هجين (hybrid transformer) يقسم الأغنية إلى أربعة مصادر داخلية - vocals وdrums وbass وother (غيتارات، مفاتيح، سينثسايزر، أي شيء آخر). يُرجع وضع "--two-stems vocals" الذي نستخدمه مسارين:

  • Vocals = توقعات النموذج للغناء.
  • Instrumental = الأغنية الأصلية مطروحًا منها توقع vocals. يتم حساب ذلك بطرح vocals من المدخل، وهذا هو ما يجعل instrumental تبدو "مفرّغة" في بعض الترددات - وهذا أمر طبيعي، وهو نفس الأثر الذي ينتجه كل أداة إزالة vocals تعمل بالذكاء الاصطناعي.

إذا كنت بحاجة إلى مسارات بدقة أعلى (الطبول فقط، الباس فقط، إلخ)، فإن نموذج demucs الكامل يعرضها كخيار منفصل؛ وضع الصوتَيْن هو ما تحتاجه معظم سير عمل الكاريوكي والريمكس.

الاستخدامات الشائعة

  • مسارات كاريوكي احتياطية - ضع المسار instrumental في تطبيق الكاريوكي.
  • استخراج acapella للماشَب (mashups) والريمكسات.
  • أخذ العينات (sampling) - اسحب vocal نظيفًا أو حلقة instrumental من تسجيل منتهٍ.
  • التدريب والتعليم - غنِّ مع المسار instrumental، ثم قارن غلافك مع الـ acapella الأصلية.
  • استعادة الصوت - اعزل vocals للتنظيف، أو تقليل الضوضاء، أو تصحيح الطبقة الصوتية دون لمس المسار المرافق.

ملاحظات تقنية

يعمل النموذج على وحدة المعالجة المركزية فقط (CPU) على خادمنا. تستغرق الطلب الأول بعد بدء تشغيل حاوية جديدة حوالي 20-30 ثانية في تحميل أوزان النموذج البالغة 340 ميجابايت في الذاكرة؛ أما الطلبات اللاحقة فتبدأ المعالجة على الفور. ستُرفض الملفات الصوتية الأطول من حد معالجة الخادم (حاليًا 50 ميجابايت) - قسّم الملفات الطويلة أولاً إذا لزم الأمر.

إذا كنت تبحث عن أداة فصل vocals، صانع كاريوكي، إزالة الصوت من الأغنية، استخراج instrumental، أو فصل مسار الغناء، فهذه الأداة مصممة لهذا الغرض بالذات.

تعتمد أداة فصل الأصوات على GitHub Repository">demucs، الصادر عن Meta تحت رخصة MIT. أوزان htdemucs_ft المُسبقة التدريب هي © Meta Platforms, Inc.، وتُعاد توزيعها من Hugging Face Hub بنفس الرخصة. تُضيف هذه الأداة واجهة الرفع، وقائمة انتظار المهام، وتعبئة التنزيل؛ أما النموذج الأساسي فهو بدون تعديل.

الأسئلة الشائعة

هل أداة فصل vocals هذه مجانية؟
نعم - لا يلزم تسجيل حساب أو دفع أو علامة مائية. يتم تمويل الصفحة من إعلانات غير مزعجة، ونحن نتحمل تكاليف الخادم.
هل يتم رفع صوتي أو مشاركته؟
يتم رفع الملف إلى خادمنا طوال مدة مهمة الفصل، ويُحذف فورًا بعدها. لا نخزّن ملفك الصوتي أو نعيد ترميزه أو نشاركه أو نحللّه بقدر ما هو ضروري لإنتاج المسارين.
ما هي صيغ الصوت المدعومة؟
MP3 وWAV وFLAC وOGG وM4A وAAC وOPUS وWMA وAIFF وM4B. يتم تطبيع عمق البت ومعدل العينة تلقائيًا.
هل يمكن فصل الآلات الفردية مثل الطبول أو الباس؟
ليس في هذه الأداة - النموذج الأساسي مُكوَّن لحالة الاستخدام الأكثر شيوعًا (vocals مقابل كل شيء آخر). وضع المسارات الأربعة الكامل (vocals، drums، bass، other) متاح في مشروع demucs الأصلي.
لماذا يستغرق الطلب الأول وقتًا طويلاً؟
يستغرق طلب vocal-separator الأول بعد بدء تشغيل خادم جديد حوالي 20-30 ثانية في تحميل نموذج الذكاء الاصطناعي (340 ميجابايت) في الذاكرة. الطلبات اللاحقة تبدأ على الفور. يُظهر شريط التقدم 'جاري تحميل نموذج الذكاء الاصطناعي' خلال هذه الخطوة حتى تعرف أنه لم يتوقف.
هل أختار إخراج MP3 أم WAV؟
MP3 أصغر بكثير ومناسب للكاريوكي أو الاستماع العادي. WAV غير مضغوط وهو ما تريده إذا كنت تنوي تحرير المسارات في DAW، حيث يضيف الضغط ذو الفقد قطعًا أثرية تنجو من المعالجة الإضافية.
كم يستغرق الفصل؟
عادةً ما تستغرق أغنية مدتها 3 دقائق من 60 إلى 180 ثانية على خادم CPU لدينا. قد تتجاوز الملفات الطويلة جدًا (أكثر من 10 دقائق) حد المهمة الواحدة؛ قسّم الملف أولاً إذا كنت بحاجة إلى مقاطع أطول.
ماذا لو كانت أغنيتي قد أُزيلت منها vocals بالفعل؟
إذا كان المدخل instrumental بالكامل، فسيكون مسار 'vocals' صامتًا (أو هسهسة قريبة من الصامت) وسيكون مسار 'instrumental' مطابقًا للمدخل.