demucs ওপেন-সোর্স মডেল ব্যবহার করে যেকোনো গানকে এক ক্লিকে vocals এবং instrumental স্টেমে আলাদা করুন। সম্পূর্ণ বিনামূল্যে, কোনো ওয়াটারমার্ক নেই, তৃতীয় পক্ষের কাছে আপলোড হয় না।
বিনামূল্যে AI ভোকাল রিমুভার ও ক্যারাওকে মেকার। আপনার ব্রাউজারে যেকোনো গানকে একটি পরিষ্কার vocals স্টেম এবং একটি instrumental (ক্যারাওকে) স্টেমে আলাদা করুন। Meta-এর ওপেন-সোর্স demucs মডেল (htdemucs_ft) এর উপর নির্মিত, যেটি অডিও ইঞ্জিনিয়াররা মিউজিক প্রোডাকশনে ব্যবহার করেন। কোনো অ্যাকাউন্ট লাগে না, কোনো ওয়াটারমার্ক নেই — অডিও আমাদের সার্ভারে প্রক্রিয়া করা হয়, স্টেমগুলি একটি একক ZIP এ পৌঁছায়।
ফাইল এখানে টেনে আনুন ও ছেড়ে দিন, অথবা বেছে নিতে ক্লিক করুন
গোপনীয়তা: আমরা আপনার অডিও ফাইল সংরক্ষণ বা শেয়ার করি না — প্রক্রিয়াকরণ শেষ হলে স্বয়ংক্রিয়ভাবে মুছে ফেলা হয়।
দ্রষ্টব্য: প্রক্রিয়াকরণ আমাদের CPU সার্ভারে হয়, প্রতিটি গানের জন্য সাধারণত ১-৩ মিনিট সময় লাগতে পারে।
ভোকাল সেপারেশন কী?
ভোকাল সেপারেশন কী?
ভোকাল সেপারেশন (যাকে ভোকাল রিমুভাল বা স্টেম সেপারেশন ও বলা হয়) হল একটি সম্পূর্ণ গানকে দুটি অংশে ভাগ করার প্রক্রিয়া: vocals — গাওয়া, র্যাপ বা কথা — এবং instrumental (অন্য সবকিছু: ড্রাম, বেস, গিটার, কীবোর্ড, সিনথ)। এটিই সেই প্রযুক্তি যা ক্যারাওকেকে লাইভ ব্যান্ড ছাড়াই সম্ভব করে, এবং প্রযোজকদের এমন গানগুলির স্যাম্পল, রিমিক্স বা কভার করতে দেয় যেগুলি কখনও আলাদা ট্র্যাক হিসেবে প্রকাশিত হয়নি।
২০১০-এর দশকের শেষ পর্যন্ত এর জন্য স্টুডিওর আসল মাল্টি-ট্র্যাক অ্যাক্সেস (বিরল) অথবা phase-cancellation কৌশল প্রয়োজন হতো যা কেবল মনো রেকর্ডিংয়ে কাজ করত। demucs-এর মতো আধুনিক AI মডেলগুলি একটি সম্পূর্ণ মিক্স করা গানকে ইনপুট হিসেবে নিয়ে দুটি পরিষ্কার স্টেম তৈরি করে, এমনকি ভারী রিভার্ব, side-chain কম্প্রেশন বা স্তরযুক্ত ব্যাকিং vocals-এর ট্র্যাকেও।
এই টুল কীভাবে ব্যবহার করবেন
১. আপনার অডিও প্রস্তুত করুন। সব সাধারণ ফরম্যাট কাজ করে — MP3, WAV, FLAC, OGG, M4A, AAC, OPUS, WMA, AIFF, M4B। স্যাম্পল রেট স্বয়ংক্রিয়ভাবে নরমালাইজ করা হয়; বিট ডেপথ সংরক্ষিত থাকে।
২. উপরের আপলোড বাক্সে ফাইলটি ড্রপ করুন, অথবা ব্রাউজ করতে ক্লিক করুন। নির্বাচিত ফাইলের নাম বাক্সের নিচে দেখা যাবে।
৩. একটি আউটপুট ফরম্যাট বেছে নিন। যেকোনো ডিভাইসে চালানোর জন্য ছোট ফাইল চাইলে MP3, অথবা DAW-এ আরও সম্পাদনার জন্য আনকম্প্রেসড মাস্টার চাইলে WAV বেছে নিন।
৪. আলাদা করুন-এ ক্লিক করুন। ব্রাউজার ফাইলটি আমাদের সার্ভারে আপলোড করে, যেখানে AI মডেল (htdemucs_ft) এটি প্রক্রিয়া করে। প্রগ্রেস বার টুলটি প্রথমবার ব্যবহারের সময় "AI মডেল লোড হচ্ছে" ধাপ দেখায়, তারপর গান বিশ্লেষণের সময় "vocals এবং instrumental আলাদা করা হচ্ছে" দেখায়। ৩-মিনিটের গান সাধারণত ৬০–১৮০ সেকেন্ড নেয়।
৫. ZIP ডাউনলোড করুন। কাজ শেষ হলে, vocals এবং instrumental ধারণকারী একটি একক আর্কাইভ সংরক্ষণ করতে ZIP ডাউনলোড (vocals + instrumental) ক্লিক করুন। উভয় স্টেম সোর্স ফাইলের গতি ও পিচ শেয়ার করে — সরাসরি প্রজেক্টে ব্যবহারের জন্য প্রস্তুত।
সেরা ফলাফলের জন্য টিপস
আপনার কাছে যতটা সম্ভব উচ্চমানের সোর্স ব্যবহার করুন। ১২৮ kbps MP3-এর মতো lossy ফরম্যাট এমন আর্টিফ্যাক্ট আনে যা AI পূরণ করতে পারে না। ৩২০ kbps MP3, AAC, FLAC বা WAV সোর্স সবসময় লক্ষণীয়ভাবে পরিষ্কার শোনায়।
ছোট ক্লিপ দ্রুত ও ভালোভাবে আলাদা হয়। আপনার শুধু কোরাস বা ভার্স দরকার হলে, আগে আপনার DAW-এ প্রাসঙ্গিক অংশটি কেটে নিন; মডেলটি পুরো ফাইল বিশ্লেষণ করে।
মনো ঠিক আছে। বেশিরভাগ পপ, রক ও হিপ-হপ রিলিজ স্টেরিওতে মিক্স করা হয়, কিন্তু AI মনো সোর্সও সমান ভালোভাবে পরিচালনা করে।
ভারী মাস্টারিং আপনার শত্রু। loudness-war ট্র্যাক যেগুলো brick-wall-limited করা হয়েছে, সেগুলো মডেলের উপর নির্ভরশীল স্থানিক কিউ অপসারণ করে দেয়। পেশাদারভাবে মিক্স করা কিন্তু মাস্টার না করা একটি গান সাধারণত -৮ LUFS লিমিটিংয়ের পরে একই গানের চেয়ে অনেক ভালো আলাদা হয়।
এখানে "instrumental" আসলে কী বোঝায়?
demucs htdemucs_ft একটি হাইব্রিড ট্রান্সফরমার যা গানকে চারটি অভ্যন্তরীণ উৎসে ভাগ করে — vocals, drums, bass এবং other (গিটার, কি, সিনথ, অন্য যেকো anything)। আমরা যে "--two-stems vocals" মোড ব্যবহার করি সেটি দুটি স্টেম প্রদান করে:
Vocals = মডেলের vocal পূর্বাভাস।
Instrumental = মূল গান বিয়োগ vocal পূর্বাভাস। এটি ইনপুট থেকে vocals বিয়োগ করে গণনা করা হয়, যা কিছু ফ্রিকোয়েন্সিতে instrumental কে "ফাঁপা" শোনায় — এটি স্বাভাবিক, এবং প্রতিটি AI ভোকাল রিমুভার একই আর্টিফ্যাক্ট তৈরি করে।
আপনার যদি আরও সূক্ষ্ম স্টেম দরকার হয় (শুধু ড্রাম, শুধু বেস, ইত্যাদি), পূর্ণ demucs মডেল সেগুলি আলাদা বিকল্প হিসেবে প্রকাশ করে; দুই-স্টেম মোড হল বেশিরভাগ ক্যারাওকে ও রিমিক্স ওয়ার্কফ্লোর প্রয়োজন।
স্যাম্পলিং — একটি সম্পূর্ণ রেকর্ড থেকে একটি পরিষ্কার vocal বা instrumental লুপ টানুন।
অনুশীলন ও শিক্ষা — instrumental-এর সঙ্গে গান গান, তারপর আপনার কভারকে মূল acapella-এর সঙ্গে তুলনা করুন।
অডিও রেস্টোরেশন — ব্যাকিং ট্র্যাক স্পর্শ না করে ক্লিনআপ, নয়েজ রিডাকশন বা পিচ কারেকশনের জন্য vocals আলাদা করুন।
প্রযুক্তিগত নোট
মডেলটি আমাদের সার্ভারে কেবল CPU-তে চলে। একটি নতুন কন্টেইনার শুরুর পরে প্রথম অনুরোধটি প্রায় ২০–৩০ সেকেন্ড মডেলের ৩৪০ MB ওজন মেমোরিতে লোড করতে ব্যয় করে; পরবর্তী অনুরোধগুলি অবিলম্বে প্রক্রিয়া শুরু করে। সার্ভারের প্রক্রিয়াকরণ সীমার (বর্তমানে ৫০ MB) চেয়ে দীর্ঘ অডিও প্রত্যাখ্যান করা হবে — দীর্ঘ ফাইল প্রথমে ভাগ করুন।
আপনি যদি একটি ভোকাল সেপারেটর, ক্যারাওকে মেকার, গান থেকে vocals রিমুভ করার টুল, instrumental এক্সট্র্যাক্টর, অথবা সিঙ্গার আলাদা করার টুল খুঁজছেন, এই টুলটি ঠিক সেই উদ্দেশ্যেই তৈরি।
প্রায়শই জিজ্ঞাসিত প্রশ্ন
এই ভোকাল রিমুভার কি বিনামূল্যে?
হ্যাঁ — কোনো অ্যাকাউন্ট নেই, কোনো পেমেন্ট নেই, কোনো ওয়াটারমার্ক নেই। পৃষ্ঠাটি অ-বিরক্তিকর বিজ্ঞাপন দ্বারা অর্থায়ন করা হয় এবং সার্ভার খরচ আমরা বহন করি।
আমার অডিও কি আপলোড বা শেয়ার করা হয়?
ফাইলটি বিভাজন কাজের সময়কালের জন্য আমাদের সার্ভারে আপলোড করা হয় এবং সাথে সাথেই মুছে ফেলা হয়। আমরা আপনার অডিও সংরক্ষণ, ট্রান্সকোড, শেয়ার বা বিশ্লেষণ করি না, স্টেম উৎপাদনের জন্য যা প্রয়োজন তার বাইরে।
কোন অডিও ফরম্যাটগুলি সমর্থিত?
MP3, WAV, FLAC, OGG, M4A, AAC, OPUS, WMA, AIFF এবং M4B। বিট ডেপথ এবং স্যাম্পল রেট স্বয়ংক্রিয়ভাবে নরমালাইজ করা হয়।
এটি কি পৃথক যন্ত্র যেমন ড্রাম বা বেস আলাদা করতে পারে?
এই টুলে নয় — অন্তর্নিহিত মডেলটি সবচেয়ে সাধারণ ব্যবহারের ক্ষেত্রে (vocals বনাম অন্য সব) কনফিগার করা আছে। সম্পূর্ণ চার-স্টেম মোড (vocals, drums, bass, other) আপস্ট্রিম demucs প্রজেক্টে উপলব্ধ।
প্রথম অনুরোধ এত দীর্ঘ কেন?
একটি নতুন সার্ভার শুরুর পরে প্রথম ভোকাল-সেপারেটর অনুরোধ মেমোরিতে ৩৪০ MB AI মডেল লোড করতে প্রায় ২০–৩০ সেকেন্ড ব্যয় করে। পরবর্তী অনুরোধগুলি অবিলম্বে শুরু হয়। প্রগ্রেস বার এই ধাপে "AI মডেল লোড হচ্ছে" দেখায় যাতে আপনি জানেন এটি আটকে নেই।
আমার কি MP3 না WAV আউটপুট বেছে নেওয়া উচিত?
MP3 অনেক ছোট এবং ক্যারাওকে বা আকস্মিক শোনার জন্য ভালো। WAV হল আনকম্প্রেসড এবং আপনি যদি DAW-এ স্টেমগুলি আরও সম্পাদনা করতে চান তবে এটিই আপনি চান, কারণ lossy কম্প্রেশন এমন আর্টিফ্যাক্ট যোগ করে যা আরও প্রক্রিয়াকরণে টিকে থাকে।
বিভাজনে কত সময় লাগে?
আমাদের CPU সার্ভারে একটি ৩-মিনিটের গান সাধারণত ৬০–১৮০ সেকেন্ড নেয়। খুব দীর্ঘ ফাইল (১০ মিনিটের বেশি) প্রতি-কাজ সীমা অতিক্রম করতে পারে; আপনার দীর্ঘ সেগমেন্ট দরকার হলে প্রথমে ফাইলটি ভাগ করুন।
আমার গানের vocals ইতিমধ্যে রিমুভ করা থাকলে কী হবে?
যদি ইনপুট বিশুদ্ধ instrumental হয়, তাহলে "vocals" স্টেম নীরব হবে (অথবা প্রায়-নীরব হিস) এবং "instrumental" স্টেম ইনপুটের সাথে অভিন্ন হবে।