GOOGLE CLOUD টেক্সট টু স্পিচ
Google-এর প্রতিটি কণ্ঠ, এক পাতায়।
Google Cloud ক্যাটালগের প্রতিটি কণ্ঠের নমুনা শুনুন। মডেল পরিবার, ভাষা ও লিঙ্গ দিয়ে ফিল্টার করুন। কোনো অ্যাকাউন্ট নেই, কোনো সেটআপ নেই, শুধু কণ্ঠ।
১০ মডেল পরিবার
Google নতুন নতুন স্পিচ আর্কিটেকচার আনতেই থাকে, আর প্রতিটি প্রজন্ম এখনো চালু। ক্যাটালগ ছোট প্যারামেট্রিক কণ্ঠ থেকে শুরু করে এক বাক্যে চালনা করা যায় এমন মডেল পর্যন্ত বিস্তৃত।
৯৩টি ভাষা
প্রতিটি ভাষার নিজস্ব পাতা আছে, কণ্ঠের পুরো তালিকাসহ, যাতে কাউকে সরাসরি ক্যাটালগের একটি তাকের লিংক পাঠানো যায়।
এই ক্যাটালগ সম্পর্কে
ক্লাউড প্রোভাইডারদের মধ্যে Google Cloud টেক্সট টু স্পিচের অন্যতম বৃহৎ ক্যাটালগ চালায়। এতে ১০টি মডেল পরিবার: নিউরাল কণ্ঠকে মূলধারায় আনা WaveNet থেকে শুরু করে Gemini কণ্ঠ পর্যন্ত, যেগুলো আপনার বর্ণনা করা সুর অনুযায়ী পরিবেশনা বদলায়। Gemini আসলে এক-এ ৪টি মডেল: প্রতিটি Gemini কণ্ঠ যেকোনো সাব-মডেল দিয়ে রেন্ডার হতে পারে, আর প্রতিটি রেন্ডারের এখানে নিজস্ব নমুনা আছে। ক্যাটালগের বাকি প্রতিটি কণ্ঠেরও নমুনা আছে।
Speakshelf স্বাধীন এবং Google, Amazon বা Kokoro প্রকল্পের সঙ্গে সম্পর্কিত নয়। কণ্ঠের তথ্য ও অডিও আসে AI TTS Microservice থেকে, যে সেবাটি Google, Amazon, Azure ও অন্যান্য স্পিচ প্রোভাইডারকে একটিমাত্র প্রবেশপথের পেছনে এক করে। নমুনা চাহিদামতো তৈরি হয়, তাই শোনা বিনামূল্যে।