Speakshelf

টেক্সট টু স্পিচ ক্যাটালগ

৪,৭৫৩ কণ্ঠ। একটাই তাক।

Speakshelf Google Cloud, Amazon Polly, Kokoro ও অন্যান্য প্রোভাইডারের টেক্সট টু স্পিচ কণ্ঠগুলোর তালিকা রাখে। প্রতিটির সঙ্গে ব্রাউজারে শোনার মতো নমুনা। কোনো অ্যাকাউন্ট নেই, কোনো সেটআপ নেই, শুধু কণ্ঠ।

৪,৭৫৩
কণ্ঠ
প্রোভাইডার
১০৫
ভাষা
১২,৬৪৭
শোনার মতো নমুনা

৩টি প্রোভাইডার

প্রতিটি প্রোভাইডারের নিজস্ব পূর্ণ তাক আছে: ফিল্টার ও প্লেব্যাকসহ কণ্ঠের পুরো তালিকা, প্রতিটি মডেল পরিবারের নোট, আর প্রতিটি ভাষার আলাদা পাতা। তাক বাড়ছে: AI TTS Microservice আরও প্রোভাইডার যুক্ত করছে, আর যাচাইয়ের পর নতুন তাক এখানে খোলে।

একটাই তাক কেন

ক্যাটালগের পার্থক্য শুধু আকারে নয়। পাশাপাশি রাখলেই ফাঁক, মিল আর প্রত্যেকটির চরিত্র চোখে পড়ে।

কভারেজ যোগ হয়

Amazon Polly আনে ওয়েলশ, যা Google Cloud-এ একেবারেই নেই, সঙ্গে English (Wales) ও আরবি (প্রমিত)-এর মতো আঞ্চলিক রূপও। একটাই তাক দেখিয়ে দেয় কোন প্রোভাইডারের কাছে কী আছে যা অন্যদের নেই।

শোনার একটাই পথ

প্রতিটি তাকে একই ফিল্টার, একই প্লেয়ার, একই কণ্ঠ-আইডি ব্যবস্থা। প্রোভাইডারে প্রোভাইডারে কণ্ঠ তুলনা মানে দুটো ক্লিক, দুটো কনসোল নয়।

নিজে থেকেই টাটকা

প্রতিটি তাক প্রতিদিন AI TTS Microservice থেকে হালনাগাদ হয়। নতুন কণ্ঠ, ভাষা আর সাব-মডেল কারও হাত না লাগিয়েই এখানে চলে আসে।

এই ক্যাটালগ সম্পর্কে

Speakshelf টেক্সট টু স্পিচ কণ্ঠের একটি রেফারেন্স ক্যাটালগ। আজ এতে ৩টি প্রোভাইডারের ৪,৭৫৩ কণ্ঠ আছে ১০৫টি ভাষায়, প্রতিটির সঙ্গে শোনার মতো নমুনা। কণ্ঠগুলো প্রোভাইডারদের নিজস্ব নিয়মেই সাজানো, অর্থাৎ মডেল পরিবার ও ইঞ্জিনে, যাতে আপনি যা শোনেন তা-ই আপনার ডিপ্লয়ের সঙ্গে মেলে।

Speakshelf স্বাধীন এবং Google, Amazon বা Kokoro প্রকল্পের সঙ্গে সম্পর্কিত নয়। কণ্ঠের তথ্য ও অডিও আসে AI TTS Microservice থেকে, যে সেবাটি Google, Amazon, Azure ও অন্যান্য স্পিচ প্রোভাইডারকে একটিমাত্র প্রবেশপথের পেছনে এক করে। নমুনা চাহিদামতো তৈরি হয়, তাই শোনা বিনামূল্যে।