دایرکتوری فارسی ابزارهای هوش مصنوعی NextList → بازگشت به لیست
Gandr
Gandr

Gandr

تبدیل متن به گفتار دوره آزمایشی رایگان بازدید 432 بوکمارک 17

توضیحات

گندر یک API تبدیل متن به گفتار و شبیه‌سازی صدا برای ایجنت‌های صوتی است. صداها به جای اینکه پس از اتمام رندر کل کلیپ تحویل داده شوند، به‌صورت قطعه‌قطعه (چانک) در حین تولید استریم می‌شوند؛ بنابراین یک ایجنت تلفنی می‌تواند پخش صدا را پیش از اتمام تولید بقیه آن آغاز کند. گندر بخش‌هایی را که معمولاً سیستم‌ها در خواندن آن‌ها دچار مشکل می‌شوند، به خوبی می‌خواند؛ شماره سفارش‌ها، تاریخ‌ها، شماره تلفن‌ها و آدرس‌ها دقیقا به همان شکلی خوانده می‌شوند که یک انسان آن‌ها را ادا می‌کند. این ابزار در آزمون استاندارد نرخ خطای کلمه (WER)، امتیاز ۱.۹۸ درصد را در مقایسه با معیار انسانی ۲.۱۷ درصدی که از همین ارزیاب عبور داده شده بود، کسب کرد. تنها یک صدای شبیه‌سازی‌شده می‌تواند به ۲۳ زبان صحبت کند، از جمله زبان‌هایی که هرگز در فایل صوتی مرجع وجود نداشته‌اند. فرآیند شبیه‌سازی تنها به یک کلیپ مرجع ۱۰ ثانیه‌ای نیاز دارد، هیچ‌گونه هزینه اضافی به ازای هر صدا دریافت نمی‌شود و صدای شبیه‌سازی‌شده برای استفاده مجدد در حافظه پنهان (کد) ذخیره می‌گردد. قابلیت استریم برای ایجنت‌ها از طریق WebSocket و برای گویندگی و دوبله از طریق HTTP انجام می‌شود. این ابزار برای کتاب‌های صوتی، دوبله، ویدیو، آموزش الکترونیکی، بازی‌ها، پادکست‌ها و خطوط پشتیبانی کاملاً مناسب است. هیچ‌گونه داده کاربری وارد هیچ مجموعه آموزشی (مربوط به هوش مصنوعی) نمی‌شود. هر کلیپ سنتز شده داراى یک واترمارک غیرقابل شنیدن است تا صدای تولید شده در مراحل بعدی نیز قابل شناسایی باقی بماند. قیمت‌گذاری به‌طور کامل منتشر شده است. یک کلید رایگان شامل ۱۰۰,۰۰۰ توکن بدون نیاز به کارت اعتباری ارائه می‌شود. پلن‌های پولی از ۱۰ دلار در ماه شروع می‌شوند و استریم نامحدود و بدون محدودیتِ حجم (Flat)، با قیمت ۱۵۰ دلار در ماه برای تیم‌هایی در نظر گرفته شده که ترجیح می‌دهند دیگر شمارش مصرف را متوقف کنند. ویژگی‌های پشتیبانی‌شده: API | MCP | ایجنت‌ها | API گفتار ویژگی‌های کلیدی: • استریم نامحدود و بدون محدودیت حجمی • شبیه‌سازی فوری صدا از روی یک کلیپ مرجع • پشتیبانی از ۲۳ زبان • واترمارک غیرقابل شنیدن روی هر خروجی رندر شده • APIهای Rest + SSE + Websocket • فرهنگ لغت تلفظ اختصاصی برای هر مشتری • سرور MCP و کیت‌های توسعه نرم‌افزار (SDK) پایتون / JS / Pipecat • عدم استفاده از داده‌های مشتری در هیچ‌گونه مجموعه آموزشی

برچسب‌ها

APITAAFT CodeText To SpeechVoice CloningAI Voice AgentsVoice Agents
مشاهده سایت بازگشت