Gandr
توضیحات
گندر یک API تبدیل متن به گفتار و شبیهسازی صدا برای ایجنتهای صوتی است. صداها به جای اینکه پس از اتمام رندر کل کلیپ تحویل داده شوند، بهصورت قطعهقطعه (چانک) در حین تولید استریم میشوند؛ بنابراین یک ایجنت تلفنی میتواند پخش صدا را پیش از اتمام تولید بقیه آن آغاز کند. گندر بخشهایی را که معمولاً سیستمها در خواندن آنها دچار مشکل میشوند، به خوبی میخواند؛ شماره سفارشها، تاریخها، شماره تلفنها و آدرسها دقیقا به همان شکلی خوانده میشوند که یک انسان آنها را ادا میکند. این ابزار در آزمون استاندارد نرخ خطای کلمه (WER)، امتیاز ۱.۹۸ درصد را در مقایسه با معیار انسانی ۲.۱۷ درصدی که از همین ارزیاب عبور داده شده بود، کسب کرد. تنها یک صدای شبیهسازیشده میتواند به ۲۳ زبان صحبت کند، از جمله زبانهایی که هرگز در فایل صوتی مرجع وجود نداشتهاند. فرآیند شبیهسازی تنها به یک کلیپ مرجع ۱۰ ثانیهای نیاز دارد، هیچگونه هزینه اضافی به ازای هر صدا دریافت نمیشود و صدای شبیهسازیشده برای استفاده مجدد در حافظه پنهان (کد) ذخیره میگردد. قابلیت استریم برای ایجنتها از طریق WebSocket و برای گویندگی و دوبله از طریق HTTP انجام میشود. این ابزار برای کتابهای صوتی، دوبله، ویدیو، آموزش الکترونیکی، بازیها، پادکستها و خطوط پشتیبانی کاملاً مناسب است. هیچگونه داده کاربری وارد هیچ مجموعه آموزشی (مربوط به هوش مصنوعی) نمیشود. هر کلیپ سنتز شده داراى یک واترمارک غیرقابل شنیدن است تا صدای تولید شده در مراحل بعدی نیز قابل شناسایی باقی بماند. قیمتگذاری بهطور کامل منتشر شده است. یک کلید رایگان شامل ۱۰۰,۰۰۰ توکن بدون نیاز به کارت اعتباری ارائه میشود. پلنهای پولی از ۱۰ دلار در ماه شروع میشوند و استریم نامحدود و بدون محدودیتِ حجم (Flat)، با قیمت ۱۵۰ دلار در ماه برای تیمهایی در نظر گرفته شده که ترجیح میدهند دیگر شمارش مصرف را متوقف کنند. ویژگیهای پشتیبانیشده: API | MCP | ایجنتها | API گفتار ویژگیهای کلیدی: • استریم نامحدود و بدون محدودیت حجمی • شبیهسازی فوری صدا از روی یک کلیپ مرجع • پشتیبانی از ۲۳ زبان • واترمارک غیرقابل شنیدن روی هر خروجی رندر شده • APIهای Rest + SSE + Websocket • فرهنگ لغت تلفظ اختصاصی برای هر مشتری • سرور MCP و کیتهای توسعه نرمافزار (SDK) پایتون / JS / Pipecat • عدم استفاده از دادههای مشتری در هیچگونه مجموعه آموزشی