۲.۵ رونمایی کرد: تبدیل متن به گفتار چندزبانه با سرعت رکوردی و تاخیر زیر ۴۰۰ میلیثانیه

2.5 رونمایی کرد: تبدیل متن به گفتار چندزبانه با سرعت رکوردی و تاخیر زیر ۴۰۰ میلیثانیه

۲.۵ رونمایی کرد تبدیل متن به گفتار چندزبانه با سرعت رکوردی و تاخیر زیر ۴۰۰ میلیثانیه, شرکت پیشرو در حوزه هوش مصنوعی صوتی، با انتشار مدل جدید.۵، استانداردهای سرعت و کارایی در تکنولوژی تبدیل متن به گفتار (TTS) را به سطحی بالاتر برده است.

این موتور پیشرفته قادر است صدا را در ۳۲ زبان زنده با تاخیر ناچیز پردازش و تولید کند که از میان آنها میتوان به زبانهای تازهافزوده شده مانند ویتنامی، مجارستانی و نروژی اشاره کرد.\افزایش سهگانه سرعت در زبانهای پرکاربردبر اساس گزارش رسمی، معماری ۲.۵ سرعت ز گفتار را در زبانهای پرمخاطب چون هندی، فرانسوی، اسپانیایی و ماندارین تا سه برابر نسبت به نسلهای قبلی افزایش داده است.

بهرهگیری از الگوریتمهای بهینهسازی شده، خروجی صوتی با کیفیت استودیویی را در عرض کمتر از ۴۰۰ میلیثانیه تحویل میدهد.

این سطح عملکرد به معنای حذف کامل احساس توقف در تعاملات صوتی است که برای کاربردهای حساس به زمان حیاتی محسوب میشود.\کاربردها در سختافزارهای هوشمند و صنعت گیمینگپتانسیل بالا این مدل به توسعهدهندگان شخص ثالث از طریق API اجازه میدهد تا آن را در سختافزارهای هوشمند تعبیه کنند. مثال بارز، عینکهای کمکی برای افراد دارای ناتوانی بینایی است که متنهای محیطی را بلافاصله به صدا تبدیل و خوانده میشوند.

ا بر توسعه مدلهای AI قرار داده است.

مدیرعامل اخیراً اعلام کرد که تیم فعلی شامل حدود ۴۰ متخصص دورکاری در سراسر جهان میباشد و برنامهریزی برای گسترش نیرو تا سقف ۱۰۰ نفر تا پایان ۲۰۲۴ در دستور کار است. همزمان، ابزاری نوین تحت عنوان AI برای حذف نویز و صداهای محیطی مزاحم رونمایی شده که به پادکسترها و تولیدکنندگان ویدیو امکان میدهد با آپلود ساده فایلها، خروجی پاکسازی شده با کیفیت استودیویی دریافت کنند بدون نیاز به تجهیزات گرانقیمت یا مهارت فنی پیچیده.