
گفتار به متن
گفتار را در لحظه به متن تبدیل کنید
گفتگوها، فایلهای صوتی و جلساتتان را با دقت بالا رونویسی کنید — با تفکیک گویندگان و یادداشتبرداری هوشمند
بیشتر درباره گفتار به متنپژواک مجموعهای از مدلهای هوش مصنوعی گفتار است که بهطور اختصاصی برای زبان فارسی ساخته شدهاند: گفتار به متن، که صدا را در لحظه به متن تبدیل میکند، و متن به گفتار، که نوشتهٔ فارسی را با صدایی طبیعی میخواند.

گفتار به متن
گفتگوها، فایلهای صوتی و جلساتتان را با دقت بالا رونویسی کنید — با تفکیک گویندگان و یادداشتبرداری هوشمند
بیشتر درباره گفتار به متن
متن به گفتار
برای محتوا، ویدیو و دستیارهای صوتیتان صدایی طبیعی و روان تولید کنید
بیشتر درباره متن به گفتار
پلتفرم EchoPrime
ایجنتهای صوتی برای پاسخگویی به تلفن بسازید — با امکان استفاده از مدلهای پژواک — و تماسهای مراکز تماس را آنالیز کنید
ورود به پلتفرم EchoPrimeمدلها در آزمایشگاههای پژواک آموزش دیدهاند و روی زیرساخت داخل ایران میزبانی میشوند؛ به همین دلیل، علاوه بر کیفیت بالا، تأخیر بسیار پایینی دارند و میتوانند در تولید محتوا، ایجنتهای صوتی و استقرار درونسازمانی به کار بروند.
پژواک یک مجموعه مدل هوش مصنوعی گفتار برای زبان فارسی است که گفتار را به متن و متن را به گفتار تبدیل میکند. مدلها در آزمایشگاههای پژواک آموزش دیده و روی زیرساخت خودِ پژواک میزبانی میشوند.
مدلهای عمومی معمولاً فارسی را بهعنوان یک زبان فرعی پشتیبانی میکنند. در پژواک، فارسی زبان اصلی است: اعداد فارسی، نیمفاصله، متن کلاسیک و گفتار محاورهای از ابتدا در دادهٔ آموزشی هستند. علاوه بر این، پردازش روی زیرساخت داخلی انجام میشود و صدا به سرویس شخص ثالث فرستاده نمیشود.
بله. هر دو مدل گفتار به متن و متن به گفتار روی همین صفحه قابل استفادهاند و برای امتحان کردن نیازی به ثبتنام یا کارت بانکی نیست.
هر کسی میتواند صدای مورد نظر خودش را شبیهسازی (کلون) کرده و از آن برای تولید صدا استفاده کند.
در حال حاضر تمرکز روی فارسی است و زبانهای بیشتر در دست کار است.
EchoPrime پلتفرم ساخت ایجنتهای صوتی است؛ با آن میتوان عاملهایی ساخت که به تماس تلفنی پاسخ میدهند و تماسهای مرکز تماس را تحلیل میکنند. EchoPrime میتواند از مدلهای گفتاری پژواک استفاده کند.
بله، استقرار اختصاصی و on-prem برای سازمانها امکانپذیر است. برای این کار با ما تماس بگیرید.
آموزش و اجرای مدلها روی زیرساخت خودمان انجام میشود؛ صدای شما به سرویس شخص ثالث فرستاده نمیشود.
مدل روی معماری متمرکز بر فارسی ساخته شده و سرویس هم داخل کشور اجرا میشود؛ همین دو، پاسخ را برای کاربردهای بلادرنگ مانند ایجنتهای صوتی سریع نگه میدارد.
سازمانها میتوانند مدلها را روی زیرساخت خودشان مستقر کنند؛ صدا و داده از شبکهٔ خودشان بیرون نمیرود.