استخدام کارشناس یادگیری ماشینی گفتار و صوت (Speech/Audio ML Engineer)
شرح موقعیت شغلی
شرح شغل
توسعه راهکارهای مبتنی بر یادگیری ماشین برای کاربردهای گفتار و صوت، شامل تشخیص خودکار گفتار (ASR)، تبدیل متن به گفتار (TTS)، بهبود کیفیت گفتار، وظایف مرتبط با شناسایی و تفکیک گویندگان و درک محتوای صوتی.
مسئولیتها
- توسعه و تنظیم دقیق مدلهای تشخیص گفتار و پردازش صوت.
- آمادهسازی، پاکسازی، قطعهبندی و اعتبارسنجی مجموعهدادههای صوتی در مقیاس بزرگ.
- توسعه زنجیرههای پردازش پیشپردازش و افزایش دادههای صوتی.
- ارزیابی مدلها با استفاده از معیارهایی مانند نرخ خطای کلمه (WER) و نرخ خطای نویسه (CER).
- انجام تحلیل تفصیلی خطاها با در نظر گرفتن تفاوتهای لهجهای، محیطهای مختلف، گویندگان و شرایط ضبط صدا.
- تنظیم دقیق مدلها برای گفتارهای تخصصی و حوزهمحور، مانند فایلهای صوتی مراکز تماس.
- بهبود دقت، سرعت پاسخگویی و پایداری مدلها.
- کار با فناوریهای تشخیص فعالیت صوتی (VAD)، تفکیک گویندگان (Diarization)، بهبود کیفیت گفتار و فناوریهای مرتبط با پردازش صوت.
- بهینهسازی مدلها برای اجرای فرایند استنتاج در محیط عملیاتی.
شرایط احراز و الزامات
- تسلط عملی بر زبان برنامهنویسی Python.
- تسلط بر مفاهیم یادگیری عمیق و پردازش گفتار و صوت.
- تجربه عملی کار با سامانههای تشخیص خودکار گفتار (ASR) یا سایر سامانههای یادگیری ماشین در حوزه گفتار.
- تجربه در آموزش و تنظیم دقیق مدلها.
- تجربه در آمادهسازی و ارزیابی مجموعهدادههای گفتاری.
- آشنایی با معیارهای ارزیابی مانند WER و CER.
- توانمندی بالا در اشکالزدایی و تحلیل خطا.
مزیت محسوب میشود
- تجربه در زمینه تشخیص گفتار فارسی.
- تجربه کار با فناوریهای VAD، تفکیک گویندگان، تبدیل متن به گفتار (TTS) یا بهبود کیفیت گفتار.
- تجربه کار با ابزارهای پردازش صوت مانند FFmpeg.
- تجربه کار با Ray Serve، vLLM یا سایر چارچوبهای استنتاج مدل.
مهارتهای مورد نیاز
- یادگیری ماشین
- Python
- پردازش صوت
حداقل سابقه کار
- کمتر از سه سال
حقوق
- حقوق از ۴۰,۰۰۰,۰۰۰ تومان
جنسیت
- مهم نیست
وضعیت نظام وظیفه
- معافیت دائم پایان خدمت