آگهی‌های استخدامی

استخدام کارشناس یادگیری ماشینی گفتار و صوت (Speech/Audio ML Engineer)

شرح موقعیت شغلی

شرح شغل

توسعه راهکارهای مبتنی بر یادگیری ماشین برای کاربردهای گفتار و صوت، شامل تشخیص خودکار گفتار (ASR)، تبدیل متن به گفتار (TTS)، بهبود کیفیت گفتار، وظایف مرتبط با شناسایی و تفکیک گویندگان و درک محتوای صوتی.

مسئولیت‌ها

  • توسعه و تنظیم دقیق مدل‌های تشخیص گفتار و پردازش صوت.
  • آماده‌سازی، پاک‌سازی، قطعه‌بندی و اعتبارسنجی مجموعه‌داده‌های صوتی در مقیاس بزرگ.
  • توسعه زنجیره‌های پردازش پیش‌پردازش و افزایش داده‌های صوتی.
  • ارزیابی مدل‌ها با استفاده از معیارهایی مانند نرخ خطای کلمه (WER) و نرخ خطای نویسه (CER).
  • انجام تحلیل تفصیلی خطاها با در نظر گرفتن تفاوت‌های لهجه‌ای، محیط‌های مختلف، گویندگان و شرایط ضبط صدا.
  • تنظیم دقیق مدل‌ها برای گفتارهای تخصصی و حوزه‌محور، مانند فایل‌های صوتی مراکز تماس.
  • بهبود دقت، سرعت پاسخ‌گویی و پایداری مدل‌ها.
  • کار با فناوری‌های تشخیص فعالیت صوتی (VAD)، تفکیک گویندگان (Diarization)، بهبود کیفیت گفتار و فناوری‌های مرتبط با پردازش صوت.
  • بهینه‌سازی مدل‌ها برای اجرای فرایند استنتاج در محیط عملیاتی.
شرایط احراز و الزامات

  • تسلط عملی بر زبان برنامه‌نویسی Python.
  • تسلط بر مفاهیم یادگیری عمیق و پردازش گفتار و صوت.
  • تجربه عملی کار با سامانه‌های تشخیص خودکار گفتار (ASR) یا سایر سامانه‌های یادگیری ماشین در حوزه گفتار.
  • تجربه در آموزش و تنظیم دقیق مدل‌ها.
  • تجربه در آماده‌سازی و ارزیابی مجموعه‌داده‌های گفتاری.
  • آشنایی با معیارهای ارزیابی مانند WER و CER.
  • توانمندی بالا در اشکال‌زدایی و تحلیل خطا.
مزیت محسوب می‌شود

  • تجربه در زمینه تشخیص گفتار فارسی.
  • تجربه کار با فناوری‌های VAD، تفکیک گویندگان، تبدیل متن به گفتار (TTS) یا بهبود کیفیت گفتار.
  • تجربه کار با ابزارهای پردازش صوت مانند FFmpeg.
  • تجربه کار با Ray Serve، vLLM یا سایر چارچوب‌های استنتاج مدل.

مهارت‌های مورد نیاز

  • یادگیری ماشین
  • Python
  • پردازش صوت

حداقل سابقه کار

  • کمتر از سه سال

حقوق

  • حقوق از ۴۰,۰۰۰,۰۰۰ تومان

جنسیت

  • مهم نیست

وضعیت نظام وظیفه

  • معافیت دائم پایان خدمت

نوع همکاری:

تمام وقت

تاریخ انتشار آگهی:

۱۴۰۵/۰۷/۱۴
ارسال رزومه