فکر مدرن | FekreModern

استخدام مهندس هوش مصنوعی گفتار (Speech AI Engineer)

  • دسته‌بندی شغلی

    وب،‌ برنامه‌نویسی و نرم‌افزار
  • موقعیت مکانی

    تهران ، تهران
  • نوع همکاری

    تمام وقت
  • حداقل سابقه کار

    سه تا شش سال
  • حقوق

    توافقی

شرح موقعیت شغلی

شرکت فکر مدرن برای توسعه محصولات و راهکارهای مبتنی بر پردازش گفتار و هوش مصنوعی، به یک مهندس هوش مصنوعی گفتار (Speech AI Engineer) خلاق، تحلیل‌گر و مسلط به فناوری‌های پردازش صوت و یادگیری ماشین نیاز دارد.

اگر در زمینه Speech Recognition، پردازش سیگنال صوتی، مدل‌های یادگیری عمیق و توسعه سیستم‌های صوتی هوشمند تجربه دارید، این فرصت برای شما مناسب است.

شرح وظایف

• طراحی و توسعه سیستم‌های هوشمند پردازش گفتار و صوت
• توسعه و بهینه‌سازی سیستم‌های تبدیل گفتار به متن (Speech-to-Text / ASR)
• توسعه راهکارهای تبدیل متن به گفتار (Text-to-Speech / TTS)
• پردازش و تحلیل سیگنال‌های صوتی
• آموزش، Fine-tune و ارزیابی مدل‌های Speech AI
• آماده‌سازی، پاک‌سازی و برچسب‌گذاری Datasetهای صوتی
• طراحی Pipelineهای پردازش داده‌های صوتی
• ارزیابی کیفیت مدل‌ها و تحلیل خطاهای تشخیص گفتار
• بهبود دقت مدل‌ها در محیط‌های نویزی و شرایط مختلف ضبط صدا
• کار با مدل‌های Deep Learning برای پردازش گفتار
• پیاده‌سازی مدل‌های Speech Recognition و Speech Synthesis
• تحقیق و ارزیابی مدل‌ها و فناوری‌های جدید حوزه Speech AI
• بهینه‌سازی مدل‌ها برای استفاده در محیط Production
• توسعه API و سرویس‌های مبتنی بر مدل‌های صوتی
• همکاری با تیم Backend و AI برای یکپارچه‌سازی مدل‌ها
• مستندسازی مدل‌ها، آزمایش‌ها و فرآیندهای توسعه
• پایش عملکرد مدل‌ها و بهبود مستمر آن‌ها

شرایط احراز

• حداقل ۲ سال تجربه عملی در حوزه AI، Machine Learning یا Speech Processing
• مدرک کارشناسی یا کارشناسی ارشد مهندسی کامپیوتر، هوش مصنوعی، برق، علوم کامپیوتر یا رشته‌های مرتبط
• تسلط مناسب به Python
• آشنایی عمیق با Machine Learning و Deep Learning
• آشنایی با اصول پردازش سیگنال و داده‌های صوتی
• تجربه کار با Speech-to-Text یا Text-to-Speech
• تجربه کار با مدل‌های Deep Learning
• آشنایی با PyTorch یا TensorFlow
• آشنایی با NumPy، Pandas و ابزارهای پردازش داده
• آشنایی با Git و اصول توسعه نرم‌افزار
• توانایی تحلیل نتایج آزمایش‌ها و مدل‌ها
• تسلط مناسب به زبان انگلیسی برای مطالعه مقالات و مستندات تخصصی

امتیازات ویژه

• تجربه کار با Whisper یا مدل‌های مشابه Speech Recognition
• تجربه Fine-tuning مدل‌های صوتی
• آشنایی با Hugging Face و Transformers
• تجربه کار با Wav2Vec2، HuBERT یا مدل‌های مشابه
• تجربه توسعه TTS و Voice Cloning
• آشنایی با Speaker Recognition و Speaker Diarization
• تجربه Voice Activity Detection (VAD)
• آشنایی با Audio Classification
• تجربه کار با داده‌های صوتی فارسی
• تجربه توسعه سیستم‌های Speech AI برای زبان فارسی
• آشنایی با مدل‌های Multimodal
• تجربه Deploy مدل‌های AI در محیط Production
• آشنایی با Docker و API Development
• آشنایی با GPU و CUDA
• تجربه کار با Cloud AI Infrastructure
• داشتن مقاله، پروژه متن‌باز یا نمونه‌کار تخصصی در حوزه Speech AI

مهارت‌های فردی

• تفکر تحلیلی
• حل مسئله
• علاقه به تحقیق و توسعه
• دقت و توجه به جزئیات
• یادگیری سریع
• توانایی مطالعه مقالات و منابع تخصصی
• خلاقیت
• مسئولیت‌پذیری
• توانایی کار تیمی
• مدیریت زمان
• توانایی مستندسازی
• روحیه آزمون و خطا و بهبود مستمر

شاخص‌های ارزیابی عملکرد

• دقت مدل‌های Speech-to-Text
• کاهش نرخ خطای تشخیص گفتار (WER)
• کیفیت خروجی مدل‌های Text-to-Speech
• سرعت و پایداری سرویس‌های صوتی
• کیفیت Datasetها و Pipelineهای داده
• میزان موفقیت مدل‌ها در شرایط واقعی
• سرعت توسعه و آزمایش مدل‌های جدید
• کیفیت مستندسازی و گزارش آزمایش‌ها
• میزان بهبود مدل‌ها پس از Fine-tuning
• موفقیت مدل‌ها در محیط Production

شرایط همکاری

نوع همکاری: تمام‌وقت و حضوری

ساعات کاری: شنبه تا پنج‌شنبه، ۹ الی ۱۷

امکان دورکاری در صورت حسن انجام کار و هماهنگی با تیم فنی وجود دارد.

حقوق و مزایا

• حقوق ثابت رقابتی و منصفانه
• پاداش عملکرد
• پاداش پروژه‌های موفق تحقیق و توسعه
• بیمه تأمین اجتماعی
• بیمه تکمیلی
• سنوات
• پرداخت عیدی
• وام سازمانی
• تسهیلات گردشگری
• ناهار
• بن خرید
• پزشک سازمانی
• پرداخت اضافه‌کاری
• آموزش تخصصی و دسترسی به منابع علمی
• دسترسی به زیرساخت‌های محاسباتی و ابزارهای AI
• بسته‌ها و هدایای مناسبتی
• افزایش حقوق بر اساس عملکرد
• امکان رشد و ارتقای شغلی
• همکاری بلندمدت در صورت رضایت دوطرفه
• محیط کاری حرفه‌ای و تحقیقاتی

توضیح مهم

مهندس هوش مصنوعی گفتار در شرکت فکر مدرن مسئول طراحی، توسعه، آموزش و بهینه‌سازی راهکارهای هوشمند مبتنی بر صوت و گفتار خواهد بود.

تمرکز این جایگاه می‌تواند شامل Speech Recognition، Speech-to-Text، Text-to-Speech، Speaker Recognition، Speaker Diarization و پردازش سیگنال‌های صوتی باشد.

فرد موردنظر باید توانایی کار با داده‌های واقعی صوتی، آماده‌سازی Dataset، آموزش و Fine-tune مدل‌ها و ارزیابی عملکرد آن‌ها را داشته باشد و بتواند مدل‌های توسعه‌یافته را برای استفاده در محصولات و سرویس‌های واقعی آماده کند.

تجربه کار با داده و زبان فارسی مزیت بسیار مهمی محسوب می‌شود؛ به‌خصوص تجربه بهبود عملکرد مدل‌ها در شرایطی مانند نویز محیطی، لهجه‌ها، گفتار محاوره‌ای و کیفیت‌های متفاوت ضبط صدا.

داشتن نمونه پروژه واقعی، GitHub، مقاله، مدل آموزش‌دیده یا Demo در حوزه Speech AI برای این موقعیت یک امتیاز مهم محسوب می‌شود.

لطفاً در رزومه خود مدل‌ها و فریم‌ورک‌های مورد استفاده، پروژه‌های Speech AI، Datasetهای مورد کار، زبان‌های مورد پشتیبانی و لینک نمونه‌کارهای فنی خود را درج نمایید.

معرفی شرکت

خانواده فکر مدرن یک آژانس خلاقیت ، دیجیتال مارکتینگ و شتاب دهنده کسب و کار ها است که فعالیت خود را از بهمن ۱۳۹۶ آغاز کرده است. ما با تمرکز بر توسعه هوش مصنوعی ، تولید و توسعه انواع وب سایت ها ، اپلیکیشن ها ، برنامه نویسی و کدنویسی اختصاصی انواع پلتفرم ها و راه اندازی انواع کسب و کار ها و مشاوره به آن ها به بهبود و رشد کسب و کار ها کمک میکنیم.
  • مهارت‌های مورد نیاز

    پردازش گفتار Pytorch هوش مصنوعی
  • جنسیت

    مهم نیست
  • وضعیت نظام وظیفه

    مهم‌ نیست
  • حداقل مدرک تحصیلی

    مهم نیست

مشاغل مشابه

چه موردی را می‌خواهید گزارش کنید؟

از اینجا شروع کنید

در شغل بهتری استخدام شوید! رایگان!

  • جستجو و ارسال رزومه به آگهی‌های استخدام بیش از ۱۰۰,۰۰۰ شرکت ایرانی
  • رزومه‌ساز رایگان
  • دریافت فرصت‌های شغلی جدید مرتبط از طریق ایمیل (Job Alert)
  • شناخت محیط کار و فرهنگ سازمانی شرکت‌های در حال استخدام
image/svg+xml