استخدام مهندس هوش مصنوعی گفتار (Speech AI Engineer)
دستهبندی شغلی
وب، برنامهنویسی و نرمافزار
موقعیت مکانی
تهران
، تهران
نوع همکاری
تمام وقت
حداقل سابقه کار
سه تا شش سال
حقوق
توافقی
شرح موقعیت شغلی
شرکت فکر مدرن برای توسعه محصولات و راهکارهای مبتنی بر پردازش گفتار و هوش مصنوعی، به یک مهندس هوش مصنوعی گفتار (Speech AI Engineer) خلاق، تحلیلگر و مسلط به فناوریهای پردازش صوت و یادگیری ماشین نیاز دارد.
اگر در زمینه Speech Recognition، پردازش سیگنال صوتی، مدلهای یادگیری عمیق و توسعه سیستمهای صوتی هوشمند تجربه دارید، این فرصت برای شما مناسب است.
شرح وظایف
• طراحی و توسعه سیستمهای هوشمند پردازش گفتار و صوت • توسعه و بهینهسازی سیستمهای تبدیل گفتار به متن (Speech-to-Text / ASR) • توسعه راهکارهای تبدیل متن به گفتار (Text-to-Speech / TTS) • پردازش و تحلیل سیگنالهای صوتی • آموزش، Fine-tune و ارزیابی مدلهای Speech AI • آمادهسازی، پاکسازی و برچسبگذاری Datasetهای صوتی • طراحی Pipelineهای پردازش دادههای صوتی • ارزیابی کیفیت مدلها و تحلیل خطاهای تشخیص گفتار • بهبود دقت مدلها در محیطهای نویزی و شرایط مختلف ضبط صدا • کار با مدلهای Deep Learning برای پردازش گفتار • پیادهسازی مدلهای Speech Recognition و Speech Synthesis • تحقیق و ارزیابی مدلها و فناوریهای جدید حوزه Speech AI • بهینهسازی مدلها برای استفاده در محیط Production • توسعه API و سرویسهای مبتنی بر مدلهای صوتی • همکاری با تیم Backend و AI برای یکپارچهسازی مدلها • مستندسازی مدلها، آزمایشها و فرآیندهای توسعه • پایش عملکرد مدلها و بهبود مستمر آنها
شرایط احراز
• حداقل ۲ سال تجربه عملی در حوزه AI، Machine Learning یا Speech Processing • مدرک کارشناسی یا کارشناسی ارشد مهندسی کامپیوتر، هوش مصنوعی، برق، علوم کامپیوتر یا رشتههای مرتبط • تسلط مناسب به Python • آشنایی عمیق با Machine Learning و Deep Learning • آشنایی با اصول پردازش سیگنال و دادههای صوتی • تجربه کار با Speech-to-Text یا Text-to-Speech • تجربه کار با مدلهای Deep Learning • آشنایی با PyTorch یا TensorFlow • آشنایی با NumPy، Pandas و ابزارهای پردازش داده • آشنایی با Git و اصول توسعه نرمافزار • توانایی تحلیل نتایج آزمایشها و مدلها • تسلط مناسب به زبان انگلیسی برای مطالعه مقالات و مستندات تخصصی
امتیازات ویژه
• تجربه کار با Whisper یا مدلهای مشابه Speech Recognition • تجربه Fine-tuning مدلهای صوتی • آشنایی با Hugging Face و Transformers • تجربه کار با Wav2Vec2، HuBERT یا مدلهای مشابه • تجربه توسعه TTS و Voice Cloning • آشنایی با Speaker Recognition و Speaker Diarization • تجربه Voice Activity Detection (VAD) • آشنایی با Audio Classification • تجربه کار با دادههای صوتی فارسی • تجربه توسعه سیستمهای Speech AI برای زبان فارسی • آشنایی با مدلهای Multimodal • تجربه Deploy مدلهای AI در محیط Production • آشنایی با Docker و API Development • آشنایی با GPU و CUDA • تجربه کار با Cloud AI Infrastructure • داشتن مقاله، پروژه متنباز یا نمونهکار تخصصی در حوزه Speech AI
مهارتهای فردی
• تفکر تحلیلی • حل مسئله • علاقه به تحقیق و توسعه • دقت و توجه به جزئیات • یادگیری سریع • توانایی مطالعه مقالات و منابع تخصصی • خلاقیت • مسئولیتپذیری • توانایی کار تیمی • مدیریت زمان • توانایی مستندسازی • روحیه آزمون و خطا و بهبود مستمر
شاخصهای ارزیابی عملکرد
• دقت مدلهای Speech-to-Text • کاهش نرخ خطای تشخیص گفتار (WER) • کیفیت خروجی مدلهای Text-to-Speech • سرعت و پایداری سرویسهای صوتی • کیفیت Datasetها و Pipelineهای داده • میزان موفقیت مدلها در شرایط واقعی • سرعت توسعه و آزمایش مدلهای جدید • کیفیت مستندسازی و گزارش آزمایشها • میزان بهبود مدلها پس از Fine-tuning • موفقیت مدلها در محیط Production
شرایط همکاری
نوع همکاری: تماموقت و حضوری
ساعات کاری: شنبه تا پنجشنبه، ۹ الی ۱۷
امکان دورکاری در صورت حسن انجام کار و هماهنگی با تیم فنی وجود دارد.
حقوق و مزایا
• حقوق ثابت رقابتی و منصفانه • پاداش عملکرد • پاداش پروژههای موفق تحقیق و توسعه • بیمه تأمین اجتماعی • بیمه تکمیلی • سنوات • پرداخت عیدی • وام سازمانی • تسهیلات گردشگری • ناهار • بن خرید • پزشک سازمانی • پرداخت اضافهکاری • آموزش تخصصی و دسترسی به منابع علمی • دسترسی به زیرساختهای محاسباتی و ابزارهای AI • بستهها و هدایای مناسبتی • افزایش حقوق بر اساس عملکرد • امکان رشد و ارتقای شغلی • همکاری بلندمدت در صورت رضایت دوطرفه • محیط کاری حرفهای و تحقیقاتی
توضیح مهم
مهندس هوش مصنوعی گفتار در شرکت فکر مدرن مسئول طراحی، توسعه، آموزش و بهینهسازی راهکارهای هوشمند مبتنی بر صوت و گفتار خواهد بود.
تمرکز این جایگاه میتواند شامل Speech Recognition، Speech-to-Text، Text-to-Speech، Speaker Recognition، Speaker Diarization و پردازش سیگنالهای صوتی باشد.
فرد موردنظر باید توانایی کار با دادههای واقعی صوتی، آمادهسازی Dataset، آموزش و Fine-tune مدلها و ارزیابی عملکرد آنها را داشته باشد و بتواند مدلهای توسعهیافته را برای استفاده در محصولات و سرویسهای واقعی آماده کند.
تجربه کار با داده و زبان فارسی مزیت بسیار مهمی محسوب میشود؛ بهخصوص تجربه بهبود عملکرد مدلها در شرایطی مانند نویز محیطی، لهجهها، گفتار محاورهای و کیفیتهای متفاوت ضبط صدا.
داشتن نمونه پروژه واقعی، GitHub، مقاله، مدل آموزشدیده یا Demo در حوزه Speech AI برای این موقعیت یک امتیاز مهم محسوب میشود.
لطفاً در رزومه خود مدلها و فریمورکهای مورد استفاده، پروژههای Speech AI، Datasetهای مورد کار، زبانهای مورد پشتیبانی و لینک نمونهکارهای فنی خود را درج نمایید.
خانواده فکر مدرن یک آژانس خلاقیت ، دیجیتال مارکتینگ و شتاب دهنده کسب و کار ها است که فعالیت خود را از بهمن ۱۳۹۶ آغاز کرده است. ما با تمرکز بر توسعه هوش مصنوعی ، تولید و توسعه انواع وب سایت ها ، اپلیکیشن ها ، برنامه نویسی و کدنویسی اختصاصی انواع پلتفرم ها و راه اندازی انواع کسب و کار ها و مشاوره به آن ها به بهبود و رشد کسب و کار ها کمک میکنیم.