بازگشت به فرصت‌ها
لوگوی مشاور مدیریت و خدمات ماشینی تامین | Tamin ICT
جدیدفارسی

کارشناس یادگیری ماشینی گفتار و صوت (Speech/Audio ML Engineer)

مشاور مدیریت و خدمات ماشینی تامین | Tamin ICT·تهران·امروز

حضوریمیان‌سطحقراردادیتوافقی

مشاور مدیریت و خدمات ماشینی تامین | Tamin ICT

شرح موقعیت

شرح شغل توسعه راهکارهای مبتنی بر یادگیری ماشین برای کاربردهای گفتار و صوت، شامل تشخیص خودکار گفتار (ASR)، تبدیل متن به گفتار (TTS)، بهبود کیفیت گفتار، وظایف مرتبط با شناسایی و تفکیک گویندگان و درک محتوای صوتی. شرایط احراز و الزامات مزیت محسوب می‌شود

مسئولیت‌ها

  • توسعه و تنظیم دقیق مدل‌های تشخیص گفتار و پردازش صوت.
  • آماده‌سازی، پاک‌سازی، قطعه‌بندی و اعتبارسنجی مجموعه‌داده‌های صوتی در مقیاس بزرگ.
  • توسعه زنجیره‌های پردازش پیش‌پردازش و افزایش داده‌های صوتی.
  • ارزیابی مدل‌ها با استفاده از معیارهایی مانند نرخ خطای کلمه (WER) و نرخ خطای نویسه (CER).
  • انجام تحلیل تفصیلی خطاها با در نظر گرفتن تفاوت‌های لهجه‌ای، محیط‌های مختلف، گویندگان و شرایط ضبط صدا.
  • تنظیم دقیق مدل‌ها برای گفتارهای تخصصی و حوزه‌محور، مانند فایل‌های صوتی مراکز تماس.
  • بهبود دقت، سرعت پاسخ‌گویی و پایداری مدل‌ها.
  • کار با فناوری‌های تشخیص فعالیت صوتی (VAD)، تفکیک گویندگان (Diarization)، بهبود کیفیت گفتار و فناوری‌های مرتبط با پردازش صوت.
  • بهینه‌سازی مدل‌ها برای اجرای فرایند استنتاج در محیط عملیاتی.
  • تسلط عملی بر زبان برنامه‌نویسی Python.
  • تسلط بر مفاهیم یادگیری عمیق و پردازش گفتار و صوت.
  • تجربه عملی کار با سامانه‌های تشخیص خودکار گفتار (ASR) یا سایر سامانه‌های یادگیری ماشین در حوزه گفتار.
  • تجربه در آموزش و تنظیم دقیق مدل‌ها.
  • تجربه در آماده‌سازی و ارزیابی مجموعه‌داده‌های گفتاری.
  • آشنایی با معیارهای ارزیابی مانند WER و CER.
  • توانمندی بالا در اشکال‌زدایی و تحلیل خطا.
  • تجربه در زمینه تشخیص گفتار فارسی.
  • تجربه کار با فناوری‌های VAD، تفکیک گویندگان، تبدیل متن به گفتار (TTS) یا بهبود کیفیت گفتار.
  • تجربه کار با ابزارهای پردازش صوت مانند FFmpeg.
  • تجربه کار با Ray Serve، vLLM یا سایر چارچوب‌های استنتاج مدل.

نیازمندی‌ها

  • یادگیری ماشین
  • Python
  • پردازش صوت