شرح شغل:
در این جایگاه شغلی، فرد مسئول طراحی، توسعه و پیاده‌سازی راهکارهای مبتنی بر پردازش تصویر، بینایی ماشین و مدل‌های هوش مصنوعی چندوجهی (Vision-Language Models) خواهد بود. این نقش شامل توسعه مدل‌های یادگیری عمیق برای تحلیل تصاویر و ویدئو، طراحی سامانه‌های هوشمند مبتنی بر تصویر، پردازش داده‌های تصویری در مقیاس بزرگ و به‌کارگیری فناوری‌های نوین هوش مصنوعی در کاربردهای عملیاتی است.
کارشناس پردازش تصویر باید توانایی کار با مدل‌های پیشرفته بینایی ماشین، مدل‌های زبانی بزرگ و مدل‌های چندوجهی، توسعه Pipelineهای ترکیبی Vision + Language، بهینه‌سازی مدل‌ها و استقرار آن‌ها در محیط‌های واقعی را داشته باشد. همچنین این فرد در توسعه سامانه‌هایی مانند OCR هوشمند، جستجوی تصویری، تحلیل اسناد، تشخیص و ردیابی اشیا و کاربردهای مبتنی بر Generative AI مشارکت خواهد داشت.
 
شرایط احراز:
عمومی:
- توانایی تحلیل مسئله و ارائه راهکارهای مبتنی بر هوش مصنوعی
- علاقه‌مندی به تحقیق و توسعه در حوزه بینایی ماشین و فناوری‌های نوین AI
- توانایی یادگیری مستمر و به‌روز ماندن در حوزه پردازش تصویر و یادگیری عمیق
- توانایی کار تیمی و تعامل مؤثر با اعضای تیم‌های فنی
- مسئولیت‌پذیری، دقت بالا و توانایی انجام پروژه‌های تحقیقاتی و توسعه‌ای
 
تخصصی
- تجربه کار با مدل‌های زبانی بزرگ و مدل‌های چندوجهی (LLMs + Vision)
- تجربه کار با مدل‌های چندوجهی مانند CLIP، BLIP، Florence و LLaVA
- توانایی استفاده از LLMها در کاربردهای پردازش تصویر شامل تولید توضیح تصویر، Visual Question Answering و استخراج اطلاعات از تصاویر
- توانایی طراحی Pipelineهای Vision + Language برای تحلیل اسناد، OCR هوشمند و سیستم‌های جستجوی تصویری
- تجربه کار با APIهای مدل‌های بزرگ مانند OpenAI Vision، Gemini Vision و Azure Vision Services
- آشنایی با مدل‌های Diffusion شامل Stable Diffusion، ControlNet و Image-to-Image
- تسلط بر مفاهیم پردازش تصویر کلاسیک شامل فیلترها، تبدیل‌ها، استخراج ویژگی‌ها (SIFT، SURF، ORB)، مورفولوژی و هیستوگرام‌ها
- تسلط بر بینایی ماشین مبتنی بر یادگیری عمیق شامل CNN و معماری‌هایی مانند ResNet، EfficientNet و MobileNet
- تجربه کار با مدل‌های تشخیص و طبقه‌بندی اشیا شامل YOLO، Faster R-CNN و RetinaNet
- تجربه کار با مدل‌های بخش‌بندی تصویر شامل U-Net، DeepLab و Mask R-CNN
- آشنایی با الگوریتم‌های ردیابی اشیا شامل SORT، DeepSORT و ByteTrack
- آشنایی با پردازش ویدئو شامل استخراج فریم، Optical Flow و مدل‌های سه‌بعدی مانند I3D و SlowFast
- تسلط به زبان برنامه‌نویسی Python برای توسعه مدل‌های هوش مصنوعی
- تسلط به کتابخانه‌های یادگیری عمیق شامل PyTorch، TensorFlow و Keras
- آشنایی با MLOps و استقرار مدل شامل Docker، FastAPI، ONNX و TensorRT
- تجربه پردازش داده‌های تصویری در مقیاس بزرگ با ابزارهایی مانند DALI، WebDataset و Ray
- آشنایی با پردازش GPU و شتاب‌دهی محاسباتی شامل CUDA و cuDNN
 
اطلاعات تکمیلی:
- ساعت کاری: شنبه تا چهارشنبه 7:00 تا 15:50 (با یکساعت شناوری)
- حقوق: توافقی
- مدرک تحصیلی: مهندسی کامپیوتر
- حداقل تحصیلات: کاردانی / کارشناسی
- سابقه کار: حداقل 1 سال
- جنسیت: آقا