MOLLKOM / هوش مصنوعی و یادگیری ماشین

مهندس پژوهشگر، ارزیابی هوش مصنوعی و پایداری ایجنت‌ها (Research Engineer, AI Evaluation & Agent Reliability)

تبدیل برداشت ذهنی از کیفیت هوش مصنوعی به شواهد عینی برای تصمیم‌گیری‌های بهتر.

ریاض، عربستان سعودیترکیبی (حضوری و دورکاری)ارشد (Senior)پذیرش درخواست‌ها فعال است

مأموریت ما

نتایج کسب‌وکار فراتر از پاسخ‌های سلیس متنی است. چارچوب‌های ارزیابی طراحی کنید که متن جذاب، اطلاعات صحیح و اجرای موفقیت‌آمیز عملیات را از یکدیگر تفکیک کرده و به انتشار بهبودها با اثرات قابل اندازه‌گیری کمک کنند.

مسئولیت‌ها و حوزه‌های کاری شما

  • ساخت بنچمارک‌ها و معیارهای سنجش برای کاتالوگ، محتوا، گفتگوها و وظایف مبتنی بر ابزار.
  • طراحی سنجه‌ها و سامانه‌های ارزیابی انسانی/خودکار همراه با تحلیل میزان همبستگی، سوگیری و پوشش داده‌ها.
  • توسعه آزمون‌های رگرسیون و آزمون‌های مقابله‌ای (adversarial tests) برای پایش مجوزها و ادعاهای نامعتبر.
  • تحلیل آزمایش‌ها و مقایسه مدل‌ها، و گزارش یافته‌های کاربردی همراه با محدودیت‌های آماری.

توانمندی‌ها و مهارت‌های شما

  • تجربه کاری در ارزیابی یادگیری ماشین، پژوهش کاربردی یا مهندسی کیفیت هوش مصنوعی.
  • تسلط بالا به Python، تحلیل داده و طراحی سیستماتیک آزمایش‌ها.
  • شناخت محدودیت‌های رویکرد LLM-as-judge، نشت اطلاعات (data leakage) و سوگیری ارزیابی.
  • توانایی انتقال شفاف نتایج و ترجمه یافته‌های تحلیلی به بهینه‌سازی‌های مهندسی.

طرز تفکر و شیوه کار خود را نشان دهید

بگذارید کارهایتان شروع‌کننده گفتگو باشند.

ارائه نمونه‌ای از یک چارچوب ارزیابی که طراحی کرده‌اید و توضیح نحوه اثرگذاری آن بر تصمیمات انتشار یا انتخاب مدل.

پیوندهای عمومی یا توضیحی کوتاه ارائه دهید، بدون افشای اطلاعات محرمانه پروژه‌های پیشین.

درباره Mollkom

پلتفرم Mollkom یک محیط عملیاتی یکپارچه و مبتنی بر هوش مصنوعی برای تجارت است. ما فرآیندهای ثبت و آماده‌سازی کالا، تولید محتوا، بازاریابی و پشتیبانی مشتریان را به سفارش‌ها، انبارداری، صندوق فروشگاهی و تحویل متصل می‌کنیم تا همه بخش‌ها بر پایه دانشی مشترک عمل کنند.

آشنایی با پلتفرم
ارسال درخواست برای این موقعیت شغلی