MOLLKOM / هوش مصنوعی و یادگیری ماشین
مهندس پژوهشگر، ارزیابی هوش مصنوعی و پایداری ایجنتها (Research Engineer, AI Evaluation & Agent Reliability)
تبدیل برداشت ذهنی از کیفیت هوش مصنوعی به شواهد عینی برای تصمیمگیریهای بهتر.
مأموریت ما
نتایج کسبوکار فراتر از پاسخهای سلیس متنی است. چارچوبهای ارزیابی طراحی کنید که متن جذاب، اطلاعات صحیح و اجرای موفقیتآمیز عملیات را از یکدیگر تفکیک کرده و به انتشار بهبودها با اثرات قابل اندازهگیری کمک کنند.
مسئولیتها و حوزههای کاری شما
- ساخت بنچمارکها و معیارهای سنجش برای کاتالوگ، محتوا، گفتگوها و وظایف مبتنی بر ابزار.
- طراحی سنجهها و سامانههای ارزیابی انسانی/خودکار همراه با تحلیل میزان همبستگی، سوگیری و پوشش دادهها.
- توسعه آزمونهای رگرسیون و آزمونهای مقابلهای (adversarial tests) برای پایش مجوزها و ادعاهای نامعتبر.
- تحلیل آزمایشها و مقایسه مدلها، و گزارش یافتههای کاربردی همراه با محدودیتهای آماری.
توانمندیها و مهارتهای شما
- تجربه کاری در ارزیابی یادگیری ماشین، پژوهش کاربردی یا مهندسی کیفیت هوش مصنوعی.
- تسلط بالا به Python، تحلیل داده و طراحی سیستماتیک آزمایشها.
- شناخت محدودیتهای رویکرد LLM-as-judge، نشت اطلاعات (data leakage) و سوگیری ارزیابی.
- توانایی انتقال شفاف نتایج و ترجمه یافتههای تحلیلی به بهینهسازیهای مهندسی.
طرز تفکر و شیوه کار خود را نشان دهید
بگذارید کارهایتان شروعکننده گفتگو باشند.
ارائه نمونهای از یک چارچوب ارزیابی که طراحی کردهاید و توضیح نحوه اثرگذاری آن بر تصمیمات انتشار یا انتخاب مدل.
پیوندهای عمومی یا توضیحی کوتاه ارائه دهید، بدون افشای اطلاعات محرمانه پروژههای پیشین.
درباره Mollkom
پلتفرم Mollkom یک محیط عملیاتی یکپارچه و مبتنی بر هوش مصنوعی برای تجارت است. ما فرآیندهای ثبت و آمادهسازی کالا، تولید محتوا، بازاریابی و پشتیبانی مشتریان را به سفارشها، انبارداری، صندوق فروشگاهی و تحویل متصل میکنیم تا همه بخشها بر پایه دانشی مشترک عمل کنند.
آشنایی با پلتفرم