MOLLKOM / AI और मशीन लर्निंग

Research Engineer, AI Evaluation & Agent Reliability

AI की गुणवत्ता को केवल एक धारणा से बदलकर बेहतर निर्णयों के साक्ष्य में बदलें।

रियाद, सऊदी अरबहाइब्रिडसीनियरआवेदन खुले हैं

हमारा मिशन

कॉमर्स परिणामों के लिए केवल धाराप्रवाह जवाबों से कहीं अधिक की आवश्यकता होती है। ऐसे मूल्यांकन डिज़ाइन करें जो अच्छे लेखन, सही जानकारी और पूरे किए गए एक्शन में अंतर कर सकें, जिससे टीम को मापने योग्य प्रभावों के साथ सुधार जारी करने में मदद मिले।

आप किस पर काम करेंगे

  • कैटलॉग, कंटेंट, बातचीत और टूल-यूज़ कार्यों के लिए बेंचमार्क बनाएं।
  • सहमति, पूर्वाग्रह और कवरेज विश्लेषण के साथ रूबरिक्स और मानव/स्वचालित मूल्यांकन डिज़ाइन करें।
  • अनुमतियों और असमर्थित दावों के लिए रिग्रेशन और एडवरसैरियल टेस्ट विकसित करें।
  • प्रयोगों और मॉडल तुलनाओं का विश्लेषण करें, व्यावहारिक निष्कर्षों और सांख्यिकीय सीमाओं को स्पष्ट रूप से संप्रेषित करें।

आपकी क्षमताएं

  • ML मूल्यांकन, अनुप्रयुक्त अनुसंधान या AI गुणवत्ता इंजीनियरिंग में अनुभव।
  • Python, डेटा विश्लेषण और प्रयोग डिज़ाइन में मजबूत पकड़।
  • LLM-as-judge सीमाओं, डेटा लीकेज और मूल्यांकन पूर्वाग्रह की समझ।
  • परिणामों को स्पष्ट रूप से संप्रेषित करने और निष्कर्षों को इंजीनियरिंग सुधारों में बदलने की क्षमता।

अपनी सोच दिखाएं

अपने काम को बातचीत की शुरुआत बनने दें।

अपने द्वारा डिज़ाइन किया गया एक मूल्यांकन साझा करें और बताएं कि उसने रिलीज़ या मॉडल-चयन के निर्णय को कैसे बदला।

पिछले काम की गोपनीय जानकारी प्रकट किए बिना सार्वजनिक लिंक या संक्षिप्त विवरण साझा करें।

Mollkom के बारे में

Mollkom एक AI-संचालित कॉमर्स ऑपरेटिंग एनवायरनमेंट है। हम प्रोडक्ट तैयारी, कंटेंट, मार्केटिंग और कस्टमर सर्विस को ऑर्डर, इन्वेंट्री, पॉइंट ऑफ़ सेल और डिलीवरी से जोड़ते हैं, ताकि सभी चरण साझा ज्ञान के आधार पर काम करें।

प्लेटफ़ॉर्म से परिचित हों
इस पद के लिए आवेदन करें