MOLLKOM / AI और मशीन लर्निंग
Research Engineer, AI Evaluation & Agent Reliability
AI की गुणवत्ता को केवल एक धारणा से बदलकर बेहतर निर्णयों के साक्ष्य में बदलें।
हमारा मिशन
कॉमर्स परिणामों के लिए केवल धाराप्रवाह जवाबों से कहीं अधिक की आवश्यकता होती है। ऐसे मूल्यांकन डिज़ाइन करें जो अच्छे लेखन, सही जानकारी और पूरे किए गए एक्शन में अंतर कर सकें, जिससे टीम को मापने योग्य प्रभावों के साथ सुधार जारी करने में मदद मिले।
आप किस पर काम करेंगे
- कैटलॉग, कंटेंट, बातचीत और टूल-यूज़ कार्यों के लिए बेंचमार्क बनाएं।
- सहमति, पूर्वाग्रह और कवरेज विश्लेषण के साथ रूबरिक्स और मानव/स्वचालित मूल्यांकन डिज़ाइन करें।
- अनुमतियों और असमर्थित दावों के लिए रिग्रेशन और एडवरसैरियल टेस्ट विकसित करें।
- प्रयोगों और मॉडल तुलनाओं का विश्लेषण करें, व्यावहारिक निष्कर्षों और सांख्यिकीय सीमाओं को स्पष्ट रूप से संप्रेषित करें।
आपकी क्षमताएं
- ML मूल्यांकन, अनुप्रयुक्त अनुसंधान या AI गुणवत्ता इंजीनियरिंग में अनुभव।
- Python, डेटा विश्लेषण और प्रयोग डिज़ाइन में मजबूत पकड़।
- LLM-as-judge सीमाओं, डेटा लीकेज और मूल्यांकन पूर्वाग्रह की समझ।
- परिणामों को स्पष्ट रूप से संप्रेषित करने और निष्कर्षों को इंजीनियरिंग सुधारों में बदलने की क्षमता।
अपनी सोच दिखाएं
अपने काम को बातचीत की शुरुआत बनने दें।
अपने द्वारा डिज़ाइन किया गया एक मूल्यांकन साझा करें और बताएं कि उसने रिलीज़ या मॉडल-चयन के निर्णय को कैसे बदला।
पिछले काम की गोपनीय जानकारी प्रकट किए बिना सार्वजनिक लिंक या संक्षिप्त विवरण साझा करें।
Mollkom के बारे में
Mollkom एक AI-संचालित कॉमर्स ऑपरेटिंग एनवायरनमेंट है। हम प्रोडक्ट तैयारी, कंटेंट, मार्केटिंग और कस्टमर सर्विस को ऑर्डर, इन्वेंट्री, पॉइंट ऑफ़ सेल और डिलीवरी से जोड़ते हैं, ताकि सभी चरण साझा ज्ञान के आधार पर काम करें।
प्लेटफ़ॉर्म से परिचित हों