MOLLKOM / MI és gépi tanulás
Research Engineer, AI Evaluation & Agent Reliability
Alakítsa a mesterséges intelligencia minőségét puszta benyomásból a megalapozott döntések bizonyítékává.
A küldetés
A valós kereskedelmi eredményekhez a folyékony fogalmazásnál többre van szükség. Tervezzen olyan értékeléseket, amelyek különbséget tesznek a jó szövegezés, a helyes információ és a sikeresen végrehajtott művelet között, segítve a csapatot a mérhető hatású fejlesztések kiadásában.
Amivel foglalkozni fog
- Építsen teljesítményértékeléseket a katalógus-, tartalom-, beszélgetés- és eszközhasználati feladatokhoz.
- Tervezzen értékelési szempontrendszereket és emberi/automatizált vizsgálatokat egyezési, torzítási és lefedettségi elemzéssel.
- Fejlesszen regressziós és ellenfél-teszteket a jogosultságok és az alátámasztatlan állítások vizsgálatára.
- Elemezzen kísérleteket és modell-összehasonlításokat, jól hasznosítható megállapításokat és statisztikai korlátokat bemutatva.
Amit Öntől várunk
- Tapasztalat az ML-értékelés, az alkalmazott kutatás vagy az MI-minőségbiztosítás terén.
- Erős Python, adatelemzési és kísérlettervezési ismeretek.
- Az „LLM-as-judge” megközelítés korlátainak, az adatszivárgásnak és az értékelési torzításoknak az ismerete.
- Képesség az eredmények egyértelmű kommunikálására és a megállapítások mérnöki fejlesztésekké formálására.
MUTASSA MEG, HOGYAN GONDOLKODIK
Beszéljenek a korábbi munkái.
Mutasson be egy Ön által tervezett értékelést, és fejtse ki, hogyan változtatott meg egy kiadási vagy modellválasztási döntést.
Osszon meg nyilvános hivatkozásokat vagy egy rövid összefoglalót a korábbi munkák bizalmas információinak felfedése nélkül.
A Mollkomról
A Mollkom egy mesterséges intelligenciára épülő kereskedelmi operációs környezet. Összekapcsoljuk a termékelőkészítést, a tartalmat, a marketinget és az ügyfélszolgálatot a megrendelésekkel, a készlettel, a pénztári rendszerrel és a kézbesítéssel, így a munkafolyamatok közös ismeretanyagra épülnek.
Ismerje meg a platformot