टेक्निकल स्टाफ़ के सदस्य, रिसर्च इंजीनियरिंग
भूमिका के बारे में
जॉब का शीर्षक: टेक्निकल स्टाफ़ के सदस्य, रिसर्च इंजीनियरिंग जॉब का प्रकार: फ़ुल-टाइम स्थान: रिमोट हम एक रिसर्च इंजीनियर की तलाश में हैं जो रीइन्फ़ोर्समेंट लर्निंग (RL) के अग्रणी मोर्चे पर काम करे, और ऐसे नए एनवायरनमेंट, ट्रेनिंग पाइपलाइन और मूल्यांकन सिस्टम विकसित करे जो आधुनिक AI मॉडल की क्षमताओं को आगे बढ़ाएँ। यह भूमिका रिसर्च और प्रोडक्शन के संगम पर है, जहाँ प्रयोगात्मक विचारों को स्केलेबल, उच्च-प्रदर्शन वाले सिस्टम में बदला जाता है।
आप किन चीज़ों पर काम करेंगे
- ऐसे स्वतंत्र RL एनवायरनमेंट का आर्किटेक्चर तैयार करें जो जटिल, वास्तविक दुनिया के टास्क को दर्शाएँ, जिनमें रिवॉर्ड फ़ंक्शन, वेरिफ़ायर और मूल्यांकन लॉजिक शामिल हैं।
- पुनरुत्पादन-योग्य प्रयोगों में सहायता के लिए एपिसोड पाइपलाइन और बहु-घटक ट्रेनिंग प्रक्रियाओं (MCPs) को डिज़ाइन करें और स्केल करें।
- ऑटोमेटेड डेटा जनरेशन सिस्टम बनाएँ, और गुणवत्ता से समझौता किए बिना ट्रेनिंग चक्रों को तेज़ करने के लिए सिंथेटिक डेटा का उपयोग करें।
- ऑटोमेटेड ग्रेडिंग, सत्यापन और फ़ीडबैक लूप के लिए AI-संचालित मूल्यांकन और क्वालिटी एश्योरेंस सिस्टम विकसित करें और एकीकृत करें।
- आंतरिक रूप से तैयार डेटासेट और कस्टम ट्रेनिंग रणनीतियों से ओपन-सोर्स RL मॉडल को फ़ाइन-ट्यून और ऑप्टिमाइज़ करें।
- विभिन्न टास्क में मॉडल की क्षमता, मज़बूती और डेटा की गुणवत्ता मापने के लिए बेंचमार्किंग फ़्रेमवर्क स्थापित करें।
- आंतरिक और बाहरी बेंचमार्क प्लेटफ़ॉर्म (जैसे micro1 बेंचमार्क) पर मूल्यांकनों के प्रकाशन और विश्लेषण में योगदान दें।
आवश्यकताएँ
- रीइन्फ़ोर्समेंट लर्निंग में गहरा अनुभव, जिसमें एनवायरनमेंट डिज़ाइन और ट्रेनिंग डायनामिक्स शामिल हैं।
- RL सिस्टम, पाइपलाइन या प्रयोग फ़्रेमवर्क बनाने और स्केल करने का मज़बूत रिकॉर्ड।
- ऑटोमेशन और डेटा जनरेशन में दक्षता, जिसमें सिंथेटिक डेटा पाइपलाइन शामिल हैं।
- ऑटोमेटेड मूल्यांकन सिस्टम, मॉडल सत्यापन और क्वालिटी एश्योरेंस वर्कफ़्लो से परिचय।
- ओपन-सोर्स ML मॉडल को फ़ाइन-ट्यून करने और उनका मूल्यांकन करने का अनुभव।
- मज़बूत तकनीकी लेखन कौशल वाला स्पष्ट और संक्षिप्त संवादकर्ता।
- तेज़ गति वाले, रिसर्च-संचालित और अत्यंत सहयोगात्मक परिवेश में काम करने में सहजता।
वरीयता
- बेंचमार्क, मूल्यांकन या शोध-सामग्री प्रकाशित करने का अनुभव।
- मूल्यांकन इकोसिस्टम (जैसे micro1 बेंचमार्क या ऐसे ही फ़्रेमवर्क) से परिचय।
- बड़े पैमाने के RL प्रयोगों के लिए स्केलेबल इन्फ़्रास्ट्रक्चर की पृष्ठभूमि।
पारिश्रमिक और शर्तें
इस फ़ुल-टाइम पद के लिए राष्ट्रीय वेतन सीमा $200,000 –$300,000 USD का आधार वेतन है। सभी कर्मचारी इक्विटी मुआवज़े के पात्र हैं, और भूमिका के अनुसार तथा कंपनी नीतियों के अधीन कर्मचारियों को प्रदर्शन-आधारित बोनस भी मिल सकता है। micro1 एक व्यापक बेनिफ़िट पैकेज देता है, जिसमें स्वास्थ्य-बीमा प्रीमियम की 100% तक प्रतिपूर्ति, सवेतन अवकाश, कंपनी मैच वाली 401(K) योजना, और एक उच्च-प्रदर्शन वाले, रिमोट-फ़र्स्ट कार्यबल को सहारा देने के लिए डिज़ाइन किए गए अतिरिक्त लाभ शामिल हैं।
संबंधित भूमिकाएँ
AI/ML इंजीनियर, इंटरनल प्लेटफ़ॉर्म
AI/ML इंजीनियर, इंटरनल प्लेटफ़ॉर्म — रिमोट, सशुल्क AI ट्रेनिंग/मूल्यांकन कार्य (AI-मशीन लर्निंग) ($160-$300/घंटा)।
AI/ML इंजीनियर
AI/ML इंजीनियर — रिमोट, सशुल्क AI ट्रेनिंग/मूल्यांकन कार्य (AI और मशीन लर्निंग) ($70-$200/घंटा)।
सांख्यिकीविद् (स्टैटिस्टिशियन)
सांख्यिकीविद् (स्टैटिस्टिशियन) — रिमोट, सशुल्क AI ट्रेनिंग/मूल्यांकन कार्य (विज्ञान-अनुसंधान) ($60-$120/घंटा)।
