रिसोर्स · 03
AI एजेंट गवर्नेंस: एक प्रोडक्शन रेडीनेस गाइड
किसी एजेंट को बिज़नेस प्रोसेस के लिए ट्रस्ट करने से पहले परमिशन, डेटा, टेस्ट, ओवरसाइट और शटडाउन को फ्रेम करें।
अपडेटेड · 6 min
यह गाइड क्या पाने में मदद करती है
- एजेंट को उसकी ज़रूरत तक ही लिमिट करें।
- प्रोडक्शन से पहले महंगे फेलियर को टेस्ट करें।
- ज़्यादा कलेक्ट किए बिना काम के ट्रेस रखें।
- असरदार ह्यूमन अकाउंटेबिलिटी बनाए रखें।
जल्दी से चेक करें
- क्या एजेंट कोई ऐसा एक्शन ट्रिगर कर सकता है जिसे बदला न जा सके?
- क्या सबमिट किया गया डेटा ऑथराइज्ड है?
- क्या किसी थ्रेशहोल्ड के लिए ह्यूमन अप्रूवल की ज़रूरत है?
- क्या टूल्स के लिए मिनिमम परमिशन हैं?
- क्या सिस्टम जल्दी से रुक सकता है और वापस आ सकता है?
स्टेप-बाय-स्टेप तरीका
- 1
असली सिस्टम के बारे में बताएं
मकसद, यूज़र, इनपुट, मॉडल, टूल, आउटपुट, डिपेंडेंसी और प्रभावित लोगों को डॉक्यूमेंट करें।
डिलीवरेबल: वर्शन वाला सिस्टम कार्ड।
- 2
एक्शन और डेटा को क्लासिफ़ाई करें
पढ़ने, रिकमेंड करने, ड्राफ़्ट बनाने और चलाने को अलग करें। मना किया हुआ, सेंसिटिव, पर्सनल और रखा हुआ डेटा पहचानें।
डिलीवरेबल: डेटा × एक्शन मैट्रिक्स।
- 3
परमिशन कम करें
ज़्यादा असर वाले एक्शन से पहले डेडिकेटेड अकाउंट, टूल अलाऊलिस्ट, आइसोलेटेड एनवायरनमेंट और अप्रूवल का इस्तेमाल करें।
डिलीवरेबल: ऑथराइज़ेशन पॉलिसी।
- 4
बिल्ड इवैल्यूएशन
नॉर्मल केस, एम्बिगुइटी, इंजेक्शन, मिसिंग डेटा, आउट-ऑफ़-स्कोप रिक्वेस्ट और इर्रिवर्सिबल एरर टेस्ट करें। पायलट से पहले थ्रेशहोल्ड सेट करें।
डिलीवरेबल: टेस्ट सेट और रिज़ल्ट।
- 5
प्रोडक्शन मॉनिटर करें
सिस्टम वर्शन, ज़रूरी कॉन्टेक्स्ट, टूल कॉल, अप्रूवल और आउटकम लॉग करें, साथ ही कम से कम डेटा स्टोर करें।
डिलीवरेबल: मॉनिटरिंग डैशबोर्ड और अलर्ट।
- 6
फेलियर के लिए तैयारी करें
शटडाउन, मैनुअल टेकओवर, नोटिफिकेशन, इंसिडेंट एनालिसिस और रिटर्न-टू-सर्विस क्राइटेरिया तय करें।
डिलीवरेबल: AI इंसिडेंट रनबुक।
काल्पनिक काम का उदाहरण
उदाहरण वाली स्थिति
एक एजेंट कस्टमर रिक्वेस्ट पढ़ सकता है और जवाब का ड्राफ़्ट बना सकता है, लेकिन बिना अप्रूवल के मैसेज नहीं भेज सकता या अकाउंट नहीं बदल सकता। टेस्टिंग में एक सोर्स डॉक्यूमेंट शामिल होता है जो अपने इंस्ट्रक्शन को रीडायरेक्ट करने की कोशिश करता है।
फैसला और उम्मीद का सबूत
रजिस्टर में परमिशन वाले टूल्स, दिखने वाला डेटा, एस्केलेशन थ्रेशहोल्ड, ज़रूरी लॉग और वह पॉइंट बताया जाता है जहाँ कोई इंसान काम संभालता है।
मैनेजमेंट इंडिकेटर
| इंडिकेटर | यह क्या मापता है | पहला एक्शन |
|---|---|---|
| काम का सक्सेस रेट | बिज़नेस क्राइटेरिया के हिसाब से सही टास्क, सिर्फ़ सही जवाब नहीं | केस फ़ैमिली के हिसाब से फेलियर का रिव्यू करें |
| ह्यूमन एस्केलेशन | किसी व्यक्ति को सही तरीके से दिए गए केस | जब एजेंट ओवरकॉन्फिडेंट हो तो थ्रेशहोल्ड को ट्यून करें |
| कैंसल किए गए एक्शन | असर से पहले ब्लॉक या रिकवर किए गए एक्शन | ज़्यादा परमिशन और बिना टेस्ट किए सिनेरियो ढूंढें |
| ड्रिफ्ट | वर्शन, डेटा या पॉपुलेशन के हिसाब से परफ़ॉर्मेंस में अंतर | हर बदलाव पर एक स्टेबल सेट से तुलना करें |
आम गलतियाँ
- सिर्फ़ लिखने की क्वालिटी मापें
- एजेंट को एंड यूज़र के पूरे अधिकार दें
- हर बातचीत को डिफ़ॉल्ट रूप से बनाए रखें
- इवैल्यूएशन दोबारा चलाए बिना मॉडल या प्रॉम्प्ट बदलना
अक्सर पूछे जाने वाले सवाल
AI एजेंट चैटबॉट से कैसे अलग है?
एक एजेंट एक्शन प्लान करता है या उन्हें चेन करता है और टूल्स को कॉल कर सकता है। उस पावर के लिए ज़्यादा सख़्त परमिशन, अप्रूवल, ट्रेस और शटडाउन कंट्रोल की ज़रूरत होती है।
क्या इंसानी अप्रूवल हमेशा ज़रूरी होता है?
यह सबसे ज़्यादा तब मायने रखता है जब कोई एक्शन इर्रिवर्सिबल, सेंसिटिव, रेगुलेटेड, फाइनेंशियल या बाद में पता लगाना मुश्किल हो। लेवल रिस्क के हिसाब से होना चाहिए।
क्या लॉग किया जाना चाहिए?
सिस्टम वर्शन, बहुत ज़रूरी कॉन्टेक्स्ट, टूल कॉल, अप्रूवल, आउटकम और एरर, एक सही रिटेंशन पीरियड के साथ।
ऑफ़िशियल रेफ़रेंस
रेफ़रेंस इस तरीके को सपोर्ट करते हैं। अपने कॉन्टेक्स्ट के हिसाब से चेक को एडजस्ट करें; वे सर्टिफ़िकेशन नहीं हैं। ओरिजिनल रेफ़रेंस टाइटल और सोर्स डॉक्यूमेंट दूसरी भाषा में हो सकते हैं।






