मल्टी-एजेंट सिस्टम: कई एजेंट एक से कब बेहतर
मल्टी-एजेंट आरेख इस क्षेत्र की सबसे लुभावनी चीज़ हैं। पदनाम वाले डिब्बे, बीच में तीर, ऊपर एक समन्वयक — यह संगठन-चार्ट जैसा दिखता है, और संगठन-चार्ट प्रगति का एहसास देते हैं।
फिर प्रोडक्शन आता है और सवाल शुरू होते हैं: यह ग़लत आँकड़ा किस एजेंट ने बनाया, समन्वयक ने क्यों माना और एक अनुरोध अब ग्यारह मॉडल कॉल क्यों लेता है। यह गाइड बताती है कि किन शर्तों में यह फिर भी सार्थक है और डीबग करने योग्य कैसे बनाया जाए।
तीन शर्तें#
कई एजेंट तब सार्थक हैं जब तीनों सही हों। उप-कार्य सचमुच स्वतंत्र हैं — किसी को शुरू करने के लिए दूसरे का नतीजा नहीं चाहिए। हर एक को अलग टूल सेट या अलग मॉडल स्तर चाहिए, यानी विशेषज्ञता कुछ असली ख़रीदती है। और काम इतना धीमा है कि समानांतर करना अनुभव बदल देता है। केवल दो सही हों तो अधिक टूल वाला एक लूप लगभग हमेशा बेहतर, सस्ता और ठीक करने में आसान है।
जिन दो एजेंटों को लगातार आपस में बात करनी पड़े, वे महँगे संदेश-मार्ग वाला एक एजेंट हैं।
टोपोलॉजी और उनकी लागत#
| टोपोलॉजी | कैसे चलती है | लागत | मुख्य विफलता |
|---|---|---|---|
| सुपरवाइज़र | एक एजेंट विशेषज्ञों को सौंपता है | N+1 लूप | सुपरवाइज़र ग़लत भेजता है |
| पाइपलाइन | तय हस्तांतरण, विशेषज्ञ चरण | पूर्वानुमेय | एक चरण चुपचाप बिगड़ता है |
| समानांतर फैलाव | वही काम, कई दृष्टि, विलय | सबसे ऊँची | विलय अड़चन बनता है |
| बहस या समीक्षक | एक सुझाता, दूसरा चुनौती देता | प्रति आदान-प्रदान 2× | बिना अंतर्दृष्टि सहमति |
| ब्लैकबोर्ड | साझा स्थिति, सब पढ़ते-लिखते | अप्रत्याशित | रेस और चक्कर |
डीबग योग्य रखने के नियम#
- हर एजेंट का लिखित अनुबंध: क्या मिलेगा, क्या लौटाएगा, क्या कभी नहीं करेगा।
- एजेंटों के बीच संरचित वस्तुएँ भेजिए, मुक्त गद्य कभी नहीं।
- पूरे अनुरोध के लिए एक रन पहचानकर्ता, हर एजेंट की हर कॉल पर।
- लागत प्रति एजेंट नहीं, पूरे सिस्टम पर सीमित कीजिए।
- स्पष्ट गिनती और निकास शर्त के बिना चक्र मना कीजिए।
- हर एजेंट `मैं नहीं कर सका` लौटा सके और समन्वयक उसे सँभाले।
वह मूल्यांकन समस्या जिसकी कोई योजना नहीं बनाता#
एक एजेंट में आप नतीजे मापते हैं। कई में हस्तांतरण भी मापने होंगे, क्योंकि हर एजेंट सही व्यवहार करते हुए भी सिस्टम ग़लत जवाब दे सकता है — राउटर ने ग़लत चुना या विलय ने ज़रूरी आधा गिरा दिया। दोनों स्तरों पर मूल्यांकन बनाइए।
एक उदाहरण जो सार्थक है#
प्रतिस्पर्धी शोध सचमुच फिट बैठता है: दस कंपनियों की सार्वजनिक जानकारी जुटाना। उप-कार्य स्वतंत्र हैं, हर एक धीमा है और विलय सीधा जोड़ है। दस समानांतर एजेंट एक के समय में पूरा करते हैं। इसकी तुलना एक ग्राहक सवाल वाले सपोर्ट एजेंट से कीजिए: वहाँ कदम क्रम में एक-दूसरे पर निर्भर हैं।
अक्सर पूछे जाने वाले प्रश्न
क्या सुपरवाइज़र सटीकता बढ़ाता है?
तभी जब राउटिंग सही हो। 95% विशेषज्ञों के आगे 90% सुपरवाइज़र अंत-से-अंत लगभग 85% देता है।
क्या एजेंट बहस लागत के लायक़ है?
कभी-कभी, सचमुच विवादित निर्णयों में जहाँ समीक्षक को जाँचने के लिए प्रमाण दे सकें। तथ्यात्मक खोज में यह ज़्यादातर सहमति देती है, दोगुनी क़ीमत पर।
मल्टी-एजेंट विफलता कैसे डीबग करें?
हर कॉल पर साझा पहचानकर्ता, प्रति एजेंट संग्रहित इनपुट-आउटपुट और क्रम में हस्तांतरण दिखाने वाले दृश्य से।
मल्टी एजेंट सिस्टमसुपरवाइज़र एजेंटएजेंट सहयोगसमानांतर एजेंटएजेंट हस्तांतरण