कार्य व्याख्याएं 01: एजेंट आर्गो का ऑर्केस्ट्रेशन इंजन
2026-07-17 18:40:30
पहले आदेश से सत्यापित पैच तक
एजेंट आर्गो एक ऐसे एकल मॉडल से नहीं बना है जो किसी कार्य पर यथासंभव लंबे समय तक काम करता है। यह एक ऐसी प्रणाली है जो सॉफ्टवेयर कार्य को समझने योग्य चरणों में अनुवादित करती है: योजना बनाना, विभाजित करना, संसाधित करना, जांचना, सुधारना और उसके बाद ही अधिग्रहण के लिए प्रस्तुत करना।
इस योगदान के साथ "कार्य व्याख्याएं" श्रृंखला शुरू होती है। यह एजेंट आर्गो के केंद्रीय तंत्रों को समझने योग्य बनाती है - मार्केटिंग वादे के रूप में नहीं, बल्कि उनके वास्तविक उपयोग के साथ। शुरुआत ऑर्केस्ट्रेशन इंजन से होती है: वह प्रक्रिया जो एक आवश्यकता से एक नियंत्रित कार्य प्रक्रिया बनाती है।
1. शुरू करने से पहले: गुणवत्ता, लागत और स्वायत्तता निर्धारित करें
इससे पहले कि आर्गो किसी कार्य को संसाधित करे, दो निर्णय महत्वपूर्ण हैं। वे जानबूझकर एक-दूसरे से अलग हैं:
- आर्गो को लागत और परिणाम गुणवत्ता के बीच कैसे संतुलन बनाना चाहिए?
- आर्गो परियोजना में कितनी स्वतंत्र रूप से कार्य कर सकता है?
यह एक विशिष्ट लक्ष्य संघर्ष को रोकता है: एक गहन रन को स्वचालित रूप से अधिक लेखन अधिकार प्राप्त नहीं होने चाहिए। और एक स्वायत्त रन को स्वचालित रूप से महंगे मॉडल नहीं चुनने चाहिए।
लागत और गुणवत्ता के लिए तीन स्तर
मॉडल राउटर तीन समझने योग्य मोड जानता है। वे बदलते हैं कि कीमत और मॉडल स्तर चयन में कितनी मजबूती से शामिल होते हैं; आवश्यक कौशल हमेशा केंद्रीय रहता है।
| स्तर | राउटर-मोड | उपयुक्त है |
|---|---|---|
| किफायती | economy |
नियमित कार्य, निष्कर्षण, स्पष्ट रूप से परिभाषित परिवर्तन। लागत का वजन अधिक। |
| संतुलित | balanced |
अधिकांश रन के लिए मानक: कौशल-फिट, लागत और गुणवत्ता स्तर संतुलन में रहते हैं। |
| मांगपूर्ण | expert |
वास्तुकला, शोध, जटिल विश्लेषण और मांगपूर्ण समीक्षाएं। मॉडल स्तर का वजन काफी अधिक, लागत कम। |
ऑपरेटिंग प्रोफाइल तेज और सस्ता, संतुलित और गहन इस राउटर मोड को अन्य निर्णयों के साथ बंडल करते हैं: उदाहरण के लिए, क्या संयुक्त सोच केवल देखी जाती है या सक्रिय रूप से निष्पादित होती है, क्या सत्यापन बाध्यकारी है और क्या आर्गो विफलता के मामले में अधिक दृढ़ता से एस्केलेट कर सकता है।
स्वायत्तता के तीन स्तर
स्वायत्तता यह नियंत्रित नहीं करती कि आर्गो क्या सही मानता है, बल्कि कब उसे इसके लिए एक इंसान की आवश्यकता होती है।
| स्तर | व्यवहार |
|---|---|
| सुरक्षित | आर्गो विश्लेषण और योजना बनाता है। परिवर्तन समीक्षा के लिए रहते हैं; लिखने या जोखिम भरी कार्रवाइयों से पहले पूछा जाता है। |
| संतुलित | सामान्य परिवर्तन एक अलग कार्य स्थिति में उत्पन्न हो सकते हैं। हटाने, कमांड, डाउनलोड, नेटवर्क एक्सेस या संरक्षित पथों पर आर्गो पूछना जारी रखता है। |
| पूरी तरह स्वायत्त | रन सामान्य प्रश्नों के बिना काम करता है। कठोर सुरक्षा, नीति और बजट सीमाएं लागू रहती हैं। |
कोड में ये नियम readonly, confirm_write, auto_write और bypass के रूप में अधिक सटीक रूप से लागू हैं। तीन स्तर उन्हें संचालन योग्य बनाते हैं; लेकिन परियोजना नीति हमेशा अंतिम प्राधिकरण बनी रहती है। यह उदाहरण के लिए क्लाउड प्रदाताओं को बाहर कर सकती है, केवल स्थानीय मॉडल की अनुमति दे सकती है, नेटवर्क एक्सेस को अवरुद्ध कर सकती है, कमांड को सीमित कर सकती है, सीक्रेट्स की रक्षा कर सकती है या लागत सीमा निर्धारित कर सकती है।
2. CEO-स्तर आदेश से एक योजना बनाता है
उपयोगकर्ता पहले सामान्य भाषा में लक्ष्य का वर्णन करता है। आर्गो का CEO-स्तर इसके लिए एक सीमित परियोजना अवलोकन, उपलब्ध मॉडल कैटलॉग और प्रासंगिक परियोजना जानकारी प्राप्त करता है। यह खुले प्रश्नों पर पहले पूछताछ कर सकता है या एक योजना उत्पन्न कर सकता है।
एक योजना में केवल एक टू-डू सूची नहीं होती। प्रत्येक कार्य को एक भूमिका, एक विवरण, निर्भरताएं और आवश्यक क्षमताएं मिलती हैं - उदाहरण के लिए coding, planning, qa_review या context_comprehension। कठिन कार्यों के लिए उच्च कठिनाई भी नोट की जा सकती है। CEO-स्तर इसमें कठोरता से एक मॉडल का नाम नहीं लेता: यह कार्य का वर्णन करता है, राउटर बाद में प्रति कार्य उपयुक्त मॉडल पर निर्णय लेता है।
इस प्रकार योजना उपक्रम के बारे में मानव-पठनीय समझौता बनी रहती है, जबकि निष्पादन अनुकूली रह सकता है।
3. योजना से एक टास्क-ग्राफ बनता है
योजना अनुमोदन के बाद आर्गो कार्यों को एक टास्क-ग्राफ में बदल देता है। एक नोड केवल तभी चल सकता है जब उसकी निर्भरताएं सफलतापूर्वक पूरी हो गई हों। स्वतंत्र कार्य समानांतर चल सकते हैं।
शेड्यूलर तैयार नोड्स को एक समझने योग्य उपयोगिता अनुमान के अनुसार क्रमबद्ध करता है: अपेक्षित गुणवत्ता घटा लागत, समय और जोखिम दंड। यदि कोई नोड महत्वपूर्ण पथ पर है, तो बराबरी की स्थिति में उसे प्राथमिकता मिलती है, क्योंकि वह रन की कुल अवधि निर्धारित करता है।
उच्च अनिश्चितता या उच्च जोखिम पर आर्गो प्रसंस्करण से पहले एक संयुक्त सोच मोड चुन सकता है: कई दृष्टिकोण दृष्टिकोण विकसित करते हैं, एक-दूसरे की आलोचना करते हैं और वर्कर के लिए एक उचित कार्य दृष्टिकोण प्रदान करते हैं। क्या यह केवल प्रोटोकॉल किया जाता है या वास्तव में निष्पादित होता है, यह रन से पहले चुने गए ऑपरेटिंग प्रोफाइल द्वारा तय किया जाता है।
4. प्रत्येक टास्क से पहले: उपयुक्त संदर्भ, उपयुक्त क्षमताएं, उपयुक्त मॉडल
इससे पहले कि एक वर्कर शुरू हो, आर्गो भूमिका और कार्य के अनुरूप एक संदर्भ बनाता है। इसमें प्रासंगिक फाइलें, निर्भरता परिणाम और - यदि सक्रिय हो - एक कॉम्पैक्ट मेमोरी पैकेज और उपयुक्त कौशल निर्देश शामिल हैं। आर्गो इस तरह पूरे परियोजना ज्ञान को प्रॉम्प्ट में अंधाधुंध नहीं लेता। मेमोरी और कौशल प्रासंगिकता, उत्पत्ति, वर्तमानता, लागत और सुरक्षा स्थिति के अनुसार चुने जाते हैं।
फिर मॉडल राउटर एक मॉडल चुनता है। पहले उन उम्मीदवारों को बाहर रखा जाता है जो पहुंच योग्य नहीं हैं, जिनके पास पर्याप्त संदर्भ विंडो नहीं है, जिनका कोटा समाप्त हो गया है या जो सक्रिय नीति का उल्लंघन करते हैं। शेष मॉडलों से आर्गो चार कारकों का मूल्यांकन करता है:
- क्षमता-फिट: एक मॉडल आवश्यक कौशल के लिए कितनी अच्छी तरह मूल्यांकित है? कई कौशल के लिए औसत माना जाता है।
- लागत: अनुरोध कितना महंगा है - या सक्रिय लागत रूटिंग पर संभावित सफल परिणाम? | मॉडल स्तर: कठिन, सुरक्षा-महत्वपूर्ण, वास्तुकला और समीक्षा कार्य एक फ्लैगशिप स्तर को प्राथमिकता दे सकते हैं।
- अनुभव मूल्य: पर्याप्त वास्तविक परिणामों के बाद, एक मॉडल/कौशल संयोजन की नवीनतम सफलता और दोहराव दर शामिल होती है।
लागत गणना के लिए आर्गो सफलता की अपेक्षित लागत का उपयोग कर सकता है: सीधी कीमत, अपेक्षित पुनरावृत्तियां, सत्यापन प्रयास, संभावित पुनर्कार्य और एक छोटा विलंबता दंड। एक सस्ता एकल कॉल इसलिए स्वचालित रूप से सबसे सस्ता समाधान नहीं है, यदि वह अक्सर विफल होता है या पुनर्कार्य ट्रिगर करता है।
एक स्पष्ट मॉडल सिफारिश केवल तभी स्वीकार की जाती है जब वह उपलब्ध हो, नीति द्वारा अनुमत हो और संदर्भ के लिए पर्याप्त बड़ी हो। CEO-स्तर की योजना, प्रतिनिधिमंडल और संदर्भ समझ फिर से एक मजबूत मॉडल का उपयोग करते हैं जिसे विशेष रूप से इन तीन क्षमताओं के लिए चुना गया है।
5. वर्कर छोटे, सत्यापन योग्य चरणों में टास्क को संसाधित करता है
एक वर्कर एक ही उत्तर के साथ काम नहीं करता। वह एक सीमित ReAct-लूप से गुजरता है:
- मॉडल संरचित कार्रवाइयों का प्रस्ताव करता है - उदाहरण के लिए फाइलें पढ़ना, खोजना, परीक्षण चलाना या परिवर्तन लिखना।
- एक्जीक्यूटर अनुमति, पथ, कमांड जोखिम और सक्रिय नीति की जांच करता है।
- आर्गो केवल अनुमत कार्रवाइयों को निष्पादित करता है।
- परिणाम, डिफ्स और त्रुटि संदेश अवलोकन के रूप में मॉडल को वापस प्रवाहित होते हैं।
- इस आधार पर वर्कर अपना अगला चरण सुधारता है या कार्य पूरा करता है।
इस प्रकार एक एजेंट उदाहरण के लिए पहले प्रभावित कोड पढ़ सकता है, फिर एक परिवर्तन कर सकता है, एक परीक्षण चला सकता है और एक परीक्षण परिणाम को अगले निर्णय में शामिल कर सकता है। पूरा अनुक्रम रन लॉग में दृश्यमान रहता है।
आउटपुट की भी जांच की जाती है। यदि कोई मॉडल अमान्य एक्शन-JSON देता है, तो आर्गो एक सीमित मरम्मत लूप का अनुरोध कर सकता है। सख्त मोड में एक स्थायी रूप से दोषपूर्ण आउटपुट को नियंत्रित तरीके से अस्वीकार कर दिया जाता है, बजाय अस्पष्ट पाठ को कार्रवाई के रूप में व्याख्या करने के।
6. त्रुटियों पर: अंधाधुंध दोहराने के बजाय लक्षित सुधार
हर विफल टास्क का मतलब यह नहीं है कि पूरा रन विफल हो गया है। ऑर्केस्ट्रेशन इंजन त्रुटि कारणों को अलग करता है और नियंत्रित तरीके से प्रतिक्रिया करता है:
- एक अस्थायी त्रुटि को निश्चित सीमाओं के भीतर पुनः प्रयास किया जा सकता है।
- एक कठोर सत्यापन निष्कर्ष अपनी ठोस आपत्ति को अगले प्रयास के लिए आदेश के रूप में देता है।
- सक्रिय कास्केडिंग के साथ अगला प्रयास पिछले की अंतर्दृष्टि को लेता है, बजाय शून्य से शुरू करने के।
- एक विफल प्रयास के बाद आर्गो एक मजबूत मॉडल को प्राथमिकता दे सकता है।
- यदि बजट समाप्त हो गया है, तो कोई महंगा अंधा प्रयास शुरू नहीं किया जाता: नोड एक प्रलेखित आंशिक परिणाम के साथ समाप्त होता है या दृश्यमान रूप से एस्केलेट किया जाता है।
नोड रणनीति अंततः तय करती है कि क्या किसी कार्य को छोड़ा जा सकता है, नियंत्रित तरीके से विफल हो सकता है या उपयोगकर्ता निर्णय की आवश्यकता है। निर्भर कार्य केवल पुष्टि किए गए आंशिक परिणाम प्राप्त करते हैं। इससे एक स्थानीय त्रुटि एक मूक त्रुटि नहीं बनती जो शेष योजना के माध्यम से जारी रहती है।
7. कार्यान्वयन के बाद: समीक्षा, सत्यापन और एक संभावित अतिरिक्त चक्र
योजित टास्क संसाधित होने के बाद, आर्गो एकीकृत स्थिति को कई दृष्टिकोणों से जांचता है:
- QA-एजेंट फाइलें पढ़ सकता है और टेस्ट कमांड निष्पादित कर सकता है।
- वास्तुकला-एजेंट संरचना को पढ़कर जांचता है और जानबूझकर बिना लेखन अधिकारों के रहता है।
- नियतात्मक वेरिफायर टेस्ट, टाइप चेकिंग या लिंटिंग को वस्तुनिष्ठ ऑरेकल के रूप में निष्पादित कर सकते हैं।
- मॉडल-आधारित और नियतात्मक निष्कर्ष एक समग्र निर्णय में विलय हो जाते हैं।
यदि QA, वास्तुकला या एक बाध्यकारी वेरिफायर समस्याएं पाते हैं, तो आर्गो निष्कर्षों को प्रभावित कार्यों को सौंपता है। केवल इन कार्यों को ठोस प्रतिक्रिया के साथ फिर से संसाधित किया जाता है। इसके बाद फिर से समीक्षा और सत्यापन होता है। सहमति मोड के बिना यह लूप सीमित है; एक स्पष्ट रूप से चुने गए सहमति मोड में यह तब तक चलता है जब तक उपयोगकर्ता रोकता है या परीक्षक सहमत होते हैं।
पर्यवेक्षण मोड में एक वेरिफायर निष्कर्षों का दस्तावेजीकरण करता है, लेकिन ब्लॉक नहीं करता। बाध्यकारी मोड में एक कठोर निष्कर्ष रोक सकता है कि परिणाम को सफल माना जाए। इस प्रकार सख्ती को ऑपरेटिंग प्रोफाइल के अनुसार चुना जा सकता है, बिना ट्रेसेबिलिटी को छोड़े।
8. केवल जब स्थिति जांची गई है: दस्तावेजीकरण और CEO-सारांश
एक पूर्ण कार्य और जांच चक्र के बाद एक दस्तावेजीकरण एजेंट परिवर्तनों को रिकॉर्ड कर सकता है। इसके बाद CEO-स्तर उपयोगकर्ता के लिए सारांश बनाता है: क्या किया गया? क्या खुला रहा? कौन सी जांच चली? कौन सी फाइलें या निर्णय प्रभावित हैं?
परिणाम एक चैट टेक्स्ट से अधिक है। रन योजना, मॉडल चयन, लागत, कार्रवाइयों, सत्यापन निर्णयों, उपयोगकर्ता रुकावटों और बाद के पैच निर्णयों के लिए एक सामान्य पहचानकर्ता का नेतृत्व करता है। इससे पता लगाया जा सकता है कि आर्गो एक परिणाम तक कैसे पहुंचा।
9. अंत में इंसान वास्तविक वर्कस्पेस पर निर्णय लेता है
डिफ़ॉल्ट रूप से आर्गो एक अलग वर्कट्री में काम करता है। परिवर्तन वहां पैच के रूप में होते हैं, वास्तविक परियोजना में चुपचाप नहीं। स्वायत्तता स्तर के आधार पर बाद में तीन चीजों में से एक होती है:
- पैच स्वीकृति, आंशिक अधिग्रहण, संपादन या अस्वीकृति के लिए तैयार रहता है।
- एक सफल पैच स्वचालित रूप से अपनाया जाता है।
- बीच में बदली गई फाइलों के साथ संघर्ष पर आर्गो दृश्यमान रूप से रुकता है; यह विदेशी परिवर्तनों को ओवरराइट नहीं करता।
एक विफल रन स्वचालित रूप से लागू नहीं होता। एक बहुत ही स्वायत्त कॉन्फिगरेशन भी नीति को नहीं हटाता: सीक्रेट सुरक्षा, कमांड नियम, प्रदाता सीमाएं, बजट सीमाएं और आवश्यक ह्यूमन गेट प्रभावी रहते हैं।
ऑर्केस्ट्रेशन इंजन क्या करता है
ऑर्केस्ट्रेशन इंजन केवल यह तय नहीं करता कि कौन सा मॉडल आगे उत्तर देता है। यह उपयोगकर्ता इरादे, सेटिंग्स, योजना, समानांतरीकरण, मॉडल चयन, उपकरण उपयोग, त्रुटि सुधार, गुणवत्ता आश्वासन और सुरक्षित अधिग्रहण को एक सुसंगत अनुक्रम से जोड़ता है।
मानदंड "यथासंभव कई एजेंट" नहीं है। अतिरिक्त कार्य केवल वहां उत्पन्न होता है जहां यह उचित है: एक कठिन वास्तुकला निर्णय के लिए एक मजबूत मॉडल, अनिश्चितता पर एक दूसरा सोच दृष्टिकोण, एक वेरिफायर आपत्ति के बाद एक लक्षित रीट्राई या जोखिम भरे प्रभाव से पहले एक मानव अनुमोदन।
इस प्रकार पाठ्यक्रम निर्धारित है।