प्लेटफ़ॉर्म के भीतर

AI एजेंट नई स्किल कैसे सीखता है - और अपने पीछे सफ़ाई कैसे करता है

जो एजेंट सिर्फ़ तथ्य याद रखता है, वह तरीक़ा हर बार नए सिरे से निकालता है। Olano के एजेंट तरीक़ा लिख लेते हैं। यह लेख उसके पीछे की इंजीनियरिंग के बारे में है: बार-बार आने वाला काम कैसे एक दोबारा इस्तेमाल होने लायक़ लिखी हुई प्रक्रिया बन जाता है, एजेंट अपनी न लिखी हुई स्किल को मूल फ़ाइल कभी ओवरराइट किए बिना कैसे सुधारता है, सीखी हुई कॉपी उस दिन कैसे बची रहती है जब मूल फ़ाइल ऊपर से अपडेट हो जाती है - और क्यों इसमें से कुछ भी उस सिस्टम को चुपचाप बिगाड़ नहीं सकता जिसे सुधारना उसका काम है।

याद्दाश्त बताती है क्या सच है। स्किल बताती है काम कैसे होता है।

AI की याद्दाश्त पर होने वाली ज़्यादातर बातें तथ्यों पर आकर रुक जाती हैं, और तथ्य रखने लायक़ होते भी हैं: आपके दाम, आपके एस्केलेशन के नियम, कौन ग्राहक मुश्किल है। उस पूरी परत की बात करता है AI एजेंट कैसे याद रखते हैं। यह वाक़ई काम का है, और फिर भी यह दक्षता जैसी चीज़ नहीं है।

दक्षता प्रक्रिया की बात है। सोमवार की रिपोर्ट एक तय क्रम में, तय स्रोतों से, तय चेतावनियों के साथ बनती है। रिफ़ंड की पूछताछ को कोई जवाब देने से पहले तीन चीज़ों से मिलाया जाता है। तिमाही सप्लायर समीक्षा हर बार वही छह आँकड़े खींचती है। जिस एजेंट के पास तथ्य पूरे हैं और प्रक्रिया नहीं, वह इनमें से हर काम हर बार थोड़ा अलग करेगा - और यही उतार-चढ़ाव आपकी टीम को खटकता है।

इसलिए Olano के एजेंट याद्दाश्त के साथ-साथ दूसरी तरह की चीज़ भी रखते हैं: स्किल। एक स्किल एक छोटा फ़ोल्डर है जिसमें एक SKILL.md फ़ाइल होती है - एक नाम, एक पंक्ति का ब्यौरा, एक ट्रिगर जो बताता है कि इसे कब उठाना है, और क्रम से लगे चरण। कुछ स्किल प्लेटफ़ॉर्म के साथ आती हैं। कुछ किसी स्किल पैक या मार्केटप्लेस से आती हैं। कुछ आप लिखते हैं। और कुछ एजेंट अपने लिए ख़ुद लिखता है, उस काम से जो उसने असल में किया है।

यह लेख उसी आख़िरी किस्म के बारे में है।

सीखी हुई स्किल कहाँ से आती है

एजेंट की हर बारी एक रिकॉर्ड में जुड़ती जाती है। पृष्ठभूमि में चलने वाला एक चक्र उन रिकॉर्ड को एक लय से पढ़ता है - सबसे सक्रिय सेटिंग पर हर घंटे, सबसे ढीली पर हर चार घंटे - और वह सिर्फ़ वही पढ़ता है जो उसने पहले नहीं पढ़ा, हर रिकॉर्ड के बाइट ऑफ़सेट से हिसाब रखते हुए। कुछ भी दोबारा नहीं जाँचा जाता, और कुछ भी इसलिए नहीं छूटता कि दो बार चलने के बीच फ़ाइल बड़ी हो गई।

वहाँ से आगे, यह चक्र जान-बूझकर मुश्किल से चालू होने वाला बनाया गया है:

  • चार से कम नई बारियाँ हों तो यह कुछ नहीं करता। ऑफ़सेट फिर भी दर्ज हो जाते हैं, ताकि वे बारियाँ जमा न हों और बाद का कोई चक्र उनका ज़्यादा मतलब न निकाल ले।
  • यह गहरे तर्क वाले स्तर पर चलता है, वरना चलता ही नहीं। कोई सस्ता वैकल्पिक मॉडल नहीं है। हर एजेंट के लिए गहरे चक्रों की रोज़ाना सीमा है - लय की सेटिंग के हिसाब से लगभग छह, बारह या चौबीस - और जब सीमा या खर्च का बजट ख़त्म हो जाता है, वह चक्र छोड़ दिया जाता है और अगली बार दोबारा आज़माया जाता है, उसके ऑफ़सेट दर्ज न किए हुए रह जाते हैं। घटिया विश्लेषण न होने से भी बुरा है: वह आत्मविश्वास से भरी ग़लत प्रक्रियाएँ बनाता है।
  • जब याद्दाश्त दोबारा लिखी जा रही हो, यह पीछे हट जाता है। याद्दाश्त समेटने वाला चक्र एक ताला लगाता है; निचोड़ने वाला उसे देखकर हट जाता है, न कि उस फ़ाइल में जोड़ता रहे जो पूरी दोबारा लिखी जा रही है।

जब यह चलता है, पहले तथ्य याद्दाश्त में जाते हैं। फिर, अगर स्किल सीखना चालू है, वही बारियाँ दूसरे चक्र में जाती हैं।

टोही दल रिकॉर्ड से पहले लाइब्रेरी पढ़ता है

यही हिस्सा सीखी हुई लाइब्रेरी को कूड़ाघर बनने से रोकता है। स्किल के टोही दल को एक बातचीत थमाकर यह नहीं पूछा जाता कि «तुमने क्या सीखा?»। उसे एक बातचीत थमाई जाती है और साथ में उन सारी स्किल की सूची जो एजेंट के पास पहले से हैं - उन प्रबंधित और बाहरी स्किल सहित जो एजेंट के अपने कार्यक्षेत्र से बाहर रहती हैं और जिन्हें उसके फ़ाइल औज़ार ख़ुद नहीं देख पाते - और फिर पूछा जाता है कि क्या कमी है, अगर है।

वह जो भी उम्मीदवार लौटाता है, उसके साथ एक कार्रवाई जुड़ी होती है, और तीन कार्रवाइयों में से दो कोई नई स्किल बनाती ही नहीं:

  • skip - यह क्षमता पहले से मौजूद है। यही सबसे आम नतीजा है, और यह एक सफलता है।
  • update - कोई मौजूदा स्किल इसे लगभग समेट लेती है और उसे और पैना किया जाना चाहिए। उम्मीदवार लक्ष्य का नाम बताता है।
  • create - वाक़ई नई। तभी कोई स्किल लिखी जाती है।

नई स्किल इसके बाद दूसरी जाँच से गुज़रती है: वह लगभग मिलते-जुलते नाम खोजती है, कोई मिले तो रुक जाती है, और frontmatter सही रखते हुए एक सुव्यवस्थित SKILL.md लिखती है। अगर वह जाँच पूरी न हो पाए, सिस्टम उम्मीदवार को खोने के बजाय सीधे लिख देता है।

अपनी न लिखी हुई स्किल को सुधारना

दिलचस्प मामला सुधार का है, क्योंकि सबसे सीधा दिखने वाला तरीक़ा ही ग़लत है।

आपकी लगाई हुई स्किल एक अकेला दस्तावेज़ नहीं है। वह कई फ़ाइलों वाली नियमावली हो सकती है: एक SKILL.md के साथ स्क्रिप्ट, संदर्भ तालिकाएँ, फ़ॉर्म, टेम्पलेट। और उसका मालिकाना ऊपर है - जिस पैक से वह आई है, वह अपडेट होता है तो पूरा फ़ोल्डर बदल जाता है। इसलिए जो एजेंट ऐसी स्किल को उसी जगह दोबारा लिखकर «सुधारता» है, उसने एक साथ दो ग़लतियाँ की हैं: उसने एक नियमावली को एक सारांश में निचोड़ दिया, और उसने अपना सुधार अगले अपडेट के रास्ते में ही रख दिया, जो उसे चुपचाप मिटा देगा।

Olano इसके बजाय शाखा बनाता है। पहली बार जब कोई एजेंट अपनी न होने वाली स्किल सुधारता है:

  • पूरा फ़ोल्डर बाइट-दर-बाइट एजेंट की सीखी हुई लाइब्रेरी में कॉपी होता है, और भीतर के पथ संदर्भ दोबारा लिखे जाते हैं ताकि कॉपी नई जगह से भी काम करे।
  • कॉपी मूल का ठीक वही नाम रखती है, इसलिए एजेंट जब स्किल लोड करता है तो कॉपी मूल को ढक लेती है, उसकी जगह नहीं लेती। मूल फ़ाइल डिस्क पर कभी छुई नहीं जाती।
  • उसके साथ एक स्रोत-अभिलेख लिखा जाता है: शाखा बनने के समय स्रोत की हर फ़ाइल की छाप, उसी समय कॉपी की हर फ़ाइल की छाप, और मूल SKILL.md फ़ाइल के खंडों की संरचना।
  • शुरुआती हालत का एक अछूता स्नैपशॉट अलग रखा जाता है, जो आगे विलय का आधार बनेगा।

इसके बाद हर सुधार कॉपी पर जोड़ने के रूप में लगता है। इससे दो ऐसे गुण निकलते हैं जो उसी जगह दोबारा लिखने वाले डिज़ाइन में हो ही नहीं सकते: «इस सुधार में कुछ खोया तो नहीं?» एक दर्ज आधार-रेखा के मुक़ाबले जाँचने लायक़ सवाल बन जाता है, दो असंबंधित दस्तावेज़ों के बीच का धुँधला मिलान नहीं; और «मूल ऊपर बदला या नहीं?» हमेशा जवाब देने लायक़ बना रहता है।

संरक्षण का द्वार

ख़ुद को बदलने वाले सिस्टम में जिस ख़राबी से सब डरते हैं, वह है धीरे-धीरे और चुपचाप होती गिरावट: हर चक्र में थोड़ा छोटा, थोड़ा फीका, जब तक जो चीज़ काम करती थी वह घिसे-पिटे वाक्यों का एक अनुच्छेद न बन जाए। यह वादा करना कि ऐसा नहीं होगा, इंजीनियरिंग का जवाब नहीं है।

इसलिए हर बार स्किल लोड होने पर सीखी हुई कॉपी को उसकी ही दर्ज शुरुआती हालत से मिलाया जाता है। वह इन स्थितियों में पास नहीं होती:

  • शाखा बनने के समय मौजूद कोई फ़ाइल अब नहीं है;
  • कोई पाठ फ़ाइल अपने मूल आकार के आधे से नीचे सिकुड़ गई है (लगभग आधे किलोबाइट से छोटी फ़ाइलें छूट में हैं, क्योंकि छोटी फ़ाइलों का आकार जायज़ तौर पर बहुत बदलता है);
  • SKILL.md फ़ाइल ने मूल के खंड-शीर्षकों का एक-तिहाई से ज़्यादा खो दिया है।

जो कॉपी पास नहीं होती, उसे अलग कर दिया जाता है - वह ढकना बंद कर देती है और मूल फिर से काम पर लौट आता है। एजेंट एक सुधार खोता है; वह कोई चलती हुई स्किल नहीं खोता। और यह द्वार जान-बूझकर सिर्फ़ मशीन से लिखी कॉपियों पर लगता है: किसी इंसान के हाथ से लिखी सीखी हुई स्किल कभी अलग नहीं की जाती, क्योंकि जान-बूझकर किया गया बदलाव छोटा होने पर भी अंतिम माना जाना चाहिए।

जब मूल नीचे से बदल जाए

आख़िरकार ऊपर की स्किल अपडेट होती है - पैक का नया संस्करण, मार्केटप्लेस का अपडेट, या आपकी टीम का कोई बदलाव। अब दो वंश हैं जो दोनों हिले हैं, और स्रोत-अभिलेख अंदाज़े की जगह असली तीन-तरफ़ा विलय मुमकिन बनाता है। निपटारा हर फ़ाइल के लिए अलग होता है, और पहले निश्चित तरीक़े से: मॉडल से सिर्फ़ वहीं पूछा जाता है जहाँ कोई निश्चित जवाब नहीं है।

मूलसीखी हुई कॉपीक्या होता है
नहीं बदलाकुछ भीसीखी हुई कॉपी रहने दें। कुछ करने की ज़रूरत नहीं।
बदलाअछूताऊपर का नया संस्करण लें, उसके भीतर के पथ संदर्भ दोबारा लिखें, और स्रोत-अभिलेख पर नई स्रोत-छाप लगाएँ।
हटाया गयाअछूतासीखी हुई कॉपी से भी हटा दें। ऊपर उसे किसी वजह से हटाया गया है और यहाँ कुछ उसके ख़िलाफ़ नहीं है।
हटाया गयाबदलासीखी हुई कॉपी रहने दें और टकराव की एक टिप्पणी जोड़ दें। इसे किसी को देखना चाहिए; तब तक कुछ भी फेंका नहीं जाता।
बदलाबदला - पाठदर्ज आधार के मुक़ाबले तीन-तरफ़ा विलय। साफ़ विलय लागू हो जाता है। असली टकराव में सीखी हुई कॉपी बनी रहती है और अर्थ के स्तर पर मेल बैठाने के लिए लाइब्रेरी वाले चक्र को सौंप दी जाती है।
बदलाबदला - स्क्रिप्ट या बाइनरीसीखी हुई कॉपी रहने दें और उस पर निशान लगा दें। कोड कभी अपने-आप विलय नहीं होता: चुपचाप टूटी स्क्रिप्ट पुरानी स्क्रिप्ट से बुरी है।

इसके बाद छापें और आधार स्नैपशॉट विलय के बाद की हालत पर ला दिए जाते हैं। यही चीज़ इस चक्र को एक जगह ले आती है: वही फ़र्क़ दोबारा नहीं उठाया जाता, और संरक्षण का द्वार किसी बहुत पुरानी की जगह नई आधार-रेखा के मुक़ाबले काम करता रहता है। जो कॉपी अभी द्वार पास नहीं कर रही, उसे विलय से पूरी तरह छोड़ दिया जाता है - बिगड़ी हुई कॉपी को दोबारा मिलाना उसे धोकर सेवा में लौटाना होगा।

पूरी लाइब्रेरी पर एक चक्र

एक-एक स्किल जाँचना और पूरी लाइब्रेरी को सुसंगत रखना, दोनों एक बात नहीं हैं। इसलिए एक अलग चक्र, अपने ही समय पर, एजेंट की हर स्किल पढ़ता है और पूरे संग्रह को एक इकाई की तरह बरतता है: दोहराव और लगभग-दोहराव को एक प्रमाणिक संस्करण में मिलाता है - सबसे अच्छा नाम, सबसे साफ़ ट्रिगर, चरणों का जोड़ - मिलाए गए फ़ोल्डर हटाता है, जिन कॉपियों के मूल खिसक गए हैं उन्हें दोबारा मिलाता है, और जो बचता है उसे सुधारता है।

यह सीमा सलाह नहीं, बंदिश है: इस चक्र के लिए मूल और प्रबंधित स्किल सिर्फ़ पढ़ने के लिए हैं। यह सिर्फ़ सीखी हुई लाइब्रेरी के अंदर संपादन, विलय और हटाना कर सकता है। शुरू करने से पहले हर उस फ़ाइल का स्नैपशॉट लिया जाता है जिसे यह छू सकता है, और ख़त्म होने पर यह बताता है कि क्या बदला, साथ में एक ही पूर्ववत बटन।

कार्यक्षेत्र के साथ भी वही बरताव

एजेंट की अपनी सेटिंग भी गद्य है, और महीनों में थोड़ा-थोड़ा लिखा गद्य उसी तरह जमा होता है: वही निर्देश तीन जगहों पर तीन तरह से लिखा हुआ, कोई पसंद ग़लत फ़ाइल में दर्ज, वही टिप्पणी लगातार ग्यारह दैनिक लॉग में दोहराई हुई, और कभी-कभी दो निर्देश जो चुपचाप एक-दूसरे से उलटे पड़ते हैं।

इसे एक कार्यक्षेत्र-समेटन चक्र सँभालता है। यह एजेंट की पहचान, व्यवहार, निर्देश और दीर्घकालिक याद्दाश्त की फ़ाइलें, साथ में पिछले दो हफ़्तों के दैनिक लॉग पढ़ता है, और उन्हीं जगहों पर दोबारा लिखता है: दूसरे शब्दों में कहे गए दोहराव मिलाता है, विरोध हटाता है, जुड़ी हुई सामग्री साफ़ शीर्षकों के नीचे रखता है, और सामग्री को उस फ़ाइल में ले जाता है जहाँ वह असल में बनती है। दैनिक लॉग में दोहराव सबसे सख़्ती से हटाया जाता है, क्योंकि दोहराव सबसे तेज़ वहीं जमा होता है।

जिस निर्देश पर यह चलता है वह एक ही वाक्य लंबा है, और सारा बोझ वही उठाता है: एजेंट की आवाज़ और हर अनोखा निर्देश बचाए रखो; समेटो, मिटाओ कभी नहीं। लाइब्रेरी वाले चक्र की तरह, हर लक्ष्य फ़ाइल का पहले स्नैपशॉट लिया जाता है, और नतीजा एक-क्लिक पूर्ववत के साथ बताया जाता है।

दो नीतियाँ, और यह फ़र्क़ मायने रखता है

इस चक्र में सब कुछ एक ही तरह से नहीं चलाया जाता, और यह बाँट सहूलियत की नहीं, इरादे की है।

  • एजेंट को जो करने के लिए कहा गया है, उसे बदलना सिर्फ़ प्रस्ताव तक है। The pass that reviews recent work and concludes an agent's instructions should be sharper does not edit those instructions. It writes grounded proposals into a review queue, and they wait - even with Fully Autonomous on, which otherwise lets new skills, memory and tidy-ups apply on their own. Nothing rewrites an agent's instructions because a background job thought it should, unless a deployment owner has explicitly lifted that hold for the agent.
  • बिना नुक़सान वाली सफ़ाई सीधे लागू होती है, स्नैपशॉट और पूर्ववत के साथ। याद्दाश्त से दोहराव हटाना, एक जैसी दो सीखी हुई स्किल मिलाना, दोहराई गई टिप्पणी समेटना - ये एजेंट के काम को नहीं बदलते, सिर्फ़ यह बदलते हैं कि लिखा हुआ कितना करीने से है। हर एक के लिए इंसान की क्लिक माँगना आपकी टीम को बिना पढ़े मंज़ूरी देने की आदत डाल देगा, और उस कतार के लिए यह सबसे बुरा नतीजा है जो वाक़ई मायने रखती है। इसलिए वे स्नैपशॉट के बाद सीधे लागू होते हैं, और हर बार चलने पर बताते हैं कि क्या बदला, साथ में पूर्ववत।

यह सब बंद किया जा सकता है। हर व्यवहार - निचोड़ना, स्किल सीखना, लाइब्रेरी की देखभाल, कार्यक्षेत्र समेटना, याद्दाश्त समेटना - एक अलग स्विच है, पूरी तैनाती के लिए सेट किया जा सकता है और हर एजेंट पर दोनों दिशाओं में बदला जा सकता है, इसलिए «इस एक एजेंट को छोड़कर हर जगह बंद» एक असली सेटिंग है। उनके ऊपर एक मुख्य स्विच है, और यह अलग चुनाव कि तय समय पर चले या सिर्फ़ कोई कहे तब। लय की सेटिंग - ढीली, संतुलित, तेज़ - समय-सारिणी और गहरे तर्क की रोज़ाना सीमा दोनों को साथ हिलाती है, और ये सब उसी सख़्त खर्च-नियंत्रण के अधीन रहते हैं जो तैनाती में बाक़ी सब कुछ चलाता है.

पूरा चक्र कैसा दिखता है

एजेंट उस दिन का असली काम करते हैंसिर्फ़ अनपढ़ी बारियाँ जाँची जाती हैं, गहरे स्तर पर या फिर बिलकुल नहींतथ्य याद्दाश्त में जाते हैं; टोही दल पहले पूरी लाइब्रेरी देखता हैनई स्किल जाँची और लिखी जाती हैं; सुधार शाखा में जाते हैं, कभी ओवरराइट नहीं होतेसंरक्षण का द्वार जो कुछ बिगड़ा है उसे अलग कर देता हैऊपर के अपडेट तीन-तरफ़ा विलय से लौट आते हैंलाइब्रेरी और कार्यक्षेत्र समेटे हुए, स्नैपशॉट लिए हुए, पूर्ववत करने लायक़

यह जुड़ाव धीमा और ठोस है। जिस रिपोर्ट को आपके संचालन एजेंट ने तीन हफ़्ते लगातार हाथ से बनाया, वह चौथे हफ़्ते एक लिखी हुई प्रक्रिया के रूप में मौजूद है। पैक की वह स्किल जो आपके उद्योग के लिए लगभग सही थी, आपका सुधार साथ लिए रहती है और फिर भी विक्रेता का अगला अपडेट सोख लेती है, उससे कुचली नहीं जाती। निर्देशों की वह फ़ाइल जो एक-दूसरे पर चढ़ती हिदायतों के चार पन्नों तक फूल गई थी, अब दो पन्ने है जिनमें कोई चढ़ाव नहीं - और जो भी वाक्य सिर्फ़ मिटाए गए संस्करण में था, वह अब भी बचाए गए संस्करण में है।

यह क्या नहीं है

किसी मॉडल का कोई वेट न प्रशिक्षित होता है, न फ़ाइन-ट्यून, न समायोजित। यह पूरा चक्र मॉडल से एक परत ऊपर चलता है, आपकी ही अलग-थलग तैनाती के भीतर सादी भाषा में लिखी चीज़ों पर: स्किल, याद्दाश्त की प्रविष्टियाँ, निर्देशों के प्रस्ताव। ये सब फ़ाइलें हैं। आपकी टीम इन्हें पढ़ सकती है, हाथ से बदल सकती है, मंज़ूरी दे सकती है, वापस पलट सकती है, और देख सकती है कि किसने कब क्या बदला।

यह कोई सीमा नहीं है जिससे हम बच निकल रहे हैं। यही वजह है कि यह चक्र वह चीज़ है जिसे आप चला सकते हैं, न कि वह जिस पर भरोसा करना पड़े - और इसी वजह से, नीचे का मॉडल बदला जा सकता है और एजेंट अपनी सीखी हुई बात नहीं खोता.

संबंधित पठन

«प्लेटफ़ॉर्म के भीतर» श्रृंखला के बाक़ी लेख, और पुस्तिका के वे अध्याय जो और गहरे जाते हैं।

अक्सर पूछे जाने वाले सवाल

स्किल क्या है, और यह याद्दाश्त से किस तरह अलग है?

याद्दाश्त वह रखती है जो आपके कारोबार के बारे में सच है - दाम, लोग, फ़ैसले, पसंद। स्किल यह रखती है कि कोई काम कैसे होता है: नाम, ब्यौरा, कब उठाना है यह बताने वाला ट्रिगर, और क्रम से लगे चरणों वाली एक छोटी लिखी हुई प्रक्रिया। याद्दाश्त एजेंट को वही सवाल दो बार पूछने से रोकती है। स्किल उसे वही प्रक्रिया दो बार नए सिरे से गढ़ने और हर बार थोड़ा अलग करने से रोकती है।

क्या एजेंट आपकी दी हुई स्किल दोबारा लिख देता है?

नहीं। आपसे, किसी स्किल पैक से, या किसी मार्केटप्लेस से आई स्किल सिर्फ़-पढ़ने वाले मूल हैं और कभी बदले या हटाए नहीं जाते। किसी एक को सुधारने के लिए एजेंट पूरा स्किल फ़ोल्डर अपनी सीखी हुई लाइब्रेरी में कॉपी करता है और कॉपी को बदलता है, जो मूल का नाम ही रखती है इसलिए स्किल लोड होते समय उसे पहले गिना जाता है। मूल फ़ाइल डिस्क पर अछूती रहती है, और यही चीज़ आगे के ऊपरी अपडेट को खोने के बजाय मिलाने लायक़ बनाती है।

सीखी हुई स्किल को घटकर एक कमज़ोर सारांश बन जाने से क्या रोकता है?

स्किल लोड होते समय चलने वाला एक संरक्षण-द्वार। सीखी हुई कॉपी को उसकी ही दर्ज शुरुआती हालत से मिलाया जाता है: अगर कोई पाठ फ़ाइल मूल आकार के आधे से नीचे सिकुड़ गई है, अगर मूल के खंड-शीर्षकों का एक-तिहाई से ज़्यादा गुम हो गया है, या अगर शुरू में मौजूद कोई फ़ाइल अब नहीं है, तो वह कॉपी अलग कर दी जाती है और मूल फिर से काम पर आ जाता है। यह एक ढाँचागत जाँच है, वादा नहीं - और इंसान के हाथ से लिखी कॉपियाँ छूट में हैं, क्योंकि जान-बूझकर किए गए बदलाव अंतिम बने रहते हैं।

अगर मूल स्किल आगे अपडेट हो जाए तो क्या होता है?

शाखा बनने के समय की हालत के स्नैपशॉट के मुक़ाबले, हर फ़ाइल के लिए एक तीन-तरफ़ा विलय। जो फ़ाइलें ऊपर बदलीं और सीखी हुई कॉपी ने कभी नहीं छुईं, वे ऊपर से ली जाती हैं। जो फ़ाइलें सीखी हुई कॉपी ने बदलीं और ऊपर नहीं बदलीं, वे रहने दी जाती हैं। जहाँ दोनों बदलीं, वहाँ पाठ साझा आधार के मुक़ाबले मिलाया जाता है, और असली टकराव लाइब्रेरी वाले चक्र को सौंपा जाता है। स्क्रिप्ट और बाइनरी कभी अपने-आप नहीं मिलाई जातीं: सीखी हुई कॉपी रहने दी जाती है और उस पर निशान लगा दिया जाता है, क्योंकि चुपचाप टूटी स्क्रिप्ट पुरानी से बुरी है।

क्या कुछ मुझसे पूछे बिना बदल जाता है?

यह इस पर है कि क्या बदल रहा है, और यह बाँट इरादतन है। जो कुछ भी यह बदलता है कि एजेंट को क्या करने के लिए कहा गया है - उसके निर्देश, उसका व्यवहार - वह प्रस्ताव के रूप में समीक्षा-कतार में लिखा जाता है और अपने-आप कभी लागू नहीं होता। बिना नुक़सान वाली सफ़ाई - याद्दाश्त से दोहराव हटाना, दोहराई गई सीखी हुई स्किल मिलाना, दोहराई गई टिप्पणियाँ समेटना - सीधे लागू हो सकती है, पर सिर्फ़ स्नैपशॉट के बाद, और हर ऐसी बार चलने पर बताया जाता है कि क्या बदला, साथ में एक-क्लिक पूर्ववत। इन व्यवहारों को आप अलग-अलग बंद भी कर सकते हैं, पूरी तैनाती के लिए या किसी एक एजेंट के लिए।

क्या यह मेरे डेटा पर किसी AI मॉडल को दोबारा प्रशिक्षित करना है?

नहीं। किसी मॉडल का कोई वेट न प्रशिक्षित होता है, न फ़ाइन-ट्यून। यह चक्र जो कुछ बनाता है वह आपकी ही तैनाती के भीतर एक सादी markdown फ़ाइल है: एक स्किल, याद्दाश्त की एक प्रविष्टि, निर्देश बदलने का एक प्रस्ताव। आपकी टीम उन्हें पढ़ सकती है, मिलाकर देख सकती है, हाथ से बदल सकती है, मंज़ूरी दे सकती है, और वापस पलट सकती है। यही पढ़ा जा सकना असल बात है - यही एक सुधार-चक्र को वह चीज़ बनाता है जिसे आप चला सकें, न कि वह जिस पर भरोसा करना पड़े।

ऐसा सिस्टम तैनात करें जो अपनी सीखी बात लिख लेता है

यह जुड़ाव तभी मायने रखता है जब नीचे का काम असली हो। एक परामर्श बुक करें - हम कार्यप्रवाह का नक्शा बनाते हैं, उसकी कीमत बताते हैं, और आपकी मंज़ूरी के बाद ही बनाना शुरू करते हैं।

प्रोजेक्ट पर चर्चा करें