Workflow Editor - Entity Enricher दस्तावेज़

वर्कफ़्लो एडिटर

वह पेज जहाँ आप एक संवर्धन को शुरू से अंत तक बनाते हैं — सैंपल डेटा, स्कीमा, मॉडल, परिणाम। इसके केंद्र में स्कीमा ट्री है: एक विज़ुअल एडिटर, जिसमें ड्रैग-एंड-ड्रॉप से क्रम बदलना, इनलाइन एडिटिंग, कीबोर्ड नेविगेशन और AI-सहायता से बदलाव करना शामिल है।

अवलोकन

स्कीमा ट्री की मदद से आप अपने एनरिचमेंट स्कीमा को हाथ से JSON लिखे बिना देख और बदल सकते हैं। प्रॉपर्टीज़ को विशेषज्ञता डोमेन के अनुसार समूहीकृत एक इंटरैक्टिव ट्री में दिखाया जाता है, ताकि एक नज़र में पता चल जाए कि कौन-सा फ़ील्ड किस विशेषज्ञ क्षेत्र का है। हर बदलाव undo/redo हिस्ट्री में दर्ज होता है और 2-सेकंड के debounce के बाद अपने-आप सेव हो जाता है।

प्रमुख क्षमताएँ

विशेषज्ञता समूहन

एक्सपर्टीज़ डोमेन के अनुसार समूहीकृत प्रॉपर्टीज़, कोलैप्स करने योग्य सेक्शन के साथ। समूहीकरण चालू/बंद टॉगल करें।

ड्रैग-एंड-ड्रॉप

Sorted व्यू बंद होने पर, ड्रैग करके प्रॉपर्टीज़ को समूह के भीतर या समूहों के बीच पुनर्व्यवस्थित करें — यह क्रम schema पर सहेजा जाता है। विज़ुअल ड्रॉप-टारगेट संकेतक दिखाते हैं कि आइटम कहाँ जाकर गिरेंगे।

इनलाइन संपादन

किसी भी प्रॉपर्टी का नाम, प्रकार, विवरण और उदाहरण सीधे ट्री में संपादित करने के लिए उस पर क्लिक करें।

कीबोर्ड नेविगेशन

नेविगेट करने और कोलैप्स या एक्सपैंड करने के लिए ऐरो कीज़, एडिट के लिए Enter, हटाने के लिए Delete, सब चुनने के लिए Ctrl+A। अनडू और रीडू टूलबार बटन हैं, और स्कीमा बदलने या पेज रीलोड करने पर भी हिस्ट्री बनी रहती है।

खोज और फ़िल्टर

बड़े schema में fields ढूँढने के लिए text search: पहले property नामों में, और जब कोई नाम मेल न खाए तो description और example में खोजता है। Nested मेल केवल उन तक ले जाने वाले path के साथ दिखाए जाते हैं।

पूर्ववत करें / पुनः करें

मैनुअल एडिट के लिए पूरी हिस्ट्री स्टैक। AI-जनरेटेड बदलाव अनडू एंट्री जोड़े बिना प्रतिस्थापित करते हैं।

टाइप्स और वैल्यू सेट्स

ऊपर की तरफ के टैब्स स्कीमा के नामित टाइप्स रखते हैं। + बटन या तो एक Object (अपनी प्रॉपर्टीज़ के साथ एक नेस्टेड एंटिटी) बनाता है या एक Enum (अनुमत मानों की एक बंद सूची जिस पर आप किसी भी टेक्स्ट प्रॉपर्टी को इंगित कर सकते हैं)।

डायग्राम व्यू

SCHEMA और JSON के बगल वाला DIAGRAM व्यू स्कीमा को एक एंटिटी डायग्राम के रूप में बनाता है — नामित एंटिटी शीर्षक वाले कार्ड के रूप में, नेस्टेड ऑब्जेक्ट अपने रिलेशन के नाम वाले सादे कार्ड के रूप में, और रेफरेंस (1–1) व लिंक (1–N) डैश्ड एज के रूप में। यह आपके बदलावों को लाइव फ़ॉलो करता है, और किसी एंटिटी कार्ड पर क्लिक करने पर वह SCHEMA व्यू में खुल जाती है।

प्रॉपर्टी ट्री

एडिटर में प्रत्येक पंक्ति एक schema property को दर्शाती है, जिसके मुख्य एट्रिब्यूट एक नज़र में दिखाई देते हैं:

चयनप्रॉपर्टी नामप्रकारविवरण
□company_name
🔍
stringकानूनी कंपनी का नाम
□revenuenumberवार्षिक राजस्व USD में
□headquartersobjectकॉर्पोरेट मुख्यालय
□ citystringनगरपालिका का नाम
□ country
🔍
stringवह राष्ट्र जहाँ मुख्यालय स्थित है
□gmp_statusbooleanGMP प्रमाणन स्थिति

नेस्टेड प्रॉपर्टीज़ (जैसे headquarters के अंतर्गत city) को पदानुक्रम दिखाने के लिए इंडेंट किया जाता है। मैग्निफ़ाइंग ग्लास आइकन सर्च कीज़ को चिह्नित करता है — वे फ़ील्ड जो entity की पहचान के लिए उपयोग होते हैं।

मान सेट (Enums)

एक वैल्यू सेट किसी टेक्स्ट प्रॉपर्टी को अनुमत मानों की एक तय सूची तक सीमित करता है — एक स्टेटस, एक ग्रेड, एक क्लासिफिकेशन कोड। इसके बाद एनरिचमेंट उस सूची से बाहर कुछ भी वापस नहीं दे सकता, जिससे एक ही कॉन्सेप्ट अलग-अलग रन में तीन अलग स्पेलिंग के रूप में नहीं आता।

मान सेट के साथ काम करना

एक बनाएं

टाइप टैब्स पर + दबाएं, Enum चुनें, और इसे नाम दें। नया टैब इसकी मेंबर सूची खोलता है।

मेंबर संपादित करें

मान जोड़ें, नाम बदलें, क्रम बदलें या हटाएं। जब किसी मेंबर का अर्थ उसके नाम से स्पष्ट न हो तो उसे एक नोट दें।

इसका उपयोग करें

टाइप ड्रॉपडाउन में Value Sets समूह से किसी भी टेक्स्ट प्रॉपर्टी का Type उस वैल्यू सेट (या उसकी एक ऐरे) पर सेट करें।

इसे पूर्ववत करें

प्रॉपर्टी का Type वापस string पर सेट करें, या वैल्यू सेट हटाएं — इसका उपयोग करने वाली प्रॉपर्टीज़ फिर से साधारण टेक्स्ट प्रॉपर्टीज़ बन जाती हैं।

किसी वैल्यू सेट का उपयोग केवल ऐसी शब्दावली के लिए करें जिसे आप पूरी तरह सूचीबद्ध कर सकें। अगर किसी वास्तविक एंटिटी को ऐसा मान चाहिए जिसे आपने छोड़ दिया, तो मॉडल समस्या की रिपोर्ट करने के बजाय सबसे करीबी गलत मान चुनने के लिए मजबूर हो जाता है — इसलिए एक ओपन-एंडेड फ़ील्ड (एक नाम, एक वर्णन, एक फ्री-टेक्स्ट श्रेणी) को सादा टेक्स्ट ही रहना चाहिए। इसी कारण स्कीमा जनरेशन वैल्यू सेट सतर्कता से प्रस्तावित करता है, और जो कुछ भी वह प्रस्तावित करता है वह यहां संपादन योग्य है।

Properties एडिट करना

एडिट मोड में जाने के लिए किसी प्रॉपर्टी रो पर क्लिक करें या Enter दबाएँ। एडिट मोड में, आप संशोधित कर सकते हैं:

नामJSON आउटपुट में प्रॉपर्टी key। संगति के लिए snake_case का उपयोग करें।
प्रकारstring, number, integer, boolean, array, या object में से चुनें। type बदलने से enrichment आउटपुट फ़ॉर्मेट अपडेट होता है।
विवरणसंदर्भात्मक विवरण जो enrichment के दौरान AI का मार्गदर्शन करता है। अधिक विवरण से बेहतर परिणाम मिलते हैं।
उदाहरणदो या तीन वास्तविक उदाहरण मान। ये AI को अपेक्षित फॉर्मेट और सामग्री समझने में मदद करते हैं।
expertiseकौन-सा डोमेन विशेषज्ञ यह मान प्रदान करता है। बहु-विशेषज्ञता संवर्धन में ग्रुपिंग निर्धारित करता है।
Nullableक्या किसी वास्तविक इंस्टेंस में यह वैल्यू सचमुच अनुपस्थित हो सकती है। डेटाबेस में प्रवेश के लिए non-nullable फ़ील्ड आवश्यक हैं — जो एनरिचमेंट इन्हें नहीं भर पाता उसे क्वालिटी गेट अस्वीकार कर देता है। डेटाबेस की (null वैल्यू किसी रो की पहचान नहीं करती) और संरक्षित फ़ील्ड (जिसे आपका इनपुट हमेशा उपलब्ध कराता है) पर यह अनुपलब्ध रहता है।
बहुभाषीक्या फ़ील्ड को कई भाषाओं में संवर्धित किया जाना चाहिए।
सुरक्षित रखेंमूल इनपुट मान को अपरिवर्तित रखना है या नहीं। उन मानों के लिए जिन्हें आपका अपना सिस्टम रखता है — एक डेटाबेस id, एक आंतरिक SKU, एक ग्राहक संदर्भ — न कि सार्वजनिक पहचानकर्ताओं (CAS, ISBN, EAN, एक टिकर) के लिए, जिन्हें enrichment आपके लिए खोज सकता है। फिर प्रत्येक enrichment को इसके लिए एक मान प्रदान करना होगा।

कीबोर्ड शॉर्टकट

स्कीमा एडिटर कुशल एडिटिंग के लिए पूर्ण कीबोर्ड-चालित वर्कफ़्लो का समर्थन करता है:

शॉर्टकटक्रिया
Arrow Up / Downप्रॉपर्टीज़ के बीच नेविगेट करें (चयन बढ़ाने के लिए Shift दबाए रखें)
Arrow Left / Rightचयनित ऑब्जेक्ट को कोलैप्स या एक्सपैंड करें
Home / Endपहली या आख़िरी प्रॉपर्टी पर जाएँ
Enterचयनित प्रॉपर्टी पर एडिट मोड टॉगल करें
Delete / Backspaceचयनित प्रॉपर्टी हटाएँ
Ctrl+A / Cmd+Aहर प्रॉपर्टी चुनें
Escapeएडिट मोड से बाहर निकलें या चयन साफ़ करें

ड्रैग-एंड-ड्रॉप पुनःक्रमण

हाथ से क्रम बदलने के लिए Sorted टॉगल बंद करना ज़रूरी है। एडिटर डिफ़ॉल्ट रूप से प्रॉपर्टीज़ को वर्णानुक्रम में दिखाता है और वहाँ ड्रैग करना बंद रहता है — हाथ से बनाया गया ऐसा क्रम जिसे कोई व्यू सेटिंग चुपचाप बदल सकती हो, ज़्यादा काम का नहीं होता। Sorted को अनचेक करने पर स्कीमा का अपना क्रम लागू हो जाता है और ड्रैग करना चालू हो जाता है; एक विज़ुअल इंसर्शन लाइन ठीक-ठीक दिखाती है कि प्रॉपर्टी कहाँ जाकर बैठेगी, और बनने वाला क्रम स्कीमा के साथ सेव हो जाता है। डोमेन असाइनमेंट बदलने के लिए आप किसी विशेषज्ञता समूह के भीतर या समूहों के आर-पार ड्रैग कर सकते हैं।

जब विशेषज्ञता ग्रुपिंग सक्षम हो, किसी प्रॉपर्टी को अलग ग्रुप में छोड़ने पर उसका विशेषज्ञता असाइनमेंट स्वतः अपडेट हो जाता है। इससे बड़े स्कीमा को पुनर्व्यवस्थित करना सहज हो जाता है — बस किसी फ़ील्ड को “Financial Analyst” से “Regulatory Expert” में खींचें और उसकी विशेषज्ञता तदनुसार अपडेट हो जाती है।

AI एडिट पेन

प्रॉपर्टी ट्री के नीचे, AI एडिट पैन आपको प्राकृतिक भाषा का उपयोग करके स्कीमा को संशोधित करने देता है। “add a parent_company reference” जैसा निर्देश टाइप करें और AI आपकी मौजूदा संरचना को बनाए रखते हुए बदलाव लागू कर देता है।

AI सुझाव

प्रत्येक जनरेशन या एडिट के बाद, AI 5 सुधार सुझाव देता है जो क्लिक करने योग्य चिप्स के रूप में प्रदर्शित होते हैं। किसी सुझाव पर क्लिक करने से वह स्वचालित रूप से एडिट इनपुट में भर जाता है और लागू हो जाता है। सुझाव डेटा पूर्णता, गुणवत्ता, संबंध, अंतरराष्ट्रीयकरण और डोमेन-विशिष्ट संवर्द्धन को कवर करते हैं।

AI स्कीमा संपादन के बारे में AI Schema Generation गाइड में और जानें।

अस्पष्टता बैज

किसी प्रॉपर्टी के नाम को उसके पैरेंट ऑब्जेक्ट के संदर्भ में पढ़ें: वह कितनी अलग-अलग चीज़ें पूछ सकता है? ठीक एक हो तो नाम स्पष्ट है। दो या उससे ज़्यादा हों तो प्रॉपर्टी पर अस्पष्ट बैज लग जाता है — एम्बर, जब अर्थ ज़्यादातर आपस में मिलते-जुलते हों और फ़र्क सिर्फ़ किनारे के मामलों में हो; लाल, जब उनसे काफ़ी अलग डेटा निकले। बैज पर होवर करके वे प्रतिस्पर्धी व्याख्याएँ पढ़ें जो नाम से निकल सकती हैं, और वह नया लिखा गया विवरण भी जो उनमें से ठीक एक को तय कर देता है। ऐसा नाम भी चिह्नित होता है जिसका पैरेंट के पास कोई जवाब ही नहीं है: वहाँ टूलटिप उन अर्थों की सूची देता है जिन पर विचार करके उन्हें खारिज किया गया, और सुधार है नाम बदलना या उसे हटा देना — कोई विवरण किसी एंटिटी को ऐसी प्रॉपर्टी नहीं दे सकता जो उसके पास है ही नहीं।

री-चेक बटन

टूलबार में शील्ड आइकन उन प्रॉपर्टीज़ का विश्लेषण करता है जिनकी अभी तक कोई एनोटेशन नहीं है, और सब कुछ एनोटेट हो जाने पर पूर्ण पुनः विश्लेषण पर स्विच कर जाता है। हर रन एक छोटी बिल की गई AI कॉल है।

यहाँ इसका समाधान एक विवरण है

सहेजे गए स्कीमा पर बैज हमेशा नया लिखा गया विवरण सुझाता है, नाम बदलना कभी नहीं: स्कीमा लाइव है, इसलिए अर्थ को विवरण में तय करने से डेटा कॉन्ट्रैक्ट बरकरार रहता है। ऐसा विवरण जो सिर्फ़ नाम को दोहराता है, कुछ नहीं जोड़ता, और उस प्रॉपर्टी को ऐसे आँका जाता है मानो उसका कोई विवरण हो ही नहीं।

बासी एनोटेशन

किसी प्रॉपर्टी को रीनेम करना या उसका विवरण एडिट करना उसकी एनोटेशन को हटा देता है — निर्णय दोनों पर आधारित था। एडिटर इन प्रॉपर्टीज़ को हाइलाइट करता है और री-चेक की सुविधा देता है।

प्रति-स्कीमा टॉगल

ओवरफ़्लो मेनू से किसी स्कीमा के लिए जाँच बंद करें — बैज और चेतावनियाँ गायब हो जाती हैं, और कभी विश्लेषित न किए गए स्कीमा पर फिर से चालू करने से जाँच अपने-आप चल जाती है।

पूरी कार्यप्रणाली — दोनों निर्णय, हर एक के पीछे की व्याख्याएँ, और क्यों स्कीमा बनने से पहले समाधान नाम बदलना है पर लाइव हो जाने के बाद विवरण — अस्पष्टता जाँच गाइड में समझाई गई है।

स्कीमा प्रबंधन

स्कीमा सेलेक्टर आपको स्कीमा बनाने, लोड करने, पिन करने, डुप्लिकेट करने और डिलीट करने देता है। स्कीमा प्रति ऑर्गनाइज़ेशन सेव होते हैं और सभी टीम सदस्यों के लिए सुलभ होते हैं।

ऑटो-सेव

परिवर्तन 2-सेकंड के विराम के बाद स्वतः सहेजे जाते हैं, अनावश्यक राइट्स से बचने के लिए content-hash डिडुप्लिकेशन के साथ।

Schema पिन करें

अक्सर उपयोग होने वाले schema को पिन करें ताकि वे सेलेक्टर सूची में सबसे ऊपर बने रहें।

डुप्लिकेट

मूल को प्रभावित किए बिना बदलावों के साथ प्रयोग करने के लिए किसी भी schema की प्रतिलिपि बनाएँ।

सॉफ्ट डिलीट

हटाए गए schema को पुनर्स्थापित किया जा सकता है। स्थायी विलोपन एक अलग कार्रवाई है।

अगले चरण