अध्याय 64 मिनट पढ़ने का समय·आधिकारिक मैनुअल · संस्करण 2026

The Kateeb engine, multi-record extraction, zero-hallucination rules, and resume.

6 · एक निष्कर्षण चलाना

कतार में सत्यापित फ़ाइलों और एक सहेजी गई स्कीमा के साथ, आप मुख्य कार्यक्रम के लिए तैयार हैं।

नौकरी शुरू करना

फ़ाइलें टैब में, प्रक्रिया (एन) सत्यापित पर क्लिक करें (या फ़्लोटिंग डॉक में 3-पास एआई एक्सट्रैक्शन प्रारंभ करें)। क्या होता है:

  1. 1 क्रेडिट प्रति पेपर अग्रिम शुल्क लिया जाता है।
  2. A job आपके कागजात और आपके स्कीमा का एक स्थायी स्नैपशॉट शामिल करके बनाया गया है।
  3. आपको एक पुष्टिकरण ईमेल मिलता है ("Sci-databaseनौकरी सबमिट हो गई है"), टोस्ट "नौकरी जमा हो गई है - एन कागजात अब संसाधित किए जा रहे हैं।" प्रकट होता है, और ऐप आपको स्वचालित रूप से डेटाबेस टैब पर स्विच करता है।

नौकरी जमा हो गई है - प्रक्रिया शुरू हो गई है

आप ब्राउज़र बंद कर सकते हैं - सर्वर पर प्रोसेसिंग जारी रहती है, और परिणाम आपको ईमेल कर दिए जाएंगे।

प्रत्येक पेपर का क्या होता है

कागजात को एक समय में एक क्रम में संसाधित किया जाता है:

  1. पीडीएफ डाउनलोड किया गया है और इसका पूरा पाठ निकाला गया है (~950,000 अक्षरों तक - संपूर्ण कागजात, केवल सार नहीं)।
  2. Kateeb इंजन सख्त निर्देशों के तहत आपके स्कीमा के विरुद्ध पाठ पढ़ता है - प्रमुख निर्देश, निष्कर्षण संकेत से शब्दशः:
    • "स्कीमा से मेल खाने वाले सभी अलग-अलग रिकॉर्ड ढूंढें" - एक पेपर एकाधिक पंक्तियाँ (उदाहरण के लिए कई सामग्री या अध्ययन हथियार) तैयार कर सकता है।
    • "यदि कोई पेपर स्कीमा के लिए अप्रासंगिक है, तो एक खाली सरणी लौटाएं" - अप्रासंगिक कागजात कुछ भी नहीं देते हैं, शोर नहीं।
    • "किसी भी फ़ील्ड के लिए, यदि मान गायब है, मौजूद नहीं है, या आप 99% आश्वस्त नहीं हैं, तो आपको सटीक स्ट्रिंग 'N/A' लौटाना होगा। शून्य या अनुमान का उपयोग न करें।"
    • "संख्यात्मक मानों के लिए, कागज से सटीक मान निकालें। गोल न करें।"
  3. निकाले गए रिकॉर्ड और टोकन उपयोग को कार्य में सहेजा जाता है।

प्रगति देखना

Database टैब कार्य चलने के दौरान हर कुछ सेकंड में स्वचालित रूप से ताज़ा हो जाता है। प्रत्येक पेपर में एक स्टेटस बैज होता है:

बैज मतलब
कतारबद्ध अपनी बारी का इंतजार
प्रसंस्करण (स्पिनर) अभी पढ़ा जा रहा है
पूर्ण निष्कर्षण समाप्त
त्रुटि यह पेपर विफल रहा (उदाहरण के लिए अपठनीय/स्कैन किया हुआ पीडीएफ) - त्रुटि संदेश पेपर पर संग्रहीत है

कार्य स्तर की स्थितियाँ: प्रसंस्करण → पूर्ण (सभी पेपर सफल), "एक्स/वाई पूर्ण" (आंशिक सफलता - कुछ पेपर विफल), या त्रुटि (कोई भी सफल नहीं हुआ)।

डेटाबेस टैब में नौकरियों की सूची

रुको और फिर से शुरू करो

  • Stop (कार्य पंक्ति पर ⏹ आइकन) वर्तमान पेपर के बाद कर्मचारी को रोक देता है: "कार्य रुका हुआ है - प्रसंस्करण शीघ्र ही रुक जाएगा।" पहले ही पूरे हो चुके कागजात अपना डेटा रखते हैं।
  • Resume (↻ आइकन) रुके हुए या आंशिक कार्य को पुनः प्रारंभ करता है। केवल अधूरे कागजों को दोबारा कतारबद्ध और पुनः चार्ज किया जाता है (प्रत्येक को 1 क्रेडिट) - पूरे किए गए कागजों को कभी भी दोबारा संसाधित या दोबारा चार्ज नहीं किया जाता है।

जब काम ख़त्म हो जाए

  • आपको एक ईमेल प्राप्त होता है - "Sci-databaseकार्य समाप्त" - परिणामों के साथ CSVसंलग्न, इसलिए ऐप पर लौटने से पहले ही आपका डेटाबेस आपके इनबॉक्स में है।
  • डैशबोर्ड का "अगला चरण" कार्ड "अपना नया डेटाबेस खोजें" पर आगे बढ़ता है।

पैमाने पर एक नोट: एक भी रुका हुआ पेपर आपके काम को अवरुद्ध नहीं कर सकता है - यदि किसी पेपर में त्रुटि होती है, तो कर्मचारी त्रुटि को रिकॉर्ड करता है और आगे बढ़ता है, और काम आंशिक सफलता के रूप में समाप्त होता है जिसे आप फिर से शुरू कर सकते हैं या वैसे ही निर्यात कर सकते हैं।


अगला: सत्यापन और एआई जज →

मदद चाहिए? अक्सर पूछे जाने वाले प्रश्न देखें।
    6 · Running an Extraction | Sci-database Documentation