1. AI प्रोसेसिंग पाइपलाइन
- 01एक्सटेंशन मौजूदा PDF को ब्राउज़र में रखता है और दस्तावेज़ की पहचान स्थापित करने के लिए उसके कॉन्टेंट का hash कैलकुलेट करता है।
- 02हर दस्तावेज़ संबंधी AI अनुरोध के साथ मौजूदा पूरी PDF भेजी जाती है; API वास्तविक बाइट्स के hash और स्वामित्व की दोबारा पुष्टि करता है।
- 03API, PostgreSQL से मौजूदा वार्तालाप का इतिहास लोड करता है और चयनित अंश, पेज नंबर या स्थानीय PDF.js सेगमेंट व्यवस्थित करता है।
- 04पूरा PDF, पिछली बातचीत और मौजूदा प्रश्न कॉन्फ़िगर किए गए स्टेटलेस तृतीय-पक्ष मॉडल प्रदाता को भेजे जाते हैं।
- 05मॉडल का आउटपुट रीडिंग इंटरफ़ेस में लौटाया जाता है; API उन नतीजों और उपयोग डेटा को सहेजता है जिन्हें स्थायी रूप से रखने की अनुमति है, और इस अनुरोध के PDF बाइट्स को मुक्त कर देता है।
2. अलग-अलग सुविधाओं द्वारा उपयोग की जाने वाली सामग्री
- सारांश और कीवर्ड:वर्तमान PDF की मूल संपूर्ण PDF का उपयोग करके एक बार दस्तावेज़-स्तरीय समेकित अवलोकन तैयार किया जाता है और परिणाम कैश किया जाता है।
- संपूर्ण पाठ पर प्रश्नोत्तर:हर दौर में पूरी PDF, सर्वर पर सहेजा गया वार्तालाप इतिहास और मौजूदा प्रश्न भेजे जाते हैं।
- चुने गए टेक्स्ट की व्याख्या:पूरा PDF, चुना गया टेक्स्ट या फ़ॉर्मूला, वास्तविक पेज नंबर और सामान्यीकृत निर्देशांक भेजे जाते हैं।
- चुने गए टेक्स्ट का अनुवाद:केवल उपयोगकर्ता द्वारा वर्तमान में चुनी गई सामग्री का अनुवाद करें; पूरे संदर्भ को अतिरिक्त रूप से विस्तृत न करें।
- पृष्ठ-दर-पृष्ठ अनुवाद:पूरा PDF और PDF.js द्वारा स्थानीय रूप से बनाए गए मौजूदा पेज के सेगमेंट भेजे जाते हैं, और हर पेज की स्थिति व परिणाम सहेजे जाते हैं।
- स्वचालित हाइलाइटिंग:पूरी PDF के आधार पर विधियों, योगदानों, परिणामों या उपयोगकर्ता द्वारा चुने गए अन्य प्रमुख प्रकारों की पहचान करना।
- चित्र का विवरण:सुविधा सक्षम होने पर, उपयोगकर्ता द्वारा पुष्टि किए गए PDF पेज के क्रॉप किए गए पिक्सेल, पेज नंबर, क्षेत्र और पूरी PDF एक साथ मॉडल को भेजे जाते हैं।
3. मॉडल और प्रदाता
क्लाइंट केवल सर्वर द्वारा उपलब्ध कराए गए मॉडल उपनाम चुन सकता है; वह सीधे कोई भी मनचाहा provider model ID सबमिट नहीं कर सकता। सर्वर इन उपनामों को वास्तविक प्रोटोकॉल के माध्यम से सत्यापित मॉडल से मैप करता है। यह मानकर नहीं चला जा सकता कि Provider, Files API, फ़ाइल के दोबारा उपयोग, सेशन या किसी अन्य असत्यापित क्षमता का समर्थन करता है।
दस्तावेज़ प्रदाता अनुरोधों को स्टेटलेस सेवा के रूप में संसाधित करता है, इसलिए एक ही PDF को कई AI अनुरोधों के दौरान बार-बार भेजा जा सकता है। आपूर्तिकर्ता अपनी सेवा शर्तों के अनुसार अनुरोधों को संसाधित कर सकते हैं। अनुबंध और कॉन्फ़िगरेशन संबंधी प्रमाण के अभाव में, Explixit “प्रशिक्षण के लिए कभी उपयोग नहीं” या “शून्य डेटा प्रतिधारण” का वादा नहीं करता।
4. फ़ॉर्मूले और रिच टेक्स्ट
Explixit फ़ॉर्मूलों को यथासंभव संरचित सामग्री के रूप में भेजता है और मॉडल के उत्तरों को रेंडर करने के लिए Markdown, DOMPurify और स्थानीय KaTeX का उपयोग करता है। फिर भी मॉडल से चर, सबस्क्रिप्ट, ट्रांसपोज़ या समीकरण की शर्तें छूट सकती हैं, इसलिए महत्वपूर्ण फ़ॉर्मूलों का मूल PDF से मिलान अवश्य करें।
5. छवियों का विवरण
इमेज की व्याख्या के अनुरोध में वास्तविक PDF canvas से क्रॉप की गई PNG या JPEG शामिल होनी चाहिए, न कि केवल OCR, कैप्शन या पहले से तय परीक्षण डेटा। सर्वर दस्तावेज़ का स्वामित्व, पेज नंबर, MIME, फ़ाइल सिग्नेचर, आकार और पिक्सेल आयाम सत्यापित करता है।
Explixit उपयोगकर्ता द्वारा क्रॉप की गई मूल इमेज को स्थायी रूप से संग्रहीत नहीं करता; यह केवल व्याख्या के स्रोत से संबंधित आवश्यक metadata और मॉडल के उत्तर सहेजता है। अनुरोधों का संसाधन मॉडल प्रदाताओं और इन्फ़्रास्ट्रक्चर की लॉगिंग नीतियों के अधीन भी होता है।
6. आउटपुट की सीमाएँ
- मॉडल तथ्यात्मक त्रुटियाँ, गलत उद्धरण, गलत फ़ॉर्मूले या शोधपत्र में मौजूद न होने वाले निष्कर्ष दे सकता है।
- स्कैन की गुणवत्ता, एन्क्रिप्शन, फ़ाइल का आकार, पृष्ठों की संख्या या मॉडल की कॉन्टेक्स्ट सीमा के कारण कुछ PDF फ़ाइलें अस्थायी रूप से अनुपलब्ध हो सकती हैं।
- एक ही प्रश्न के परिणाम अलग-अलग मॉडल, समय और संदर्भ के अनुसार भिन्न हो सकते हैं।
- हाइलाइट मॉडल द्वारा सुझाए गए पढ़ने के प्रमुख बिंदु दर्शाते हैं; वे सहकर्मी समीक्षा या शोधपत्र की गुणवत्ता का आकलन नहीं हैं।
- उपयोगकर्ताओं को मूल PDF, विश्वसनीय डेटाबेस और पेशेवर निर्णय के आधार पर महत्वपूर्ण सामग्री की पुष्टि करनी चाहिए।
7. मानवीय नियंत्रण
- उपयोगकर्ता तय करता है कि मौजूदा PDF के लिए Explixit रीडिंग मोड चालू करना है या नहीं।
- पूरे दस्तावेज़ के स्वचालित अनुवाद को रोका और फिर से शुरू किया जा सकता है। किसी एक पेज पर विफलता होने से अन्य पेजों का अनुवाद नहीं हटेगा।
- AI स्ट्रीमिंग टास्क रद्द किए जा सकते हैं। विफल या रद्द किए गए टास्क को पूर्ण परिणाम के रूप में नहीं दिखाया जाना चाहिए।
- मैन्युअल और स्वचालित हाइलाइट, टिप्पणियाँ, नोट्स और व्याख्या रिकॉर्ड देखे और हटाए जा सकते हैं।
- उपयोगकर्ता रीडिंग मोड से बाहर निकलकर Chrome के मूल PDF रीडर पर वापस जा सकता है।
8. सुरक्षा और फ़ीडबैक
API key केवल सर्वर पर सुरक्षित रखी जाती है। त्रुटि स्क्रीन पर key, आंतरिक स्टैक या पहले से तय फ़ॉलबैक उत्तर नहीं दिखाया जाना चाहिए। मॉडल से जुड़ी समस्याओं, उल्लंघन और सुरक्षा घटनाओं के लिए संपर्क करें explixitai@outlook.com。