Qwen3 और LM Studio के साथ स्थानीय रूप से सैकड़ों पृष्ठों के दस्तावेज़ों का विश्लेषण करें - डेटा क्लाउड में भेजे बिना
अपने कंप्यूटर पर 128K कॉन्टेक्स्ट विंडो वाला मॉडल चलाएं और किसी भी बड़े PDF या DOCX का सारांश, मुख्य बिंदु और उत्तर पाएं
- 1.LM Studio डाउनलोड और इंस्टॉल करें - यह स्थानीय रूप से AI मॉडल चलाने का प्रोग्राम है। वेबसाइट पर जाएं, अपने OS के लिए वर्शन चुनें (Windows / Mac / Linux) और इंस्टॉल करें।
प्रोग्राम मुफ़्त है और इंस्टॉल के बाद ऑफ़लाइन काम करता है। अगर आपके क्षेत्र से वेबसाइट नहीं खुलती - तो डाउनलोड के लिए VPN आज़माएं, मॉडल चलाने के लिए इंटरनेट की ज़रूरत नहीं है।
LM Studio ↗टूल के बारे में - 2.LM Studio खोलें, सर्च बार में «Qwen3 32B GGUF» लिखें और क्वांटाइज़्ड वर्शन डाउनलोड करें (नाम में Q4_K_M वाली फ़ाइल खोजें - यह गुणवत्ता और मेमोरी उपयोग का बेहतरीन संतुलन है)। Download दबाएं।
Qwen3 32B मॉडल 128,000 टोकन तक का कॉन्टेक्स्ट विंडो सपोर्ट करता है - यह लगभग 300 - 400 पृष्ठ का टेक्स्ट है। इसे चलाने के लिए 16+ GB RAM चाहिए। अगर कम मेमोरी है - तो Qwen3 14B या Qwen3 8B खोजें, वे भी बड़ा कॉन्टेक्ट सपोर्ट करते हैं।
LM Studio ↗टूल के बारे में - 3.मॉडल डाउनलोड होने के बाद चैट टैब पर जाएं (बाएं मेन्यू में बातचीत आइकन)। ऊपर ड्रॉपडाउन से डाउनलोड किया गया Qwen3 मॉडल चुनें। दाएं सेटिंग्स पैनल में «Context Length» पैरामीटर खोजें और इसे 131072 पर सेट करें (या जो अधिकतम आपकी ग्राफ़िक्स कार्ड/RAM अनुमति देती है)।
कॉन्टेक्स्ट विंडो जितना बड़ा, उतनी ज़्यादा RAM उपयोग होगी। अगर मॉडल नहीं चलता - तो Context Length को 65536 या 32768 तक कम करें। ज़्यादातर दस्तावेज़ों के लिए 32K काफ़ी है।
LM Studio ↗टूल के बारे में - 4.चैट इनपुट बार में पेन क्लिप बटन (या «Attach File») दबाएं और अपना दस्तावेज़ चुनें - PDF, DOCX या TXT। LM Studio टेक्स्ट निकालेगा और मॉडल कॉन्टेक्स्ट में लोड करेगा। रुकें जब तक फ़ाइल चैट में अटैचमेंट के रूप में दिखे।
⚠️ ध्यान दें: दस्तावेज़ स्थानीय रूप से प्रोसेस होता है और बाहरी सर्वर पर नहीं भेजा जाता। यह गोपनीय सामग्री के लिए सुरक्षित है। टेक्स्ट PDF सपोर्टेड हैं; बिना टेक्स्ट लेयर वाले स्कैन को पहले OCR से निकालें (जैसे मुफ़्त OCR MyPDF)।
LM Studio ↗टूल के बारे में - 5.चैट में निम्न प्रॉम्प्ट डालें, वर्ग कोष्ठक में टेक्स्ट को अपने काम से बदलें। Send दबाएं और मॉडल के जवाब का इंतज़ार करें।
मॉडल को जवाब देने में 30 सेकंड से कुछ मिनट लग सकते हैं - दस्तावेज़ के आकार और आपके हार्डवेयर की शक्ति पर निर्भर करता है। प्रोग्रेस टेक्स्ट के स्ट्रीमिंग आउटपुट में दिखती है।
LM Studio ↗टूल के बारे मेंप्रॉम्प्टआप एक विशेषज्ञ विश्लेषक हैं। संलग्न दस्तावेज़ ध्यान से पढ़ें और निम्न काम करें: 1. 5-7 वाक्यों में संक्षिप्त सारांश लिखें। 2. 10 सबसे महत्वपूर्ण बिंदुओं को बुलेट पॉइंट में सूचीबद्ध करें। 3. दस्तावेज़ में उल्लिखित सभी तारीखें, नंबर और संज्ञाओं को निकालें। 4. केवल दस्तावेज़ के आधार पर इस प्रश्न का उत्तर दें: [आपका_प्रश्न] अगर प्रश्न का उत्तर दस्तावेज़ में नहीं मिलता, तो कहें: «यह जानकारी दस्तावेज़ में मौजूद नहीं है।»
यह प्रॉम्प्ट क्या करता हैप्रॉम्प्ट मॉडल से अनुरोध करता है: 1) 5-7 वाक्यों में संक्षिप्त सारांश लिखना, 2) 10 मुख्य बिंदु निकालना, 3) सभी तारीखें, नंबर और नाम निकालना, 4) आपके प्रश्न का उत्तर दस्तावेज़ के अनुसार देना। [आपका_प्रश्न] को अपने विशिष्ट प्रश्न से बदलें, जैसे «अनुबंध में कौन से जोखिम बताए गए हैं?» या «प्रोजेक्ट का कुल बजट क्या है?»। अगर आप प्रश्न हिंदी में पूछेंगे तो मॉडल हिंदी में जवाब देगा। - 6.ज़रूरत पड़ने पर स्पष्टीकरण प्रश्न पूछें - मॉडल पूरे दस्तावेज़ को कॉन्टेक्स्ट में «याद» रखता है, और आप फ़ाइल दोबारा अपलोड किए बिना बातचीत जारी रख सकते हैं।
चैट इतिहास LM Studio में सहेजा जाता है। नए दस्तावेज़ का विश्लेषण शुरू करने के लिए - ऊपरी पैनल में «New Chat» दबाएं, वरना कॉन्टेक्स्ट जमा होगा और गति गिर जाएगी।
LM Studio ↗टूल के बारे मेंप्रॉम्प्टअब दस्तावेज़ के खंड [A] और खंड [B] की तुलना करें। उनके बीच किसी भी विरोधाभास, ओवरलैप या कमियों को उजागर करें। तुलना को तालिका के रूप में प्रस्तुत करें।
यह प्रॉम्प्ट क्या करता हैयह प्रॉम्प्ट मॉडल से दस्तावेज़ के दो खंडों की तुलना करने को कहता है, विरोधाभास, समानताएं और कमियां खोजने और परिणाम को तालिका में देने को। [A] और [B] को खंडों के नाम या नंबर से बदलें, जैसे «खंड 3» और «परिशिष्ट 2»।
- मुफ़्तLM Studioप्रोग्राम पूरी तरह मुफ़्त है, अनुरोधों या दस्तावेज़ों की संख्या पर कोई प्रतिबंध नहीं।
- मुफ़्तQwen3 32B GGUF (मॉडल)मॉडल मुफ़्त है और सीधे LM Studio से डाउनलोड होता है। 32B वर्शन चलाने के लिए 16+ GB RAM चाहिए; हल्के वर्शन (8B, 14B) 8 GB पर काम करते हैं।
आज ही क्यों
AI सेवाएँ तेज़ी से बदलती हैं - इंटरफ़ेस और मुफ़्त सीमाएँ बताए गए से अलग हो सकती हैं।