दस्तावेज़ शब्द आवृत्ति भार सांख्यिकी उपकरण
टेक्स्ट दस्तावेज़ों के शब्द-आवृत्ति वितरण का बैच विश्लेषण करें, TF-IDF और BM25 वेट गणना का समर्थन करता है
ब्राउज़र निष्पादन मोड: आपका डेटा आपके ब्राउज़र में प्रोसेस होता है और सर्वर पर अपलोड नहीं किया जाता.
गति और स्थिरता: प्रोसेसिंग गति आपके डिवाइस और ब्राउज़र पर निर्भर करती है। बड़े बैच कार्यों के लिए डेस्कटॉप संस्करण अधिक स्थिर हो सकता है।
टूल लोड हो रहा है, कृपया प्रतीक्षा करें...
यदि ऑनलाइन टूल लोड या रन नहीं हो सके, तो डेस्कटॉप टूल आज़माएँ। https://tools.yikeaigc.com/
टूल उपयोग
पुराने संस्करण पर लौटेंTXT, TEXT, MD, CSV, SRT, LOG समर्थित। फ़ाइल सामग्री ब्राउज़र में पढ़ी और विश्लेषित होगी।
पहले TXT फ़ाइल जोड़ें, टेक्स्ट पेस्ट करें या उदाहरण डेटा लोड करें।
सामान्य मान: K1 लगभग 1.2-2.0, B लगभग 0.75। मान BM25 स्कोर क्रम को प्रभावित करते हैं।
फ़ाइल और पैरामीटर सही हों तो विश्लेषण शुरू करें। प्रक्रिया के दौरान पेज खुला रखें।
प्रगति 0%
| रैंक | शब्द | रेंज | शब्द आवृत्ति | दस्तावेज़ संख्या | कवरेज | घनत्व | TF-IDF | BM25 | पहली स्थिति |
|---|
निर्देश
सॉफ़्टवेयर उपयोग निर्देश
- टेक्स्ट सामग्री चुनें: TXT, MD, CSV, SRT, LOG आदि टेक्स्ट फ़ाइलों को बैच में आयात करने के लिए “फ़ाइल चुनें” पर क्लिक करें, या “टेक्स्ट पेस्ट करें” पर स्विच करके सीधे सामग्री दर्ज करें; प्रक्रिया का अनुभव करने के लिए उदाहरण डेटा लोड किया जा सकता है।
- फ़ाइल सूची की पुष्टि करें: बैच में फ़ाइलें चुनने के बाद, इंटरफ़ेस पहले 20 फ़ाइलें दिखाता है, बाकी फ़ाइलें संख्या संकेत के रूप में दिखाई जाएँगी; वास्तविक विश्लेषण के दौरान सभी फ़ाइलें फिर भी प्रोसेसिंग में शामिल होंगी।
- शब्द-विभाजन नियम सेट करें: चीनी शब्द-विभाजन विधि, न्यूनतम शब्द लंबाई और चीनी संयुक्त शब्द लंबाई चुनें; यदि निश्चित उद्योग-विशेष शब्द हैं, तो “कस्टम संरक्षित शब्द” में प्रत्येक पंक्ति में एक शब्द भरें।
- वज़न एल्गोरिदम कॉन्फ़िगर करें:
- शब्द आवृत्ति आँकड़े: शब्दों के प्रकट होने की संख्या, दस्तावेज़ कवरेज संख्या और कीवर्ड घनत्व की गणना करें।
- TF-IDF वज़न: शब्द आवृत्ति और इनवर्स डॉक्यूमेंट फ़्रीक्वेंसी के आधार पर शब्दों की विभेदक क्षमता का मूल्यांकन करें।
- BM25 वज़न: शब्द आवृत्ति, दस्तावेज़ आवृत्ति और दस्तावेज़ लंबाई को मिलाकर प्रासंगिकता स्कोर की गणना करें।
- फ़िल्टर विकल्प समायोजित करें: स्टॉपवर्ड फ़िल्टरिंग, संख्याएँ बनाए रखना, अंग्रेज़ी अपर/लोअर केस भेद सक्षम किया जा सकता है, और प्रदर्शित परिणामों की संख्या तथा डिफ़ॉल्ट सॉर्टिंग विधि सेट की जा सकती है।
- सेटिंग्स सहेजें: सामान्य पैरामीटर बनाए रखने के लिए “सेटिंग्स सहेजें” पर क्लिक करें, अगली बार टूल खोलने पर वे स्वचालित रूप से बहाल हो जाएँगे; फिर से कॉन्फ़िगर करने की आवश्यकता होने पर “डिफ़ॉल्ट पुनर्स्थापित करें” पर क्लिक किया जा सकता है।
- विश्लेषण शुरू करें: “विश्लेषण शुरू करें” पेज पर जाने के बाद “विश्लेषण शुरू करें और अगला चरण” पर क्लिक करें, टूल टेक्स्ट पढ़ेगा, शब्द-विभाजन करेगा, शब्द आवृत्ति की गणना करेगा और वज़न की गणना करेगा।
- परिणाम देखें और डाउनलोड करें: विश्लेषण पूरा होने के बाद परिणाम तालिका में कीवर्ड खोजे जा सकते हैं और वर्तमान CSV परिणाम डाउनलोड किया जा सकता है; बैच फ़ाइलों के लिए ZIP संपीड़ित पैकेज डाउनलोड किया जा सकता है, एकल दस्तावेज़ रिपोर्ट मूल फ़ाइल नाम के अनुसार निर्यात होगी, और समान नाम वाली फ़ाइलों में अंतर करने के लिए स्वचालित रूप से संख्या जोड़ दी जाएगी।
सामान्य प्रश्न
संबंधित टूल
Word दस्तावेज़ बैच फ़ॉर्मेटिंग टूल
Word दस्तावेज़ों का बैच प्रोसेसिंग करें, शीर्षक स्तरों की...
TXT में निर्दिष्ट पंक्तियाँ बैच में हटाने का टूल
TXT फ़ाइलों का बैच प्रोसेसिंग करें, कीवर्ड फ़िल्टरिंग, पं...
Markdown संपादन और बैच रूपांतरण टूल
Markdown संपादन पूर्वावलोकन का समर्थन करता है, HTML, PDF,...
टेक्स्ट फ़ाइल नाम समानता फ़िल्टर टूल
फ़ाइल नाम की समानता के आधार पर TXT/HTML फ़ाइलों को समूहित...
ऑनलाइन टेक्स्ट तुलना टूल
दो पाठों के अंतर की ऑनलाइन तुलना करें, पंक्ति-दर-पंक्ति त...
टेक्स्ट वॉटरमार्क एम्बेडिंग टूल
पेशेवर पाठ कॉपीराइट संरक्षण टूल, वॉटरमार्क एम्बेडिंग और न...
Word को लंबी इमेज में बदलने का टूल
Word दस्तावेज़ों को तुरंत हाई-डेफिनिशन लंबी इमेज में बदले...