nlp
nlp टैग वाली ट्रैक की गई ओपन सोर्स रिपॉजिटरी, स्टार के हिसाब से क्रमबद्ध।
- #61
OCR-मुक्त दस्तावेज़ समझ ट्रांसफॉर्मर (Donut) और सिंथेटिक दस्तावेज़ जेनरेटर (SynthDoG), ECCV 2022 का आधिकारिक कार्यान्वयन
★ 6,917+0पिछले 7 दिनों में स्टार का बदलाव - #62
वेब पर टेक्स्ट और मेटाडेटा एकत्र करने के लिए Python और कमांड-लाइन टूल: क्रॉलिंग, स्क्रैपिंग, एक्सट्रैक्शन, CSV, JSON, HTML, MD, TXT, XML के रूप में आउटपुट
★ 6,754+0पिछले 7 दिनों में स्टार का बदलाव - #63
बॉट बनाने के लिए एक NLP लाइब्रेरी, जिसमें एंटिटी एक्सट्रैक्शन, सेंटीमेंट एनालिसिस, ऑटोमैटिक लैंग्वेज आइडेंटिफिकेशन और बहुत कुछ शामिल है
★ 6,588+0पिछले 7 दिनों में स्टार का बदलाव - #64
यह रिपॉजिटरी आर्टिफिशियल इंटेलिजेंस (AI) के बारे में विभिन्न पाठ्यक्रमों और संसाधनों के लिंक का एक संग्रहित संग्रह है।
★ 6,482+0पिछले 7 दिनों में स्टार का बदलाव - #65
Python में लिखी गई ओपन-सोर्स ऑफ़लाइन अनुवाद लाइब्रेरी
★ 6,425+0पिछले 7 दिनों में स्टार का बदलाव - #66★ 6,416+0पिछले 7 दिनों में स्टार का बदलाव
- #67★ 6,327+0पिछले 7 दिनों में स्टार का बदलाव
- #68
Tensorflow Machine Learning Cookbook के लिए कोड
★ 6,238+0पिछले 7 दिनों में स्टार का बदलाव - #69★ 6,176+0पिछले 7 दिनों में स्टार का बदलाव
- #70
👮♂️ Java के लिए संवेदनशील शब्द टूल। (DFA एल्गोरिथ्म के आधार पर उच्च-प्रदर्शन Java संवेदनशील शब्द फ़िल्टरिंग टूल फ़्रेमवर्क। अंतर्निहित समर्थन शब्द टैग वर्गीकरण और ग्रेडिंग। कृपया राजनीति, विज्ञापन, विपणन, फ़्लिपिंग दीवार, राष्ट्रीय कानूनों और विनियमों का उल्लंघन करने वाली सामग्री प्रकाशित न करें। उच्च-प्रदर्शन संवेदनशील शब्द का पता लगाने और फ़िल्टरिंग घटक, पारंपरिक और सरलीकृत चीनी परस्पर रूपांतरण के साथ, पूर्ण-चौड़ाई और आधे-चौड़ाई के परस्पर रूपांतरण का समर्थन करता है, चीनी अक्षरों को पिनयिन में परिवर्तित करता है, फ़ज़ी खोज और अन्य कार्य।)
★ 6,036+0पिछले 7 दिनों में स्टार का बदलाव - #71
CLIP का चीनी संस्करण जो चीनी क्रॉस-मोडल पुनर्प्राप्ति और प्रतिनिधित्व पीढ़ी को प्राप्त करता है।
★ 6,001+0पिछले 7 दिनों में स्टार का बदलाव - #72★ 5,709+0पिछले 7 दिनों में स्टार का बदलाव
- #73
शानदार प्रीट्रेनड चीनी NLP मॉडल, उच्च गुणवत्ता वाले चीनी प्रीट्रेनड मॉडल, बड़े मॉडल, मल्टीमॉडल मॉडल और लार्ज लैंग्वेज मॉडल का संग्रह
★ 5,584+0पिछले 7 दिनों में स्टार का बदलाव - #74★ 5,259+0पिछले 7 दिनों में स्टार का बदलाव
- #75
लोकल-फर्स्ट हेल्थकेयर AI: क्लिनिकल NER और HIPAA PII डी-आइडेंटिफ़िकेशन जो 100% ऑन-डिवाइस चलता है। 2,200+ मेडिकल मॉडल, 21 भाषाएँ, Apple MLX + Python, कोई क्लाउड नहीं, कोई रोगी डेटा आपके नेटवर्क से बाहर नहीं जाता। Apache-2.0
★ 5,199+0पिछले 7 दिनों में स्टार का बदलाव - #76
Claude स्किल जो AI द्वारा लिखे गए कोरियाई को इंसान की तरह लिखती है — कोरियन AI-टेक्स्ट ह्यूमैनलाइज़र: अनुवाद की भाषा, यांत्रिक समानता और 71 अन्य AI संकेतों का पता लगाता है और उन्हें फिर से लिखता है
★ 5,178+0पिछले 7 दिनों में स्टार का बदलाव - #77★ 5,141+0पिछले 7 दिनों में स्टार का बदलाव
- #78★ 5,111+0पिछले 7 दिनों में स्टार का बदलाव
- #79
Argilla उच्च गुणवत्ता वाले डेटासेट बनाने के लिए AI इंजीनियरों और डोमेन विशेषज्ञों के लिए एक सहयोग टूल है
★ 5,093+0पिछले 7 दिनों में स्टार का बदलाव - #80
BenCao [मूल नाम: HuaTuo (华驼)] के लिए रिपो, चीनी चिकित्सा ज्ञान के साथ लार्ज लैंग्वेज मॉडल की इंस्ट्रक्शन-ट्यूनिंग।
★ 4,989+0पिछले 7 दिनों में स्टार का बदलाव - #81
text2vec, text to vector. टेक्स्ट को वेक्टर मैट्रिक्स में बदलने के लिए एक टेक्स्ट वेक्टर प्रतिनिधित्व टूल, जो Word2Vec, RankBM25, Sentence-BERT, CoSENT आदि जैसे टेक्स्ट प्रतिनिधित्व और टेक्स्ट समानता गणना मॉडल को लागू करता है, उपयोग के लिए तैयार है।
★ 4,974+0पिछले 7 दिनों में स्टार का बदलाव - #82★ 4,927+0पिछले 7 दिनों में स्टार का बदलाव
- #83
प्रॉम्प्ट-लर्निंग के लिए एक ओपन-सोर्स फ्रेमवर्क।
★ 4,889+0पिछले 7 दिनों में स्टार का बदलाव - #84
दुनिया भर के सड़क पतों को पार्स/सामान्य करने के लिए एक C लाइब्रेरी। सांख्यिकीय NLP और खुले भू-डेटा द्वारा संचालित।
★ 4,880+0पिछले 7 दिनों में स्टार का बदलाव - #85
Learn Prompting द्वारा Prompt Engineering, Generative AI, और LLM गाइड | सबसे बड़े Prompt Engineering लर्निंग कम्युनिटी के लिए हमारे Discord से जुड़ें
★ 4,728+0पिछले 7 दिनों में स्टार का बदलाव - #86★ 4,665+0पिछले 7 दिनों में स्टार का बदलाव
- #87
प्रॉम्प्ट इंजीनियरिंग | प्रॉम्प्ट वर्ज़निंग | संरचित आउटपुट प्राप्त करने के लिए GPT या अन्य प्रॉम्प्ट-आधारित मॉडल का उपयोग करें। प्रॉम्प्ट-इंजीनियरिंग, LLMs और अन्य नवीनतम शोध के लिए हमारे discord से जुड़ें।
★ 4,637+0पिछले 7 दिनों में स्टार का बदलाव - #88
सेंटीमेंट एनालिसिस के लिए PyTorch और TorchText के साथ शुरुआत करने पर ट्यूटोरियल।
★ 4,612+0पिछले 7 दिनों में स्टार का बदलाव - #89
"लार्ज लैंग्वेज मॉडल" लेखक: झाओ शिन, ली जुनिई, झोउ कुन, तांग तियानयी, वेन जिरोंग
★ 4,557+0पिछले 7 दिनों में स्टार का बदलाव - #90
लार्ज लैंग्वेज मॉडल, AI पेंटिंग और अन्य के लिए क्यूरेटेड ट्यूटोरियल और संसाधन।
★ 4,537+0पिछले 7 दिनों में स्टार का बदलाव