nlp
Dépôts open source suivis étiquetés nlp, triés par étoiles.
- #331
Utilisez directement les derniers modèles de recherche Stanza (StanfordNLP) dans spaCy
★ 746+0Évolution des étoiles sur les 7 derniers jours - #332★ 745+0Évolution des étoiles sur les 7 derniers jours
- #333
Le corpus de poésie moderne chinoise le plus complet au monde, avec plus de 3 000 poètes, 80 000 poèmes et 15 millions de caractères.
★ 742+3Évolution des étoiles sur les 7 derniers jours - #334
Le dépôt de référence pour la recherche et le développement de pointe en matière de réponse aux questions multilingues.
★ 738-1Évolution des étoiles sur les 7 derniers jours - #335
Un parseur Python pour le sous-ensemble XML en accès libre de PubMed et le jeu de données XML MEDLINE
★ 738+0Évolution des étoiles sur les 7 derniers jours - #336
Une liste de ressources, méthodes et outils sélectionnés dédiés à l'analyse de textes juridiques.
★ 735+1Évolution des étoiles sur les 7 derniers jours - #337
Étend les LLM existants bien au-delà de leur longueur d'entraînement d'origine avec une utilisation de mémoire constante, sans réentraînement
★ 734-1Évolution des étoiles sur les 7 derniers jours - #338
Famille PromptKG : une galerie de travaux de recherche, de boîtes à outils et de listes d'articles liés à l'apprentissage par prompt et aux graphes de connaissances (KG).
★ 734+1Évolution des étoiles sur les 7 derniers jours - #339★ 729+0Évolution des étoiles sur les 7 derniers jours
- #340★ 726+0Évolution des étoiles sur les 7 derniers jours
- #341
Implémentation simple du modèle OpenAI CLIP en PyTorch.
★ 726+0Évolution des étoiles sur les 7 derniers jours - #342
Réexamen des modèles pré-entraînés pour le traitement automatique du langage naturel en chinois (MacBERT)
★ 721+1Évolution des étoiles sur les 7 derniers jours - #343
Système de méthode d'envoi du japonais pour Linux, macOS, moteur de conversion Kana-Kanji neuronal
★ 720+4Évolution des étoiles sur les 7 derniers jours - #344
Moteur de recherche ancré (avec références de sources) basé sur LLM / ChatGPT / OpenAI API. Il prend en charge la recherche sur le Web, la recherche de contenu de fichiers, etc.
★ 711+0Évolution des étoiles sur les 7 derniers jours - #345
VectorFlow est un pipeline d'embedding vectoriel à haut volume qui ingère des données brutes, les transforme en vecteurs et les écrit dans la base de données vectorielle de votre choix.
★ 703+0Évolution des étoiles sur les 7 derniers jours - #346
Chatbot basé sur la compréhension du langage naturel et l'apprentissage automatique, prenant en charge la simultanéité multi-utilisateur et les dialogues multi-tours personnalisés
★ 702+0Évolution des étoiles sur les 7 derniers jours - #347
Une feuille de route ML (Machine Learning) Full Stack implique l'apprentissage des compétences et technologies nécessaires pour maîtriser tous les aspects du machine learning, y compris la collecte et le prétraitement des données, le développement, le déploiement et la maintenance des modèles.
★ 701+0Évolution des étoiles sur les 7 derniers jours - #348
:black_circle: Un pipeline et un modèle spaCy pour le TALN sur du texte juridique non structuré.
★ 696+0Évolution des étoiles sur les 7 derniers jours - #349★ 691+0Évolution des étoiles sur les 7 derniers jours
- #350
Créez des applications Dart/Flutter alimentées par des LLM.
★ 686+0Évolution des étoiles sur les 7 derniers jours - #351
🔥 Rankify : un toolkit Python complet pour la récupération, le re‑ranking et la génération augmentée par récupération 🔥. Notre toolkit intègre 40 jeux de données de référence pré‑récupérés et prend en charge plus de 7 techniques de récupération, plus de 24 modèles de re‑ranking de pointe, ainsi que plusieurs méthodes RAG.
★ 682+1Évolution des étoiles sur les 7 derniers jours - #352
Open Information Extraction de Stanford simplifiée !
★ 682+0Évolution des étoiles sur les 7 derniers jours - #353★ 675+1Évolution des étoiles sur les 7 derniers jours
- #354
Modèles pour SpaCy prenant en charge le chinois
★ 673+0Évolution des étoiles sur les 7 derniers jours - #355
Ekphrasis est un outil de traitement de texte orienté vers les textes issus des réseaux sociaux, tels que Twitter ou Facebook. Ekphrasis effectue la tokenisation, la normalisation des mots, la segmentation des mots (pour la division des hashtags) et la correction orthographique, en utilisant des statistiques de mots provenant de 2 grands corpus (Wikipedia anglais, Twitter - 330 millions de tweets en anglais).
★ 673+0Évolution des étoiles sur les 7 derniers jours - #356
Une bibliothèque Python rapide, légère et facile à utiliser pour diviser le texte en tronçons sémantiquement significatifs.
★ 665+1Évolution des étoiles sur les 7 derniers jours - #357
Trouver des dates dans le texte en utilisant Python et obtenir des objets datetime
★ 665+0Évolution des étoiles sur les 7 derniers jours - #358
Bibliothèque moderne de vérification orthographique : précise, rapide et multilingue.
★ 664+1Évolution des étoiles sur les 7 derniers jours - #359
Un kit multilingue Python pour l'analyse de sentiment et les tâches de NLP social
★ 660+0Évolution des étoiles sur les 7 derniers jours - #360
Formatez rapidement vos notes avec ChatGPT dans Obsidian
★ 658-2Évolution des étoiles sur les 7 derniers jours