chinese-nlp
標記 chinese-nlp 主題、收錄中的開源專案,依星數排序。
相關主題
常跟 chinese-nlp 一起出現在同一個專案上的主題。
近期新秀
近 90 天內建立、標記 chinese-nlp 主題的專案。
近 90 天內還沒有新專案標記這個主題。
- #1★ 33,567+0近 7 天星數變化
- #2
大規模中文自然語言處理語料庫 Large Scale Chinese Corpus for NLP
★ 9,912+0近 7 天星數變化 - #3★ 8,274+0近 7 天星數變化
- #4★ 5,259+0近 7 天星數變化
- #5
MNBVC(Massive Never-ending BT Vast Chinese corpus)超大規模中文語料集。對標 chatGPT 訓練的 40T 數據。MNBVC 數據集不僅包括主流文化,也包括各個小眾文化甚至火星文的數據。MNBVC 數據集包含新聞、作文、小說、書籍、雜誌、論文、台詞、帖子、wiki、古詩、歌詞、商品介紹、笑話、糗事、聊天記錄等一切形式的純文本中文數據。
★ 4,272+0近 7 天星數變化 - #6
Fengshenbang-LM(封神榜大模型)是 IDEA 研究院認知計算與自然語言研究中心主導的大模型開源體系,成為中文 AIGC 與認知智能的基礎設施。
★ 4,122+0近 7 天星數變化 - #7★ 3,043+0近 7 天星數變化
- #8
使用 IDCNN/biLSTM+CRF 的中文命名實體識別,以及使用 biGRU+2ATT 的關係提取 中文实体识别与关系提取
★ 2,264+0近 7 天星數變化 - #9
華東師範大學 ICALK 推出的開源教育對話模型。開源中英教育對話大模型。(通用基座模型,GPU部署,數據清理) 致敬: LLaMA, MOSS, BELLE, Ziya, vLLM
★ 969+1近 7 天星數變化 - #10
透明的 Python RAG 參考實作,採用 FAISS + BM25 混合檢索、重新排序、Gradio UI 與 FastAPI。
★ 952+1近 7 天星數變化 - #11
:four_leaf_clover: 另一款以 PyTorch 實作的中文聊天機器人,它是智慧工單處理機器人的子模組。 👩🔧
★ 916+0近 7 天星數變化 - #12★ 870+0近 7 天星數變化
- #13
Rime 粵語拼音輸入方案 | 中州韻粵語拼音輸入方案
★ 680+4近 7 天星數變化 - #14
SpaCy 中文模型
★ 673+0近 7 天星數變化 - #15
微信公眾號 AI 營運助手 | 涵蓋選題、寫稿、審稿、排版、配圖、發布全流程 Skill,支援 OpenClaw / Claude Code / Cursor / Codex。
★ 585+38近 7 天星數變化