nlp
標記 nlp 主題、收錄中的開源專案,依星數排序。
- #331
💥 直接在 spaCy 中使用最新的 Stanza (StanfordNLP) 研究模型
★ 746+0近 7 天星數變化 - #332★ 745+0近 7 天星數變化
- #333★ 743+3近 7 天星數變化
- #334★ 738-1近 7 天星數變化
- #335
:clipboard: 用於 PubMed 開放存取 XML 子集與 MEDLINE XML 資料集的 Python 解析器
★ 738+0近 7 天星數變化 - #336
專門用於法律文字分析的精選資源、方法與工具列表。
★ 734+1近 7 天星數變化 - #337
在常數記憶體用量下,將現有 LLM 的長度大幅擴充套件至原始訓練長度之外,且無需重新訓練
★ 734-1近 7 天星數變化 - #338★ 734+1近 7 天星數變化
- #339★ 729+0近 7 天星數變化
- #340
在 PyTorch 中簡單實現 OpenAI CLIP 模型
★ 726+0近 7 天星數變化 - #341★ 726+0近 7 天星數變化
- #342★ 721+4近 7 天星數變化
- #343★ 721+1近 7 天星數變化
- #344★ 711+0近 7 天星數變化
- #345
VectorFlow 是一個高吞吐量的向量嵌入管線,能擷取原始資料、將其轉換為向量,並寫入您選擇的向量資料庫中。
★ 703+0近 7 天星數變化 - #346★ 702+0近 7 天星數變化
- #347
全端機器學習(ML)學習藍圖涵蓋成為機器學習各方面專家所需的技能與技術,包含資料收集與前處理、模型開發、部署與維護。
★ 700-1近 7 天星數變化 - #348
用於非結構化法律文字 NLP 的 spaCy 管道與模型。
★ 696+0近 7 天星數變化 - #349★ 691+0近 7 天星數變化
- #350
建構由 LLM 驅動的 Dart/Flutter 應用程式。
★ 686+0近 7 天星數變化 - #351
🔥 Rankify:用於檢索、重新排序與檢索增強生成(RAG)的全方位 Python 工具包 🔥。本工具包整合了 40 個預先檢索的基準資料集,並支援 7 種以上檢索技術、24 種以上最先進的 Reranking 模型以及多種 RAG 方法。
★ 683+2近 7 天星數變化 - #352
讓 Stanford Open Information Extraction 變得簡單!
★ 682+0近 7 天星數變化 - #353★ 676+2近 7 天星數變化
- #354
SpaCy 中文模型
★ 673+0近 7 天星數變化 - #355
Ekphrasis 是一個文字處理工具,專為來自 Twitter 或 Facebook 等社群網路的文字而設計。Ekphrasis 使用來自兩個大型語料庫(英文維基百科、Twitter - 3.3億條英文推文)的單字統計數據,執行標記化、單字正規化、單字分割(用於分割 hashtag)和拼字校正。
★ 673+0近 7 天星數變化 - #356★ 666+2近 7 天星數變化
- #357★ 665+2近 7 天星數變化
- #358
使用 Python 在文字中尋找日期並傳回 datetime 物件
★ 665+0近 7 天星數變化 - #359
用於情感分析與社群 NLP 任務的 Python 多語言工具包
★ 659-1近 7 天星數變化 - #360
在 Obsidian 中使用 ChatGPT 快速格式化你的筆記
★ 658-2近 7 天星數變化