nlp
標記 nlp 主題、收錄中的開源專案,依星數排序。
- #181★ 1,788+0近 7 天星數變化
- #182★ 1,778+0近 7 天星數變化
- #183★ 1,774+0近 7 天星數變化
- #184
快速且高效的非結構化資料萃取。以 Rust 編寫,並提供多種語言的綁定。
★ 1,772+0近 7 天星數變化 - #185
自然語言處理、知識圖譜、對話系統、大模型等技術研究與應用。
★ 1,766+0近 7 天星數變化 - #186★ 1,763+0近 7 天星數變化
- #187
透過架構變更與擴展將 BERT 帶入現代化
★ 1,716+0近 7 天星數變化 - #188
我們在學習過程中收集的人工智慧、機器學習與深度學習精選內容。包含學習筆記以及此類主題的優質資源列表。
★ 1,713+0近 7 天星數變化 - #189
📚 數千篇 AI、LLM、NLP、CV 頂會論文解讀,每篇 5 分鐘讀懂核心思想。
★ 1,709+0近 7 天星數變化 - #190
Graph4nlp 是一個能輕鬆將圖神經網路(GNN)應用於 NLP 的函式庫。歡迎造訪我們的 DLG4NLP 網站 (https://dlg4nlp.github.io/index.html) 獲取各種學習資源!
★ 1,690+0近 7 天星數變化 - #191★ 1,680+0近 7 天星數變化
- #192★ 1,672+0近 7 天星數變化
- #193
Tika-Python 是 Apache Tika™ REST 服務的 Python 綁定,允許在 Python 社群中原生呼叫 Tika。
★ 1,667+0近 7 天星數變化 - #194
預訓練中文 XLNet 模型
★ 1,646+0近 7 天星數變化 - #195★ 1,637+0近 7 天星數變化
- #196
基於 PyTorch 構建的無程式碼框架,用於可重複的深度學習研究。PyTorch 生態系統。🏆 至今已實作 26 種發表於 TPAMI、CVPR、IClR、ECCV、NeurIPS、ICCV、AAAI 等會議的知識蒸餾方法。🎁 提供已訓練模型、訓練日誌與設定檔,以確保可重複性與基準測試。
★ 1,630+0近 7 天星數變化 - #197★ 1,615+0近 7 天星數變化
- #198★ 1,602+0近 7 天星數變化
- #199
ExtractThinker 是一個針對 LLM 的文件智慧函式庫,提供 ORM 風格的互動以實現靈活且強大的文件工作流程。
★ 1,596+0近 7 天星數變化 - #200★ 1,592+0近 7 天星數變化
- #201
similarity:Java 撰寫的文字相似度計算工具包,可用於文字相似度計算、情感分析等任務,開箱即用。
★ 1,584+0近 7 天星數變化 - #202
這是一本持續更新的手冊,供讀者輕鬆追蹤文獻中的最新 Text-to-SQL 技術,並為研究人員與實務工作者提供實用指南。
★ 1,580+0近 7 天星數變化 - #203
你的資料裡有什麼?從資料集中萃取 Schema、統計數據與實體
★ 1,579+0近 7 天星數變化 - #204
關於文字對抗攻擊與防禦的必讀論文
★ 1,575+0近 7 天星數變化 - #205
命名實體識別 (NER) 與實體識別任務的語料庫集合。這些標註資料集涵蓋多種語言、領域和實體類型。
★ 1,574+0近 7 天星數變化 - #206
機器人流程自動化(RPA)的開源函式庫與工具集合,設計用於 Robot Framework 與 Python
★ 1,555+0近 7 天星數變化 - #207★ 1,553+0近 7 天星數變化
- #208
用於 CPU 與 GPU 上 transformer 推論(Bert、Albert、GPT2、Decoders 等)的快速且使用者友善的執行環境。
★ 1,550+0近 7 天星數變化 - #209★ 1,538+0近 7 天星數變化
- #210★ 1,507+0近 7 天星數變化