nlp
标记 nlp 主题、收录中的开源项目,按星标数排序。
- #331
💥 直接在 spaCy 中使用最新的 Stanza (StanfordNLP) 研究模型
★ 746+0近 7 天星标变化 - #332★ 745+0近 7 天星标变化
- #333★ 743+3近 7 天星标变化
- #334★ 738-1近 7 天星标变化
- #335
:clipboard: 用于 PubMed 开放获取 XML 子集与 MEDLINE XML 数据集的 Python 解析器
★ 738+0近 7 天星标变化 - #336
在常数内存用量下,将现有 LLM 的长度大幅扩展至原始训练长度之外,且无需重新训练
★ 734-1近 7 天星标变化 - #337
专门用于法律文本分析的精选资源、方法与工具列表。
★ 734+1近 7 天星标变化 - #338★ 734+1近 7 天星标变化
- #339★ 729+0近 7 天星标变化
- #340★ 726+0近 7 天星标变化
- #341
在 PyTorch 中简单实现 OpenAI CLIP 模型
★ 726+0近 7 天星标变化 - #342★ 721+1近 7 天星标变化
- #343★ 721+4近 7 天星标变化
- #344★ 711+0近 7 天星标变化
- #345
VectorFlow 是一个高吞吐量的向量嵌入管道,能获取原始数据、将其转换为向量,并写入您选择的向量数据库中。
★ 703+0近 7 天星标变化 - #346★ 702+0近 7 天星标变化
- #347
全端机器学习(ML)路线图涵盖成为机器学习各方面专家所需的技能与技术,包含数据收集与预处理、模型开发、部署与维护。
★ 700-1近 7 天星标变化 - #348
用于非结构化法律文本 NLP 的 spaCy 管道与模型。
★ 696+0近 7 天星标变化 - #349★ 691+0近 7 天星标变化
- #350
构建由 LLM 驱动的 Dart/Flutter 应用程序。
★ 686+0近 7 天星标变化 - #351
🔥 Rankify:用于检索、重新排序与检索增强生成(RAG)的全方位 Python 工具包 🔥。本工具包整合了 40 个预先检索的基准数据集,并支持 7 种以上检索技术、24 种以上最先进的 Reranking 模型以及多种 RAG 方法。
★ 683+2近 7 天星标变化 - #352
让 Stanford Open Information Extraction 变得简单!
★ 682+0近 7 天星标变化 - #353★ 676+2近 7 天星标变化
- #354
Ekphrasis 是一个文本处理工具,专为来自 Twitter 或 Facebook 等社交网络的文本而设计。Ekphrasis 使用来自两个大型语料库(英文维基百科、Twitter - 3.3亿条英文推文)的单词统计数据,执行标记化、单词规范化、单词分割(用于分割 hashtag)和拼写校正。
★ 673+0近 7 天星标变化 - #355
SpaCy 中文模型
★ 673+0近 7 天星标变化 - #356★ 666+2近 7 天星标变化
- #357★ 665+2近 7 天星标变化
- #358
使用 Python 在文本中寻找日期并返回 datetime 对象
★ 665+0近 7 天星标变化 - #359
用于情感分析与社群 NLP 任务的 Python 多语言工具包
★ 659-1近 7 天星标变化 - #360
在 Obsidian 中使用 ChatGPT 快速格式化你的笔记
★ 658-2近 7 天星标变化