跳到主要内容
buildradar
登录
主题 · nlp

nlp

标记 nlp 主题、收录中的开源项目,按星标数排序。

共 440 个项目
  • donut@clovaai

    官方实现 OCR-free Document Understanding Transformer(Donut)与 Synthetic Document Generator(SynthDoG),ECCV 2022。

    6,917+0近 7 天星标变化
  • trafilatura@adbar

    Python 与命令行工具,用于在网络上收集文本和元数据:爬取、抓取、抽取,输出为 CSV、JSON、HTML、MD、TXT、XML

    6,754+0近 7 天星标变化
  • nlp.js@axa-group

    用于构建机器人之自然语言处理库,具备实体抽取、情感分析、自动语言识别等功能

    6,588+0近 7 天星标变化
  • courses@SkalskiP

    此仓库是关于人工智慧(AI)的各种课程与资源的精选链接集合

    6,482+0近 7 天星标变化
  • argos-translate@argosopentech

    用 Python 编写的开源离线翻译库

    6,425+0近 7 天星标变化
  • smile@haifengl

    统计机器智能与学习引擎

    6,416+0近 7 天星标变化
  • TagUI@aisingapore

    AI Singapore 提供的免费 RPA 工具

    6,327+0近 7 天星标变化
  • tensorflow_cookbook@nfmcclure

    Tensorflow 机器学习 Cookbook 的代码

    6,238+0近 7 天星标变化
  • Parsr@axa-group

    将PDF、文件和图像转换为增强结构化数据

    6,176+0近 7 天星标变化
  • 👮‍♂️ Java 敏感词工具(敏感词/违禁词/违法词/脏词)。基于 DFA 算法的高性能 Java 敏感词过滤框架,内置单词标签分类分级。请勿发布涉及政治、广告、营销、翻墙、违反国家法律法规等内容。高性能敏感词检测过滤组件,附带繁体简体互换、全角半角互换、汉字转拼音、模糊搜索等功能。

    6,036+0近 7 天星标变化
  • Chinese-CLIP@OFA-Sys

    中文版本的 CLIP,实现中文跨模态检索与表征生成。

    6,001+0近 7 天星标变化
  • flashtext@vi3k6i5

    从句子中提取关键词或替换句子中的关键词

    5,709+0近 7 天星标变化
  • Awesome Pretrained Chinese NLP Models,高质量中文预训练模型、大模型、多模态模型与大语言模型集合。

    5,584+0近 7 天星标变化
  • ltp@HIT-SCIR

    语言技术平台。

    5,259+0近 7 天星标变化
  • openmed@maziyarpanahi

    本地优先医疗 AI:临床 NER 与 HIPAA PII 去识别化,100% 端上执行,2,200+ 医疗模型,21 种语言,Apple MLX + Python,无云端,无病患资料离开网络。Apache-2.0

    5,199+0近 7 天星标变化
  • im-not-ai@epoko77-ai

    AI 撰写的韩文被 Claude 重新写成像人类文字的技能 — Korean AI-text humanizer:检测并重写翻译痕迹、机械式平行、以及 71 种其他 AI 特色

    5,178+0近 7 天星标变化
  • EasyR1@hiyouga

    EasyR1:一个基于 veRL 的高效、可扩展、多模态 RL 训练框架。

    5,141+0近 7 天星标变化
  • Synonyms@chatopera

    :herb: 中文近义词:聊天机器人,智能问答工具包

    5,111+0近 7 天星标变化
  • argilla@argilla-io

    Argilla 是一个协作工具,供 AI 工程师与领域专家构建高质量数据集

    5,093+0近 7 天星标变化
  • BenCao(原名:HuaTuo)模型仓库,基于中文医学知识的大语言模型指令微调

    4,989+0近 7 天星标变化
  • text2vec@shibing624

    text2vec,文本转向量。文本向量表征工具,把文本转化为向量矩阵,实现了 Word2Vec、RankBM25、Sentence-BERT、CoSENT 等文本表征、文本相似度计算模型,开箱即用

    4,974+0近 7 天星标变化
  • ml-road@yanshengjia

    机器学习与代理式 AI 资源、实践与研究

    4,927+0近 7 天星标变化
  • OpenPrompt@thunlp

    一个开源 Prompt‑Learning 框架

    4,889+0近 7 天星标变化
  • libpostal@openvenues

    一个用于解析/标准化全球街道地址的 C 库,采用统计 NLP 与开放地理数据

    4,880+0近 7 天星标变化
  • Learn_Prompting@trigaten

    Prompt Engineering、生成式 AI 与 LLM 指南,由 Learn Prompting 提供 | 加入我们的 Discord,加入最大的 Prompt Engineering 学习社区

    4,728+0近 7 天星标变化
  • nlpaug@makcedward

    用于 NLP 的数据增强

    4,665+0近 7 天星标变化
  • Promptify@promptslab

    Prompt Engineering | Prompt Versioning | 使用 GPT 或其他基于 Prompt 的模型获取结构化输出。加入我们的 Discord,了解 Prompt-Engineering、LLM 及其他最新研究

    4,637+0近 7 天星标变化
  • pytorch-sentiment-analysis@bentrevett

    使用 PyTorch 与 TorchText 进行情感分析的入门教程

    4,612+0近 7 天星标变化
  • LLMBook-zh.github.io@LLMBook-zh

    《大语言模型》作者:赵鑫,李军毅,周昆,唐天一,文继荣

    4,557+0近 7 天星标变化
  • 精选大型语言模型、AI 绘画等教程与资源。

    4,537+0近 7 天星标变化
← 返回主题列表