Pular para o conteúdo principal
buildradar
Entrar
Tópico · nlp

nlp

Repositórios de código aberto acompanhados marcados com nlp, ordenados por estrelas.

440 repositórios
  • spacy-stanza@explosion

    💥 Use os modelos de pesquisa mais recentes do Stanza (StanfordNLP) diretamente no spaCy

    746+0Variação de estrelas nos últimos 7 dias
  • Octopii@redhuntlabs

    Um scanner de Informações de Identificação Pessoal (PII) alimentado por IA.

    745+0Variação de estrelas nos últimos 7 dias
  • poetry@sheepzh

    O corpus de poesia moderna chinesa mais completo do planeta, com mais de 3 mil poetas, mais de 80 mil poemas e mais de 15 milhões de caracteres.

    742+3Variação de estrelas nos últimos 7 dias
  • primeqa@primeqa

    O repositório principal para pesquisa e desenvolvimento de QA (Question Answering) multilíngue de última geração.

    738-1Variação de estrelas nos últimos 7 dias
  • pubmed_parser@titipata

    :clipboard: Um parser em Python para o subconjunto XML de acesso aberto do PubMed e o conjunto de dados XML do MEDLINE

    738+0Variação de estrelas nos últimos 7 dias
  • Legal-Text-Analytics@Liquid-Legal-Institute

    Uma lista de recursos, métodos e ferramentas selecionados dedicados à Análise de Textos Jurídicos.

    735+1Variação de estrelas nos últimos 7 dias
  • attention_sinks@tomaarsen

    Estenda LLMs existentes muito além do comprimento de treinamento original com uso constante de memória, sem retreinamento

    734-1Variação de estrelas nos últimos 7 dias
  • PromptKG@zjunlp

    Família PromptKG: uma galeria de pesquisas, kits de ferramentas e listas de artigos relacionados a Prompt Learning e KG.

    734+1Variação de estrelas nos últimos 7 dias
  • 729+0Variação de estrelas nos últimos 7 dias
  • xgen@salesforce

    LLMs de código aberto da Salesforce com comprimento de sequência de 8k.

    726+0Variação de estrelas nos últimos 7 dias
  • OpenAI-CLIP@moein-shariatnia

    Implementação simples do modelo OpenAI CLIP em PyTorch.

    726+0Variação de estrelas nos últimos 7 dias
  • Revisitando Modelos Pré-treinados para Processamento de Linguagem Natural em Chinês (MacBERT)

    721+1Variação de estrelas nos últimos 7 dias
  • karukan@togatoga

    Sistema de método de entrada em japonês para Linux, macOS, mecanismo de conversão neural Kana-Kanji.

    720+4Variação de estrelas nos últimos 7 dias
  • searchGPT@michaelthwan

    Mecanismo de busca fundamentado (ou seja, com referência de fonte) baseado em LLM / ChatGPT / OpenAI API. Suporta busca na web, busca de conteúdo de arquivos, etc.

    711+0Variação de estrelas nos últimos 7 dias
  • vectorflow@dgarnitz

    VectorFlow é um pipeline de incorporação de vetores de alto volume que ingere dados brutos, os transforma em vetores e os grava em um banco de dados vetorial de sua escolha.

    703+0Variação de estrelas nos últimos 7 dias
  • chat@Decalogue

    Chatbot baseado em compreensão de linguagem natural e aprendizado de máquina, com suporte a usuários simultâneos e diálogos personalizados de múltiplas rodadas

    702+0Variação de estrelas nos últimos 7 dias
  • Um Roadmap de ML (Machine Learning) Full Stack envolve o aprendizado das habilidades e tecnologias necessárias para se tornar proficiente em todos os aspectos de machine learning, incluindo coleta e pré-processamento de dados, desenvolvimento de modelos, implantação e manutenção.

    701+0Variação de estrelas nos últimos 7 dias
  • Blackstone@ICLRandD

    :black_circle: Um pipeline e modelo do spaCy para PNL em texto jurídico não estruturado.

    696+0Variação de estrelas nos últimos 7 dias
  • WeCron@polyrabbit

    :heavy_check_mark: Lembretes agendados no WeChat - Cron no WeChat

    691+0Variação de estrelas nos últimos 7 dias
  • langchain_dart@davidmigloz

    Crie aplicações Dart/Flutter impulsionadas por LLM.

    686+0Variação de estrelas nos últimos 7 dias
  • Rankify@DataScienceUIBK

    🔥 Rankify: Um kit de ferramentas abrangente em Python para Recuperação, Reclassificação e Geração Aumentada por Recuperação (RAG) 🔥. Nosso kit de ferramentas integra 40 conjuntos de dados de referência pré-recuperados e suporta mais de 7 técnicas de recuperação, mais de 24 modelos de reclassificação de última geração e vários métodos de RAG.

    682+1Variação de estrelas nos últimos 7 dias
  • stanford-openie-python@philipperemy

    Stanford Open Information Extraction simplificado!

    682+0Variação de estrelas nos últimos 7 dias
  • medspacy@medspacy

    Biblioteca para PLN clínico com spaCy.

    675+1Variação de estrelas nos últimos 7 dias
  • ekphrasis@cbaziotis

    O Ekphrasis é uma ferramenta de processamento de texto voltada para textos de redes sociais, como Twitter ou Facebook. O Ekphrasis realiza tokenização, normalização de palavras, segmentação de palavras (para divisão de hashtags) e correção ortográfica, utilizando estatísticas de palavras de dois grandes corpora (Wikipedia em inglês, Twitter - 330 milhões de tweets em inglês).

    673+0Variação de estrelas nos últimos 7 dias
  • Chinese_models_for_SpaCy@howl-anderson

    Modelos para SpaCy que suportam chinês

    673+0Variação de estrelas nos últimos 7 dias
  • semchunk@isaacus-dev

    Uma biblioteca Python rápida, leve e fácil de usar para dividir texto em pedaços semanticamente significativos.

    665+1Variação de estrelas nos últimos 7 dias
  • datefinder@akoumjian

    Encontre datas dentro de texto usando Python e retorne objetos datetime

    665+0Variação de estrelas nos últimos 7 dias
  • JamSpell@bakwc

    Biblioteca moderna de verificação ortográfica - precisa, rápida e multilíngue

    664+1Variação de estrelas nos últimos 7 dias
  • pysentimiento@pysentimiento

    Um kit de ferramentas multilíngue em Python para Análise de Sentimento e tarefas de PNL Social

    660+0Variação de estrelas nos últimos 7 dias
  • obsidian-ava@different-ai

    Formate rapidamente suas notas com o ChatGPT no Obsidian

    658-2Variação de estrelas nos últimos 7 dias
← Voltar para os tópicos