nlp
Repositórios de código aberto acompanhados marcados com nlp, ordenados por estrelas.
- #331
💥 Use os modelos de pesquisa mais recentes do Stanza (StanfordNLP) diretamente no spaCy
★ 746+0Variação de estrelas nos últimos 7 dias - #332★ 745+0Variação de estrelas nos últimos 7 dias
- #333
O corpus de poesia moderna chinesa mais completo do planeta, com mais de 3 mil poetas, mais de 80 mil poemas e mais de 15 milhões de caracteres.
★ 742+3Variação de estrelas nos últimos 7 dias - #334
O repositório principal para pesquisa e desenvolvimento de QA (Question Answering) multilíngue de última geração.
★ 738-1Variação de estrelas nos últimos 7 dias - #335
:clipboard: Um parser em Python para o subconjunto XML de acesso aberto do PubMed e o conjunto de dados XML do MEDLINE
★ 738+0Variação de estrelas nos últimos 7 dias - #336
Uma lista de recursos, métodos e ferramentas selecionados dedicados à Análise de Textos Jurídicos.
★ 735+1Variação de estrelas nos últimos 7 dias - #337
Estenda LLMs existentes muito além do comprimento de treinamento original com uso constante de memória, sem retreinamento
★ 734-1Variação de estrelas nos últimos 7 dias - #338
Família PromptKG: uma galeria de pesquisas, kits de ferramentas e listas de artigos relacionados a Prompt Learning e KG.
★ 734+1Variação de estrelas nos últimos 7 dias - #339★ 729+0Variação de estrelas nos últimos 7 dias
- #340★ 726+0Variação de estrelas nos últimos 7 dias
- #341
Implementação simples do modelo OpenAI CLIP em PyTorch.
★ 726+0Variação de estrelas nos últimos 7 dias - #342
Revisitando Modelos Pré-treinados para Processamento de Linguagem Natural em Chinês (MacBERT)
★ 721+1Variação de estrelas nos últimos 7 dias - #343
Sistema de método de entrada em japonês para Linux, macOS, mecanismo de conversão neural Kana-Kanji.
★ 720+4Variação de estrelas nos últimos 7 dias - #344
Mecanismo de busca fundamentado (ou seja, com referência de fonte) baseado em LLM / ChatGPT / OpenAI API. Suporta busca na web, busca de conteúdo de arquivos, etc.
★ 711+0Variação de estrelas nos últimos 7 dias - #345
VectorFlow é um pipeline de incorporação de vetores de alto volume que ingere dados brutos, os transforma em vetores e os grava em um banco de dados vetorial de sua escolha.
★ 703+0Variação de estrelas nos últimos 7 dias - #346
Chatbot baseado em compreensão de linguagem natural e aprendizado de máquina, com suporte a usuários simultâneos e diálogos personalizados de múltiplas rodadas
★ 702+0Variação de estrelas nos últimos 7 dias - #347
Um Roadmap de ML (Machine Learning) Full Stack envolve o aprendizado das habilidades e tecnologias necessárias para se tornar proficiente em todos os aspectos de machine learning, incluindo coleta e pré-processamento de dados, desenvolvimento de modelos, implantação e manutenção.
★ 701+0Variação de estrelas nos últimos 7 dias - #348
:black_circle: Um pipeline e modelo do spaCy para PNL em texto jurídico não estruturado.
★ 696+0Variação de estrelas nos últimos 7 dias - #349★ 691+0Variação de estrelas nos últimos 7 dias
- #350
Crie aplicações Dart/Flutter impulsionadas por LLM.
★ 686+0Variação de estrelas nos últimos 7 dias - #351
🔥 Rankify: Um kit de ferramentas abrangente em Python para Recuperação, Reclassificação e Geração Aumentada por Recuperação (RAG) 🔥. Nosso kit de ferramentas integra 40 conjuntos de dados de referência pré-recuperados e suporta mais de 7 técnicas de recuperação, mais de 24 modelos de reclassificação de última geração e vários métodos de RAG.
★ 682+1Variação de estrelas nos últimos 7 dias - #352
Stanford Open Information Extraction simplificado!
★ 682+0Variação de estrelas nos últimos 7 dias - #353★ 675+1Variação de estrelas nos últimos 7 dias
- #354
O Ekphrasis é uma ferramenta de processamento de texto voltada para textos de redes sociais, como Twitter ou Facebook. O Ekphrasis realiza tokenização, normalização de palavras, segmentação de palavras (para divisão de hashtags) e correção ortográfica, utilizando estatísticas de palavras de dois grandes corpora (Wikipedia em inglês, Twitter - 330 milhões de tweets em inglês).
★ 673+0Variação de estrelas nos últimos 7 dias - #355
Modelos para SpaCy que suportam chinês
★ 673+0Variação de estrelas nos últimos 7 dias - #356
Uma biblioteca Python rápida, leve e fácil de usar para dividir texto em pedaços semanticamente significativos.
★ 665+1Variação de estrelas nos últimos 7 dias - #357
Encontre datas dentro de texto usando Python e retorne objetos datetime
★ 665+0Variação de estrelas nos últimos 7 dias - #358★ 664+1Variação de estrelas nos últimos 7 dias
- #359
Um kit de ferramentas multilíngue em Python para Análise de Sentimento e tarefas de PNL Social
★ 660+0Variação de estrelas nos últimos 7 dias - #360
Formate rapidamente suas notas com o ChatGPT no Obsidian
★ 658-2Variação de estrelas nos últimos 7 dias