nlp
Repositórios de código aberto acompanhados marcados com nlp, ordenados por estrelas.
- #151
Notas detalhadas do livro Introdução ao Processamento de Linguagem Natural, do autor do HanLP. Uma obra de referência que explica modelos de algoritmos de forma acessível, abordando segmentação de texto, etiquetagem gramatical, reconhecimento de entidades nomeadas, extração de informações, agrupamento e classificação de textos, e análise sintática.
★ 2.270+0Variação de estrelas nos últimos 7 dias - #152
Reconhecimento de Entidades Nomeadas em chinês com IDCNN/biLSTM+CRF e Extração de Relações com biGRU+2ATT
★ 2.264+0Variação de estrelas nos últimos 7 dias - #153★ 2.259+0Variação de estrelas nos últimos 7 dias
- #154★ 2.257+0Variação de estrelas nos últimos 7 dias
- #155
[Lista de Artigos] Artigos que integram grafos de conhecimento (KGs) e grandes modelos de linguagem (LLMs)
★ 2.228+0Variação de estrelas nos últimos 7 dias - #156
Implementação em Python de algoritmos TextRank ("textgraphs") para extração de frases
★ 2.219+0Variação de estrelas nos últimos 7 dias - #157★ 2.196+0Variação de estrelas nos últimos 7 dias
- #158★ 2.189+0Variação de estrelas nos últimos 7 dias
- #159★ 2.186+0Variação de estrelas nos últimos 7 dias
- #160
Explique, analise e visualize modelos de linguagem de PNL. O Ecco cria visualizações interativas diretamente em notebooks Jupyter, explicando o comportamento de modelos de linguagem baseados em Transformer (como GPT2, BERT, RoBERTA, T5 e T0).
★ 2.103+0Variação de estrelas nos últimos 7 dias - #161
Um kit de ferramentas local para extração de dados não estruturados sem OCR, conversão para markdown e benchmarking. (https://idp-leaderboard.org/)
★ 2.086+0Variação de estrelas nos últimos 7 dias - #162
Uma lista de leitura sobre segurança, proteção e privacidade de grandes modelos (incluindo Awesome LLM Security, Safety, etc.).
★ 2.070+0Variação de estrelas nos últimos 7 dias - #163
Coleção de codificadores-decodificadores do laboratório MinD (Machine IntelligeNce of Damo) da Alibaba.
★ 2.041+0Variação de estrelas nos últimos 7 dias - #164
Uma referência abrangente para todos os tópicos relacionados ao Processamento de Linguagem Natural
★ 2.038+0Variação de estrelas nos últimos 7 dias - #165
Um avaliador automático para modelos de linguagem de seguimento de instruções. Validado por humanos, de alta qualidade, barato e rápido.
★ 2.012+0Variação de estrelas nos últimos 7 dias - #166
ContextGem: Extração descomplicada de LLM a partir de documentos.
★ 1.996+0Variação de estrelas nos últimos 7 dias - #167
Uma coleção de frameworks, projetos e recursos de RAG (Retrieval-Augmented Generation) impulsionada pela comunidade. Contribua e explore o ecossistema RAG em constante evolução.
★ 1.991+0Variação de estrelas nos últimos 7 dias - #168★ 1.987+0Variação de estrelas nos últimos 7 dias
- #169
Projeto de LLMs Llama-3 em chinês (Chinese Llama-3 LLMs) desenvolvido a partir do Llama 3 da Meta
★ 1.980+0Variação de estrelas nos últimos 7 dias - #170
🌸 Aprenda gramática japonesa com TypeScript
★ 1.945+0Variação de estrelas nos últimos 7 dias - #171
Modelos para a biblioteca de Processamento de Linguagem Natural (NLP) spaCy
★ 1.901+0Variação de estrelas nos últimos 7 dias - #172
Tutorial de introdução rápida à biblioteca Transformers
★ 1.892+0Variação de estrelas nos últimos 7 dias - #173
Uma lista curada de materiais de aprendizado, bancos de dados, ferramentas e outros recursos relacionados a Grafos de Conhecimento
★ 1.885+0Variação de estrelas nos últimos 7 dias - #174
[ICML 2024] LLMCompiler: Um compilador de LLM para chamada paralela de funções
★ 1.879+0Variação de estrelas nos últimos 7 dias - #175
Pacote de aumento de dados em chinês com um clique; aumento de dados para NLP, BERT, EDA: pip install nlpcda
★ 1.879+0Variação de estrelas nos últimos 7 dias - #176
Biblioteca independente de Machine Learning e Processamento de Linguagem Natural em Go
★ 1.850+0Variação de estrelas nos últimos 7 dias - #177★ 1.828+0Variação de estrelas nos últimos 7 dias
- #178
Classificação de texto longo, frases curtas, multirrótulo e similaridade entre duas frases em chinês (Keras NLP), classes base para construção de camadas de embedding de palavras/caracteres e camadas de rede (grafo), FastText, TextCNN, CharCNN, TextRNN, RCNN, DCNN, DPCNN, VDCNN, CRNN, Bert, Xlnet, Albert, Attention, DeepMoji, HAN, CapsuleNet, Transformer-encode, Seq2seq, SWEM, LEAM, TextGCN
★ 1.808+0Variação de estrelas nos últimos 7 dias - #179
Underthesea - Assistente de IA
★ 1.803+0Variação de estrelas nos últimos 7 dias - #180
O Microsoft.Recognizers.Text fornece reconhecimento e resolução de números, unidades, data/hora, etc., em vários idiomas (ZH, EN, FR, ES, PT, DE, IT, TR, HI, NL. Suporte parcial para JA, KO, AR, SV). Pacotes disponíveis em: https://www.nuget.org/profiles/Recognizers.Text, https://www.npmjs.com/~recognizers.text
★ 1.794+0Variação de estrelas nos últimos 7 dias