nlp
Repositórios de código aberto acompanhados marcados com nlp, ordenados por estrelas.
- #181
A biblioteca de detecção de linguagem natural mais precisa para Python, adequada para textos curtos e textos em idiomas mistos.
★ 1.788+0Variação de estrelas nos últimos 7 dias - #182★ 1.778+0Variação de estrelas nos últimos 7 dias
- #183★ 1.774+0Variação de estrelas nos últimos 7 dias
- #184
Extração de dados não estruturados rápida e eficiente. Escrito em Rust com bindings para várias linguagens.
★ 1.772+0Variação de estrelas nos últimos 7 dias - #185
Pesquisa e aplicação de tecnologias como processamento de linguagem natural, grafos de conhecimento, sistemas de diálogo e grandes modelos de linguagem.
★ 1.766+0Variação de estrelas nos últimos 7 dias - #186★ 1.763+0Variação de estrelas nos últimos 7 dias
- #187
Trazendo o BERT para a modernidade através de mudanças de arquitetura e escalonamento.
★ 1.716+0Variação de estrelas nos últimos 7 dias - #188
Uma curadoria de recursos sobre Inteligência Artificial, Machine Learning e Deep Learning, incluindo notas de estudo e uma lista selecionada de materiais sobre esses temas.
★ 1.713+0Variação de estrelas nos últimos 7 dias - #189
Milhares de interpretações de artigos de conferências de topo em IA, LLM, NLP e CV, com explicações das ideias centrais em 5 minutos.
★ 1.709+0Variação de estrelas nos últimos 7 dias - #190
Graph4nlp é a biblioteca para o uso facilitado de Graph Neural Networks em NLP. Visite nosso site DLG4NLP (https://dlg4nlp.github.io/index.html) para diversos recursos de aprendizado!
★ 1.690+0Variação de estrelas nos últimos 7 dias - #191★ 1.680+0Variação de estrelas nos últimos 7 dias
- #192★ 1.672+0Variação de estrelas nos últimos 7 dias
- #193
Tika-Python é um binding Python para os serviços REST do Apache Tika™, permitindo que o Tika seja chamado nativamente na comunidade Python.
★ 1.667+0Variação de estrelas nos últimos 7 dias - #194
Modelo pré-treinado XLNet para chinês.
★ 1.646+0Variação de estrelas nos últimos 7 dias - #195
Uma biblioteca Python para analisar strings de endereços não estruturados dos Estados Unidos em componentes de endereço.
★ 1.637+0Variação de estrelas nos últimos 7 dias - #196
Um framework sem código construído sobre PyTorch para estudos de deep learning reprodutíveis. Ecossistema PyTorch. Até o momento, 26 métodos de destilação de conhecimento apresentados em conferências como TPAMI, CVPR, ICLR, ECCV, NeurIPS, ICCV e AAAI foram implementados. Modelos treinados, logs de treinamento e configurações estão disponíveis para garantir a reprodutibilidade e o benchmark.
★ 1.630+0Variação de estrelas nos últimos 7 dias - #197
WikiChat é um RAG aprimorado. Ele interrompe a alucinação de grandes modelos de linguagem recuperando dados de um corpus.
★ 1.615+0Variação de estrelas nos últimos 7 dias - #198★ 1.602+0Variação de estrelas nos últimos 7 dias
- #199
ExtractThinker é uma biblioteca de inteligência de documentos para LLMs, oferecendo interação estilo ORM para fluxos de trabalho de documentos flexíveis e poderosos.
★ 1.596+0Variação de estrelas nos últimos 7 dias - #200
Repositório de código para "WebArena: A Realistic Web Environment for Building Autonomous Agents"
★ 1.592+0Variação de estrelas nos últimos 7 dias - #201
similarity: Kit de ferramentas de cálculo de similaridade de texto para Java. Escrito em Java, pode ser usado para cálculo de similaridade de texto, análise de sentimentos e outras tarefas, pronto para uso.
★ 1.584+0Variação de estrelas nos últimos 7 dias - #202
Este é um manual atualizado continuamente para que os leitores acompanhem facilmente as técnicas mais recentes de Text-to-SQL na literatura e forneçam orientação prática para pesquisadores e profissionais.
★ 1.580+0Variação de estrelas nos últimos 7 dias - #203
O que há nos seus dados? Extraia esquema, estatísticas e entidades de conjuntos de dados
★ 1.579+0Variação de estrelas nos últimos 7 dias - #204
Artigos essenciais sobre ataques e defesas adversariais em texto
★ 1.575+0Variação de estrelas nos últimos 7 dias - #205
Uma coleção de corpora para reconhecimento de entidades nomeadas (NER) e tarefas de reconhecimento de entidades. Esses conjuntos de dados anotados cobrem uma variedade de idiomas, domínios e tipos de entidades.
★ 1.574+0Variação de estrelas nos últimos 7 dias - #206
Coleção de bibliotecas e ferramentas de código aberto para Automação de Processos Robóticos (RPA), projetadas para uso com Robot Framework e Python
★ 1.555+0Variação de estrelas nos últimos 7 dias - #207
Modelo de deep learning de última geração para análise de sentimento, emoção, sarcasmo, etc.
★ 1.553+0Variação de estrelas nos últimos 7 dias - #208
Um runtime rápido e amigável para inferência de transformers (Bert, Albert, GPT2, Decoders, etc) em CPU e GPU.
★ 1.550+0Variação de estrelas nos últimos 7 dias - #209★ 1.538+0Variação de estrelas nos últimos 7 dias
- #210
Este projeto é um pacote básico que encapsula ferramentas comumente usadas na maioria dos projetos de NLP
★ 1.507+0Variação de estrelas nos últimos 7 dias