nlp
Repositórios de código aberto acompanhados marcados com nlp, ordenados por estrelas.
- #301
[ICLR 2025] Síntese de dados de alinhamento do zero, solicitando LLMs alinhados com nada. Seu pipeline de geração de dados sintéticos eficiente e de alta qualidade!
★ 882+3Variação de estrelas nos últimos 7 dias - #302
Associações (bindings) em Python para o libpostal para análise e normalização rápida de endereços internacionais
★ 880+0Variação de estrelas nos últimos 7 dias - #303
Toolkit para fine-tuning, ablação e testes unitários de LLMs de código aberto.
★ 871+0Variação de estrelas nos últimos 7 dias - #304
Uma interface C++ leve baseada em Eigen para Solvers de Programação Não Linear (Ipopt, Snopt).
★ 866+0Variação de estrelas nos últimos 7 dias - #305
Componentes e visualizadores spaCy para aplicações Streamlit
★ 863+3Variação de estrelas nos últimos 7 dias - #306
Repositório do GitHub com tutoriais para ajuste fino de transformers para diversas tarefas de PLN
★ 862+0Variação de estrelas nos últimos 7 dias - #307
Catalyst é uma biblioteca de Processamento de Linguagem Natural em C# focada em velocidade. Inspirada no design do spaCy, oferece modelos pré-treinados, suporte nativo para treinamento de embeddings de palavras e documentos, e modelos flexíveis de reconhecimento de entidades.
★ 860+1Variação de estrelas nos últimos 7 dias - #308
Uma biblioteca de detecção de idiomas para PHP. Detecta o idioma a partir de uma dada string de texto.
★ 858+1Variação de estrelas nos últimos 7 dias - #309
🔥 Machine Learning / Deep Learning / Python / Grandes Modelos / Multimodal / LLM / Entrevistas de Algoritmos / Tutorial de NLP
★ 857+0Variação de estrelas nos últimos 7 dias - #310
Use modelos multimodais de interação tardia, como o ColPali, em apenas algumas linhas de código.
★ 851-1Variação de estrelas nos últimos 7 dias - #311
Apresentamos um novo modelo projetado para a tarefa de geração de código. Sua precisão de teste no conjunto de dados base HumanEval supera a do GPT-4 Turbo (abril de 2024) e do GPT-4o.
★ 850+0Variação de estrelas nos últimos 7 dias - #312
🌟 Uma coleção selecionada de ferramentas de IA 🤖, APIs 🔗, conjuntos de dados 📊 e recursos de aprendizagem 📚 gratuitos e de alta qualidade abrangendo machine learning 🧠, deep learning 🧩, IA generativa 🎨, NLP 💬 e ciência de dados 📈. Projetado para ajudar desenvolvedores 👩💻, pesquisadores 🔬 e criadores ✨ a explorar e construir com IA mais rapidamente ⚡.
★ 841+12Variação de estrelas nos últimos 7 dias - #313
Toolkit de processamento de linguagem natural para línguas índicas, visando fornecer suporte imediato para diversas tarefas de PLN que um desenvolvedor de aplicações possa precisar
★ 838+1Variação de estrelas nos últimos 7 dias - #314
DeepResearch Bench: Um benchmark abrangente para agentes de pesquisa profunda
★ 827+5Variação de estrelas nos últimos 7 dias - #315
A versão online está temporariamente indisponível porque não podemos pagar pela chave. Você pode clonar e executá-la localmente. Nota: definimos uma chave padrão da OpenAI. Se as chaves excederem o plano e forem inválidas, por favor nos avise. A velocidade de resposta depende da OpenAI (às vezes, o serviço oficial está muito congestionado e lento).
★ 826+0Variação de estrelas nos últimos 7 dias - #316
A biblioteca de detecção de linguagem natural mais precisa para Java e a JVM, adequada tanto para textos longos quanto curtos
★ 822+3Variação de estrelas nos últimos 7 dias - #317
Chatbot de IA 🤖 para conversar com arquivos CSV, PDF, TXT 📄 e vídeos do YTB 🎥 | usando Langchain🦜 | OpenAI | Streamlit ⚡
★ 812+0Variação de estrelas nos últimos 7 dias - #318★ 808+0Variação de estrelas nos últimos 7 dias
- #319
OCTIS: Comparar modelos de tópicos é simples! Um pacote Python para otimizar e avaliar modelos de tópicos (aceito na trilha de demonstração do EACL2021)
★ 804+0Variação de estrelas nos últimos 7 dias - #320
Conecte-se e converse com seus múltiplos documentos (pdf e txt) através do GPT 3.5, GPT-4 Turbo, Claude e LLMs locais de código aberto
★ 802+0Variação de estrelas nos últimos 7 dias - #321
Trankit é um kit de ferramentas Python leve baseado em Transformer para Processamento de Linguagem Natural Multilíngue
★ 798+0Variação de estrelas nos últimos 7 dias - #322
LexNLP por LexPredict
★ 795+0Variação de estrelas nos últimos 7 dias - #323
DNABERT: modelo Bidirectional Encoder Representations from Transformers pré-treinado para linguagem de DNA no genoma.
★ 778+1Variação de estrelas nos últimos 7 dias - #324★ 778+0Variação de estrelas nos últimos 7 dias
- #325★ 778+6Variação de estrelas nos últimos 7 dias
- #326
O PatrickStar permite modelos pré-treinados maiores, mais rápidos e ecológicos para NLP e democratiza a IA para todos.
★ 772+0Variação de estrelas nos últimos 7 dias - #327★ 768+0Variação de estrelas nos últimos 7 dias
- #328
Artigos mais citados e de conferências de topo sobre interpretabilidade de modelos de redes neurais em deep learning nos últimos anos (com código)
★ 767+0Variação de estrelas nos últimos 7 dias - #329
Deduplicação de texto tudo-em-um
★ 764+1Variação de estrelas nos últimos 7 dias - #330
Implementações em Python de tecnologias de Desambiguação de Sentido de Palavras (WSD).
★ 749+0Variação de estrelas nos últimos 7 dias