nlp
Repositórios de código aberto acompanhados marcados com nlp, ordenados por estrelas.
- #271
Uma lista curada de recursos para processamento de linguagem natural (PLN) em japonês: bibliotecas Python, LLMs, dicionários, corpora e datasets. Inclui habilidades do Claude Code para pesquisar recursos.
★ 1.006-1Variação de estrelas nos últimos 7 dias - #272
仕事の日本語を、読みやすくわかりやすく書く・直すための Agent Skill です。
★ 1.005+475Variação de estrelas nos últimos 7 dias - #273★ 1.005+15Variação de estrelas nos últimos 7 dias
- #274
Um framework para modelos multimodais grandes de pequena escala.
★ 1.003-1Variação de estrelas nos últimos 7 dias - #275
LLaMA jurídico em chinês (LLaMA for Chinese legal domain)
★ 1.000+0Variação de estrelas nos últimos 7 dias - #276
🔍 LangKit: Um toolkit de código aberto para monitorar Large Language Models (LLMs). 📚 Extrai sinais de prompts e respostas, garantindo segurança. 🛡️ Os recursos incluem qualidade de texto, métricas de relevância e análise de sentimento. 📊 Uma ferramenta abrangente para observabilidade de LLMs. 👀
★ 997+1Variação de estrelas nos últimos 7 dias - #277
Biblioteca Python para processamento de linguagem natural em coreano. Fornece recursos de extração de palavras, tokenizador, etiquetagem de parte do discurso (POS) e pré-processamento.
★ 992+1Variação de estrelas nos últimos 7 dias - #278★ 990+3Variação de estrelas nos últimos 7 dias
- #279★ 990+0Variação de estrelas nos últimos 7 dias
- #280★ 977+0Variação de estrelas nos últimos 7 dias
- #281
Implementação oficial dos artigos "GECToR – Grammatical Error Correction: Tag, Not Rewrite" (BEA-20) e "Text Simplification by Tagging" (BEA-21)
★ 972+0Variação de estrelas nos últimos 7 dias - #282
Uma ferramenta para aprender representações vetoriais de palavras e entidades da Wikipédia
★ 971+0Variação de estrelas nos últimos 7 dias - #283
Modelos Transformer de BERT a GPT-4, ambientes de Hugging Face a OpenAI. Exemplos de fine-tuning, treinamento e prompt engineering. Uma seção bônus com ChatGPT, GPT-3.5-turbo, GPT-4 e DALL-E, incluindo inicialização de GPT-4, speech-to-text, text-to-speech, geração de texto para imagem com DALL-E, Google Cloud AI, HuggingGPT e muito mais
★ 966+0Variação de estrelas nos últimos 7 dias - #284★ 959+0Variação de estrelas nos últimos 7 dias
- #285
Bolt é uma biblioteca de deep learning com alto desempenho e flexibilidade heterogênea.
★ 957+0Variação de estrelas nos últimos 7 dias - #286
[Grande Modelo de Linguagem Jurídica em Chinês] DISC-LawLLM: um sistema jurídico inteligente alimentado por modelos de linguagem grande (LLMs) para fornecer uma ampla gama de serviços jurídicos.
★ 953+3Variação de estrelas nos últimos 7 dias - #287
Mais de 10.000 projetos selecionados, incluindo aprendizado de máquina, aprendizado profundo, NLP, GNN, sistemas de recomendação, biomedicina, visão computacional, desenvolvimento front-end e back-end, entre outros. Continue atualizando! Bem-vindo para dar uma estrela!
★ 948+1Variação de estrelas nos últimos 7 dias - #288
O "AI-Compass" guiará a comunidade na navegação pelo oceano da tecnologia de IA; seja você um iniciante ou um desenvolvedor avançado, encontrará aqui o caminho para as principais direções da IA. O objetivo é ajudar os desenvolvedores a entender sistematicamente os conceitos principais de IA, tecnologias tradicionais, tendências de ponta e dominar todo o processo, da teoria à implementação prática, por meio da prática.
★ 937+7Variação de estrelas nos últimos 7 dias - #289
MindSpore + 🤗Huggingface: Execute qualquer modelo Transformers/Diffusers no MindSpore com compatibilidade perfeita e aceleração.
★ 920+0Variação de estrelas nos últimos 7 dias - #290★ 919+0Variação de estrelas nos últimos 7 dias
- #291★ 915+0Variação de estrelas nos últimos 7 dias
- #292
Uma lista de projetos de IA de código aberto que você pode usar para gerar renda facilmente.
★ 914+19Variação de estrelas nos últimos 7 dias - #293
📚 Processe PDFs, documentos Word e muito mais com spaCy
★ 911+1Variação de estrelas nos últimos 7 dias - #294★ 911+0Variação de estrelas nos últimos 7 dias
- #295
Agente de pesquisa profunda para ajudar você a encontrar os melhores repositórios do GitHub 🕵️!
★ 910+5Variação de estrelas nos últimos 7 dias - #296
TextGAN é um framework PyTorch para modelos de geração de texto baseados em Redes Adversariais Generativas (GANs).
★ 905+0Variação de estrelas nos últimos 7 dias - #297
Similarities: um kit de ferramentas para cálculo de similaridade e busca semântica. Suporta busca de texto em texto, texto em imagem e imagem em imagem para centenas de milhões de dados. Desenvolvido em Python 3, pronto para uso.
★ 905+2Variação de estrelas nos últimos 7 dias - #298
Backend que alimenta o visualizador de datasets nas páginas de datasets do Hugging Face através de uma API pública.
★ 899+0Variação de estrelas nos últimos 7 dias - #299
Uma biblioteca PyTorch de modelos Transformer selecionados e seus componentes combináveis
★ 890+0Variação de estrelas nos últimos 7 dias - #300
Este repositório apresenta o PIXIU, um recurso de código aberto que contém os primeiros Large Language Models (LLMs) financeiros, dados de ajuste de instrução e benchmarks de avaliação para avaliar holisticamente LLMs financeiros. Nosso objetivo é promover continuamente o desenvolvimento de código aberto em inteligência artificial (IA) financeira.
★ 886+1Variação de estrelas nos últimos 7 dias