language-model
Repositórios de código aberto acompanhados marcados com language-model, ordenados por estrelas.
- #61
Biblioteca independente de Machine Learning e Processamento de Linguagem Natural em Go
★ 1.850+0Variação de estrelas nos últimos 7 dias - #62
Dicionários estendidos simplificado/tradicional, codificação de tons, cadeia de ferramentas de anotação de tons completa, cadeia de ferramentas de atualização e modelo gramatical Rime: LMDG - Language, Model, Dictionary, Grammar. Sim, este é o "Império Romano" do Pinyin Wanxiang!
★ 1.849+8Variação de estrelas nos últimos 7 dias - #63
A implementação oficial do RAPTOR: Recursive Abstractive Processing for Tree-Organized Retrieval
★ 1.752+1Variação de estrelas nos últimos 7 dias - #64
Modelo de chat em chinês de 0.2B (ChatLM-Chinese-0.2B), com código aberto completo para fontes de dados, limpeza, treinamento de tokenizer, pré-treinamento, ajuste fino SFT e otimização RLHF. Suporta ajuste fino SFT para tarefas downstream, incluindo exemplos de extração de triplas.
★ 1.731+2Variação de estrelas nos últimos 7 dias - #65
Crie diagramas de arquitetura a partir de código automaticamente usando grandes modelos de linguagem (LLMs).
★ 1.695-1Variação de estrelas nos últimos 7 dias - #66
Macaw-LLM: Modelagem de Linguagem Multimodal com Integração de Imagem, Vídeo, Áudio e Texto
★ 1.591+0Variação de estrelas nos últimos 7 dias - #67★ 1.579+0Variação de estrelas nos últimos 7 dias
- #68
Modelo pequeno, lógica grande: otimização orientada pela diversidade desperta a capacidade de raciocínio de grandes modelos no VibeThinker-1.5B.
★ 1.567+5Variação de estrelas nos últimos 7 dias - #69
[EMNLP 2025 Oral] MemoryOS foi projetado para fornecer um sistema operacional de memória para agentes de IA personalizados.
★ 1.567+1Variação de estrelas nos últimos 7 dias - #70
Um currículo para aprender sobre modelos de fundação, do zero à fronteira tecnológica.
★ 1.464+1Variação de estrelas nos últimos 7 dias - #71
Modelo pré-treinado ELECTRA em chinês
★ 1.434+0Variação de estrelas nos últimos 7 dias - #72
Resumo de LLMs em japonês - Visão geral de LLMs japoneses
★ 1.428+1Variação de estrelas nos últimos 7 dias - #73★ 1.420+3Variação de estrelas nos últimos 7 dias
- #74
🛸 Use transformers pré-treinados como BERT, XLNet e GPT-2 no spaCy
★ 1.410+0Variação de estrelas nos últimos 7 dias - #75
Calcule tokens/s e requisitos de memória GPU para qualquer LLM. Suporta quantização llama.cpp/ggml/bnb/QLoRA.
★ 1.406+0Variação de estrelas nos últimos 7 dias - #76★ 1.385-1Variação de estrelas nos últimos 7 dias
- #77
Comprimir o treinamento de um modelo de linguagem (tipo BERT) em recursos computacionais limitados.
★ 1.366+0Variação de estrelas nos últimos 7 dias - #78★ 1.309+0Variação de estrelas nos últimos 7 dias
- #79
Transformers4Rec é uma biblioteca flexível e eficiente para recomendação sequencial e baseada em sessão, compatível com PyTorch.
★ 1.281+0Variação de estrelas nos últimos 7 dias - #80
Lista de agentes de linguagem baseada no artigo "Cognitive Architectures for Language Agents"
★ 1.256+3Variação de estrelas nos últimos 7 dias - #81★ 1.212-1Variação de estrelas nos últimos 7 dias
- #82
💁 Tesouro incrível de modelos Transformers para processamento de linguagem natural, contendo artigos, vídeos, blogs, repositório oficial e notebooks do Colab. 🛫☑️
★ 1.179+0Variação de estrelas nos últimos 7 dias - #83
Uma coleção de conjuntos de dados de código aberto para treinar LLMs que seguem instruções (ChatGPT, LLaMA, Alpaca)
★ 1.153-1Variação de estrelas nos últimos 7 dias - #84
Uma lista com curadoria de recursos de PNL focados em redes Transformer, mecanismo de atenção, GPT, BERT, ChatGPT, LLMs e aprendizado por transferência.
★ 1.152+2Variação de estrelas nos últimos 7 dias - #85
[NeurIPS 2023] LLM-Pruner: Sobre a poda estrutural de Large Language Models. Suporta Llama-3/3.1, Llama-2, LLaMA, BLOOM, Vicuna, Baichuan, TinyLlama, etc.
★ 1.139+2Variação de estrelas nos últimos 7 dias - #86
ToRA é uma série de LLM Agents integrados a ferramentas projetados para resolver problemas desafiórios de raciocínio matemático interagindo com ferramentas [ICLR'24].
★ 1.124+0Variação de estrelas nos últimos 7 dias - #87
Z80-μLM é um modelo de linguagem quantizado de 2 bits pequeno o suficiente para rodar em um processador Z80 de 8 bits. Treine modelos conversacionais em Python, exporte-os como binários .COM para CP/M e converse com seu computador antigo.
★ 1.119+2Variação de estrelas nos últimos 7 dias - #88
Implementações do SDK do cliente LangSmith
★ 1.048+8Variação de estrelas nos últimos 7 dias - #89★ 1.040+1Variação de estrelas nos últimos 7 dias
- #90
Plugin de tradução de legendas em tempo real que integra a API do OpenAI ChatGPT (ou qualquer modelo com o mesmo método de chamada de API) ao PotPlayer, permitindo traduzir legendas enquanto assiste a vídeos.
★ 1.030+1Variação de estrelas nos últimos 7 dias