large-language-models
Repositórios de código aberto acompanhados marcados com large-language-models, ordenados por estrelas.
- #361
LLaVA-Mini é um modelo multimodal grande (LMM) unificado que suporta a compreensão de imagens, imagens de alta resolução e vídeos de forma eficiente.
★ 577+0Variação de estrelas nos últimos 7 dias - #362
[ICML 2025] "SepLLM: Acelere Grandes Modelos de Linguagem Comprimindo um Segmento em um Separador"
★ 572+0Variação de estrelas nos últimos 7 dias - #363
Um sistema de classificação flexível e adaptativo para classificação de texto dinâmico
★ 569+1Variação de estrelas nos últimos 7 dias - #364
Uma coleção aberta de metodologias para auxiliar no treinamento bem-sucedido de grandes modelos de linguagem.
★ 569+2Variação de estrelas nos últimos 7 dias - #365★ 568+0Variação de estrelas nos últimos 7 dias
- #366★ 568+6Variação de estrelas nos últimos 7 dias
- #367
O Chatbot Arena encontra a multimodalidade! O Multi-Modality Arena permite comparar modelos de visão-linguagem lado a lado fornecendo imagens como entrada. Suporta MiniGPT-4, LLaMA-Adapter V2, LLaVA, BLIP-2 e muito mais!
★ 566+0Variação de estrelas nos últimos 7 dias - #368★ 564-1Variação de estrelas nos últimos 7 dias
- #369
Versão em Java do LangChain, capacitando LLMs para Big Data.
★ 564-1Variação de estrelas nos últimos 7 dias - #370
🤖 Um protótipo de assistente para escrita e raciocínio
★ 562+0Variação de estrelas nos últimos 7 dias - #371
Implementação oficial do artigo "DoLa: Decoding by Contrasting Layers Improves Factuality in Large Language Models"
★ 559+0Variação de estrelas nos últimos 7 dias - #372★ 559+0Variação de estrelas nos últimos 7 dias
- #373
Pax é um framework de aprendizado de máquina baseado em Jax para treinamento de modelos de grande escala. O Pax permite experimentação e paralelização avançadas e totalmente configuráveis, demonstrando taxas de utilização de FLOPs de modelo líderes do setor.
★ 558+0Variação de estrelas nos últimos 7 dias - #374
Repositório para o artigo "Agentes Baseados em Modelo de Linguagem Grande para Engenharia de Software: Uma Pesquisa". Continue atualizando.
★ 556+1Variação de estrelas nos últimos 7 dias - #375
[Resultados do EMNLP'25] Um sistema Graph RAG fácil de usar que utiliza conhecimento hierárquico.
★ 556+1Variação de estrelas nos últimos 7 dias - #376★ 555+1Variação de estrelas nos últimos 7 dias
- #377
🔥🔥🔥 Uma lista selecionada de artigos sobre geração multimodal baseada em LLMs (imagem, vídeo, 3D e áudio).
★ 552+0Variação de estrelas nos últimos 7 dias - #378
Meta Agents Research Environments é uma plataforma abrangente projetada para avaliar agentes de IA em cenários dinâmicos e realistas. Ao contrário de benchmarks estáticos, esta plataforma introduz ambientes em evolução onde os agentes devem adaptar suas estratégias à medida que novas informações se tornam disponíveis, espelhando os desafios do mundo real.
★ 551+1Variação de estrelas nos últimos 7 dias - #379
Universal LLM Gateway: Uma API, qualquer LLM. Endpoints compatíveis com OpenAI/Anthropic com tradução entre múltiplos provedores e balanceamento de carga inteligente.
★ 549+5Variação de estrelas nos últimos 7 dias - #380
Uma coleção curada de recursos para engenharia de IA aplicada (em desenvolvimento).
★ 549+2Variação de estrelas nos últimos 7 dias - #381
Dataset e benchmark para RAG em documentos internos de empresas.
★ 548+8Variação de estrelas nos últimos 7 dias - #382
Este é o repositório para o survey de LLM4IR.
★ 545+0Variação de estrelas nos últimos 7 dias - #383
[ICML'24 Spotlight] "TravelPlanner: A Benchmark for Real-World Planning with Language Agents"
★ 545+2Variação de estrelas nos últimos 7 dias - #384
MiniMax M2.1, um modelo SOTA para desenvolvimento e agentes no mundo real.
★ 543+0Variação de estrelas nos últimos 7 dias - #385★ 539+2Variação de estrelas nos últimos 7 dias
- #386
A curated collection of papers and resources on On-Policy Distillation for Large Language Models.
★ 537+10Variação de estrelas nos últimos 7 dias - #387★ 534+0Variação de estrelas nos últimos 7 dias
- #388
[NeurIPS'23] H2O: Heavy-Hitter Oracle para Inferência Gerativa Eficiente de Modelos de Linguagem de Grande Porte.
★ 533+1Variação de estrelas nos últimos 7 dias - #389
Implementação oficial do artigo do ICLR 2024: "Reasoning on Graphs: Faithful and Interpretable Large Language Model Reasoning"
★ 532+0Variação de estrelas nos últimos 7 dias - #390
[NeurIPS 2025 Spotlight] Um Tokenizador Unificado para Geração e Compreensão Visual
★ 529-1Variação de estrelas nos últimos 7 dias