llama
Repositórios de código aberto acompanhados marcados com llama, ordenados por estrelas.
- #181
Este repositório fornece programas para construir código de RAG (Retrieval-Augmented Generation) para Generative AI com LlamaIndex, Deep Lake e Pinecone, aproveitando o poder dos modelos da OpenAI e Hugging Face para geração e avaliação.
★ 624+2Variação de estrelas nos últimos 7 dias - #182
Fine-tuning fácil e eficiente de LLMs. (Suporta LLaMA, LLaMA2, LLaMA3, Qwen, Baichuan, GLM, Falcon). Treinamento e implantação eficientes de quantização para grandes modelos.
★ 621+0Variação de estrelas nos últimos 7 dias - #183
kani (カニ) é um microframework altamente personalizável para modelos de linguagem com chamada de ferramentas. (NLP-OSS @ EMNLP 2023)
★ 609+2Variação de estrelas nos últimos 7 dias - #184
Os Copilots já são locais? A fronteira dos LLM Copilots locais para conclusão de código, geração de projetos, assistência de shell e muito mais. Encontre ferramentas que moldam a experiência do desenvolvedor de amanhã, hoje!
★ 600+0Variação de estrelas nos últimos 7 dias - #185
Yet Another Language Model: inferência de LLM em C++/CUDA, sem bibliotecas além de I/O.
★ 596-1Variação de estrelas nos últimos 7 dias - #186
Vá com sua própria inteligência - Aplicativos Go que integram diretamente o llama.cpp para inferência local usando aceleração de hardware.
★ 594+16Variação de estrelas nos últimos 7 dias - #187★ 592+0Variação de estrelas nos últimos 7 dias
- #188
SDK de IA local open-source - execute IA no dispositivo sem nuvem e sem chaves de API. Suporta GGUF, RAG, geração de imagem, música e vídeo, conversão de fala em texto, inferência P2P e muito mais. Multiplataforma: Linux, macOS, Windows, Android, iOS.
★ 591+33Variação de estrelas nos últimos 7 dias - #189
[ECCV2024] Modelo de Linguagem Grande Multimodal Fundamentado com Tokenização Visual Localizada
★ 586+0Variação de estrelas nos últimos 7 dias - #190
Este é um repositório de NLP de Deep Learning que organiza desde o pré-processamento de texto usando TensorFlow até tarefas downstream de modelos modernos como Topic Models, BERT, GPT e LLM.
★ 581+0Variação de estrelas nos últimos 7 dias - #191★ 578+8Variação de estrelas nos últimos 7 dias
- #192
LLaVA-Mini é um modelo multimodal grande (LMM) unificado que suporta a compreensão de imagens, imagens de alta resolução e vídeos de forma eficiente.
★ 577+0Variação de estrelas nos últimos 7 dias - #193
Treine e deduza poderosos embeddings de frases com AnglE | 🔥 SOTA nas leaderboards de STS e MTEB
★ 573+0Variação de estrelas nos últimos 7 dias - #194
Use o Code Llama com o Visual Studio Code e a extensão Continue. Uma alternativa de LLM local ao GitHub Copilot.
★ 569+0Variação de estrelas nos últimos 7 dias - #195★ 555+2Variação de estrelas nos últimos 7 dias
- #196★ 553+0Variação de estrelas nos últimos 7 dias
- #197★ 539+2Variação de estrelas nos últimos 7 dias
- #198
[ICML 2024] LESS: Selecionando dados influentes para ajuste de instrução direcionado
★ 532-1Variação de estrelas nos últimos 7 dias - #199
Assistente baseado em IA para ajudar nas suas tarefas diárias, alimentado por Llama 3, DeepSeek R1 e muitos outros modelos no HuggingFace.
★ 530+0Variação de estrelas nos últimos 7 dias - #200
A Reactive CLI that generates commit messages for Git and Jujutsu with Ollama, ChatGPT, Gemini, Claude, Mistral and other AI
★ 528-1Variação de estrelas nos últimos 7 dias - #201★ 523+1Variação de estrelas nos últimos 7 dias
- #202
Um mecanismo de atendimento de baixa latência e alto rendimento para LLMs
★ 520+0Variação de estrelas nos últimos 7 dias - #203★ 514+1Variação de estrelas nos últimos 7 dias
- #204
Servidor de inferência de linguagem de código aberto, local e auto-hospedado altamente otimizado com suporte a ASR/STT, TTS e LLM via WebRTC, REST e WS
★ 512+0Variação de estrelas nos últimos 7 dias - #205
RESTai é uma plataforma open-source de AIaaS (IA como Serviço). Suporta muitos LLMs públicos e locais suportados por Ollama/vLLM/etc. Uso preciso de embeddings, ajuste, análises, etc. Geração de imagem/áudio integrada com geradores de carregamento dinâmico. Implantação de chat ao vivo. Linguagem gráfica baseada em blocos integrada. Versionamento de prompts e muito mais...
★ 512+0Variação de estrelas nos últimos 7 dias - #206
🚀🚀🚀 Este repositório lista alguns projetos incríveis públicos de CUDA, cuda-python, cuBLAS, cuDNN, CUTLASS, TensorRT, TensorRT-LLM, Triton, TVM, MLIR, PTX e Computação de Alto Desempenho (HPC).
★ 511-3Variação de estrelas nos últimos 7 dias - #207
Open Model Engine (OME) — Kubernetes operator for LLM serving, GPU scheduling, and model lifecycle management. Works with SGLang, vLLM, TensorRT-LLM, and Triton
★ 507—Variação de estrelas nos últimos 7 dias