llama
Repositorios de código abierto monitorizados etiquetados con llama, ordenados por estrellas.
- #181
Este repositorio proporciona programas para crear código de Generación Aumentada por Recuperación (RAG) para IA generativa con LlamaIndex, Deep Lake y Pinecone, aprovechando el poder de los modelos de OpenAI y Hugging Face para la generación y evaluación.
★ 624+1Variación de estrellas de los últimos 7 días - #182
Ajuste fino (finetuning) fácil y eficiente para LLMs. (Compatible con LLama, LLama2, LLama3, Qwen, Baichuan, GLM, Falcon). Entrenamiento y despliegue eficiente de cuantización para grandes modelos.
★ 621+0Variación de estrellas de los últimos 7 días - #183
kani (カニ) es un microframework altamente personalizable para modelos de lenguaje con llamadas a herramientas. (NLP-OSS @ EMNLP 2023)
★ 609+2Variación de estrellas de los últimos 7 días - #184
¿Son locales los Copilots ya? La frontera de los Copilots LLM locales para autocompletado de código, generación de proyectos, asistencia en shell y más. ¡Encuentra hoy las herramientas que darán forma a la experiencia del desarrollador del mañana!
★ 600+0Variación de estrellas de los últimos 7 días - #185
Yet Another Language Model: inferencia de LLM en C++/CUDA, sin bibliotecas excepto para E/S
★ 596-1Variación de estrellas de los últimos 7 días - #186★ 592+0Variación de estrellas de los últimos 7 días
- #187
SDK de IA local de código abierto: ejecute IA en el dispositivo sin nube ni claves API. Soporta GGUF, RAG, generación de imágenes, música y video, voz a texto, inferencia P2P y más. Multiplataforma: Linux, macOS, Windows, Android, iOS.
★ 589+32Variación de estrellas de los últimos 7 días - #188
Go con inteligencia propia: aplicaciones en Go que integran directamente llama.cpp para inferencia local mediante aceleración por hardware.
★ 589+14Variación de estrellas de los últimos 7 días - #189
[ECCV2024] Modelo de lenguaje multimodal fundamentado con tokenización visual localizada
★ 586+0Variación de estrellas de los últimos 7 días - #190
Repositorio de Deep Learning NLP que utiliza TensorFlow para cubrir desde el preprocesamiento de texto hasta tareas posteriores con modelos modernos como Topic Models, BERT, GPT y LLM.
★ 581+0Variación de estrellas de los últimos 7 días - #191
LLaVA-Mini es un modelo multimodal grande (LMM) unificado que admite la comprensión de imágenes, imágenes de alta resolución y videos de manera eficiente.
★ 577+0Variación de estrellas de los últimos 7 días - #192★ 577+8Variación de estrellas de los últimos 7 días
- #193
Entrena e infiere potentes incrustaciones de oraciones con AnglE | 🔥 SOTA en STS y en la tabla de clasificación MTEB
★ 573+0Variación de estrellas de los últimos 7 días - #194
Utiliza Code Llama con Visual Studio Code y la extensión Continue. Una alternativa local de LLM a GitHub Copilot.
★ 569+0Variación de estrellas de los últimos 7 días - #195★ 554+2Variación de estrellas de los últimos 7 días
- #196★ 553+0Variación de estrellas de los últimos 7 días
- #197★ 539+1Variación de estrellas de los últimos 7 días
- #198
[ICML 2024] LESS: Selección de datos influyentes para el ajuste de instrucciones dirigido.
★ 532-1Variación de estrellas de los últimos 7 días - #199
Asistente impulsado por IA para ayudar con las tareas diarias, basado en Llama 3, DeepSeek R1 y muchos otros modelos de HuggingFace.
★ 530+0Variación de estrellas de los últimos 7 días - #200
Una CLI reactiva que genera mensajes de commit para Git y Jujutsu utilizando Ollama, ChatGPT, Gemini, Claude, Mistral y otras IA
★ 527-1Variación de estrellas de los últimos 7 días - #201★ 522+0Variación de estrellas de los últimos 7 días
- #202
Un motor de servicio de baja latencia y alto rendimiento para LLMs.
★ 520+0Variación de estrellas de los últimos 7 días - #203★ 514+1Variación de estrellas de los últimos 7 días
- #204
RESTai es una plataforma de código abierto de AIaaS (IA como servicio). Soporta múltiples LLM públicos y locales mediante Ollama/vLLM, entre otros. Incluye uso preciso de embeddings, ajuste, analítica, generación integrada de imagen/audio con cargadores dinámicos, despliegue de chat en vivo, lenguaje gráfico basado en bloques y control de versiones de prompts.
★ 512+0Variación de estrellas de los últimos 7 días - #205
Servidor de inferencia de lenguaje altamente optimizado, de código abierto, local y autohospedado, que admite ASR/STT, TTS y LLM a través de WebRTC, REST y WS.
★ 512+0Variación de estrellas de los últimos 7 días - #206
Este repositorio enumera proyectos destacados de código abierto sobre CUDA, cuda-python, cuBLAS, cuDNN, CUTLASS, TensorRT, TensorRT-LLM, Triton, TVM, MLIR, PTX y computación de alto rendimiento (HPC).
★ 511-2Variación de estrellas de los últimos 7 días - #207
Open Model Engine (OME) — Kubernetes operator for LLM serving, GPU scheduling, and model lifecycle management. Works with SGLang, vLLM, TensorRT-LLM, and Triton
★ 506—Variación de estrellas de los últimos 7 días