llama
Erfasste Open-Source-Repos mit dem Tag llama, sortiert nach Sternen.
- #181
Dieses Repository bietet Programme zum Erstellen von Retrieval-Augmented-Generation (RAG)-Code für generative KI mit LlamaIndex, Deep Lake und Pinecone unter Nutzung von OpenAI- und Hugging-Face-Modellen für Generierung und Evaluierung.
★ 624+2Sterne-Änderung der letzten 7 Tage - #182
Einfaches und effizientes Finetuning von LLMs. (Unterstützt LLama, LLama2, LLama3, Qwen, Baichuan, GLM, Falcon)
★ 621+0Sterne-Änderung der letzten 7 Tage - #183
kani (カニ) ist ein hochgradig anpassbares Mikroframework für Tool-Calling-Sprachmodelle. (NLP-OSS @ EMNLP 2023)
★ 609+2Sterne-Änderung der letzten 7 Tage - #184
Sind Copilots schon lokal verfügbar? Die Grenze lokaler LLM-Copilots für Code-Vervollständigung, Projektgenerierung, Shell-Unterstützung und mehr. Entdecken Sie Tools, die die Entwicklererfahrung von morgen schon heute prägen!
★ 600+0Sterne-Änderung der letzten 7 Tage - #185
Go mit eigener Intelligenz – Go-Anwendungen, die llama.cpp direkt für lokale Inferenz mittels Hardwarebeschleunigung integrieren.
★ 596+21Sterne-Änderung der letzten 7 Tage - #186
Yet Another Language Model: LLM-Inferenz in C++/CUDA, ohne externe Bibliotheken außer für I/O.
★ 596-1Sterne-Änderung der letzten 7 Tage - #187
Open-Source-lokales KI-SDK – Führen Sie KI geräteintern ohne Cloud, ohne API-Schlüssel aus. Unterstützt GGUF, RAG, Bild-, Musik- und Videoerstellung, Sprache-zu-Text, P2P-Inferenz und mehr. Plattformübergreifend: Linux, macOS, Windows, Android, iOS.
★ 594+35Sterne-Änderung der letzten 7 Tage - #188★ 592+0Sterne-Änderung der letzten 7 Tage
- #189
[ECCV2024] Grounded Multimodal Large Language Model mit lokalisierter visueller Tokenisierung
★ 586+0Sterne-Änderung der letzten 7 Tage - #190
Ein Deep-Learning-NLP-Repository mit TensorFlow, das von der Textvorverarbeitung bis hin zu Downstream-Tasks moderner Modelle wie Topic Models, BERT, GPT und LLMs reicht.
★ 581+0Sterne-Änderung der letzten 7 Tage - #191★ 580+9Sterne-Änderung der letzten 7 Tage
- #192
LLaVA-Mini ist ein einheitliches großes multimodales Modell (LMM), das die effiziente Analyse von Bildern, hochauflösenden Bildern und Videos unterstützt.
★ 577+0Sterne-Änderung der letzten 7 Tage - #193
Training und Inferenz leistungsstarker Satz-Embeddings mit AnglE – SOTA auf den STS- und MTEB-Bestenlisten.
★ 573+0Sterne-Änderung der letzten 7 Tage - #194
Code Llama mit Visual Studio Code und der Continue-Erweiterung nutzen. Eine lokale LLM-Alternative zu GitHub Copilot.
★ 569+0Sterne-Änderung der letzten 7 Tage - #195★ 555+3Sterne-Änderung der letzten 7 Tage
- #196★ 553+0Sterne-Änderung der letzten 7 Tage
- #197★ 539+2Sterne-Änderung der letzten 7 Tage
- #198★ 532-1Sterne-Änderung der letzten 7 Tage
- #199
KI-gestützter Assistent für tägliche Aufgaben, basierend auf Llama 3, DeepSeek R1 und weiteren Modellen von HuggingFace.
★ 530+0Sterne-Änderung der letzten 7 Tage - #200
Ein reaktives CLI, das Commit-Nachrichten für Git und Jujutsu mithilfe von Ollama, ChatGPT, Gemini, Claude, Mistral und anderen KIs generiert.
★ 528+0Sterne-Änderung der letzten 7 Tage - #201★ 523+2Sterne-Änderung der letzten 7 Tage
- #202
Eine Serving-Engine mit niedriger Latenz und hohem Durchsatz für LLMs
★ 521+0Sterne-Änderung der letzten 7 Tage - #203★ 514+1Sterne-Änderung der letzten 7 Tage
- #204
RESTai ist eine Open-Source-Plattform für AIaaS (AI as a Service). Unterstützt zahlreiche öffentliche und lokale LLMs via Ollama/vLLM/etc. Bietet präzise Embeddings, Tuning, Analysen sowie integrierte Bild-/Audiogenerierung mit dynamisch ladbaren Generatoren, Live-Chat-Bereitstellung, eine blockbasierte grafische Sprache, Prompt-Versionierung und mehr.
★ 512+0Sterne-Änderung der letzten 7 Tage - #205
Open-Source, lokaler und selbst gehosteter, hochoptimierter Sprachinferenz-Server mit Unterstützung für ASR/STT, TTS und LLM über WebRTC, REST und WS.
★ 512+0Sterne-Änderung der letzten 7 Tage - #206
🚀🚀🚀 Dieses Repository listet herausragende öffentliche Projekte zu CUDA, cuda-python, cuBLAS, cuDNN, CUTLASS, TensorRT, TensorRT-LLM, Triton, TVM, MLIR, PTX und High Performance Computing (HPC).
★ 511-3Sterne-Änderung der letzten 7 Tage - #207
Open Model Engine (OME) — Kubernetes operator for LLM serving, GPU scheduling, and model lifecycle management. Works with SGLang, vLLM, TensorRT-LLM, and Triton
★ 507—Sterne-Änderung der letzten 7 Tage