inference
Erfasste Open-Source-Repos mit dem Tag inference, sortiert nach Sternen.
- #31
Superduper: End-to-End-Framework zum Erstellen benutzerdefinierter KI-Anwendungen und Agents.
★ 5.318+1Sterne-Änderung der letzten 7 Tage - #32
cube studio开源云原生一站式机器学习/深度学习/大模型AI平台,mlops算法链路全流程,算力租赁平台,notebook在线开发,拖拉拽任务流pipeline编排,多机多卡分布式训练,超参搜索,推理服务VGPU虚拟化,边缘计算,标注平台自动化标注,deepseek等大模型sft微调/奖励模型/强化学习训练,vllm/ollama/mindie大模型多机推理,私有知识库,AI模型市场,支持国产cpu/gpu/npu 昇腾生态,支持RDMA,支持pytorch/tf/mxnet/deepspeed/paddle/colossalai/horovod/ray/volcano等分布式
★ 5.078+3Sterne-Änderung der letzten 7 Tage - #33★ 4.882+3Sterne-Änderung der letzten 7 Tage
- #34
Schnelle Inferenz-Engine für Transformer-Modelle.
★ 4.658+7Sterne-Änderung der letzten 7 Tage - #35
TNN: Entwickelt vom Tencent Youtu Lab und Guangying Lab, ein einheitliches Deep-Learning-Inferenz-Framework für Mobilgeräte, Desktops und Server. TNN zeichnet sich durch herausragende Funktionen wie Plattformunabhängigkeit, hohe Leistung, Modellkomprimierung und Code-Pruning aus. Basierend auf ncnn und Rapidnet verstärkt TNN die Unterstützung und Leistungsoptimierung für Mobilgeräte weiter.
★ 4.649+1Sterne-Änderung der letzten 7 Tage - #36★ 4.438+8Sterne-Änderung der letzten 7 Tage
- #37
Trainierte Deep-Learning-Modelle und Demos (von hoher Qualität und extrem schnell)
★ 4.424+0Sterne-Änderung der letzten 7 Tage - #38★ 4.390+69Sterne-Änderung der letzten 7 Tage
- #39
Ein einheitliches Inferenz- und Post-Training-Framework für beschleunigte Videogenerierung.
★ 4.300+150Sterne-Änderung der letzten 7 Tage - #40
CSGHub ist eine brandneue Open-Source-Plattform zur Verwaltung von LLMs, entwickelt vom OpenCSG-Team. Sie bietet sowohl Open-Source- als auch On-Premise/SaaS-Lösungen mit Funktionen, die mit Hugging Face vergleichbar sind. Erhalten Sie die volle Kontrolle über den Lebenszyklus von LLMs, Datensätzen und Agenten, mit Python-SDK-Kompatibilität zu Hugging Face. Machen Sie mit! ⭐️
★ 4.104+3Sterne-Änderung der letzten 7 Tage - #41
Jedes Modell. Jede Hardware. Keine Kompromisse. Entwickelt mit @ziglang / @openxla / MLIR / @bazelbuild
★ 4.015+5Sterne-Änderung der letzten 7 Tage - #42
Leistungsstarkes Inferenz- und Bereitstellungs-Toolkit für LLMs und VLMs auf Basis von PaddlePaddle
★ 3.714+3Sterne-Änderung der letzten 7 Tage - #43
Die schnellste lokale KI-Engine für Apple Silicon. 4,2x schneller als Ollama, 0,08s gecachte TTFT, 100% Tool-Calling. 17 Tool-Parser, Prompt-Cache, Reasoning-Trennung, Cloud-Routing. Nahtloser OpenAI-Ersatz. Funktioniert mit Claude Code, Cursor, Aider.
★ 3.647+81Sterne-Änderung der letzten 7 Tage - #44
Implementiere Schritt für Schritt eine hochleistungsfähige Deep-Learning-Inferenzbibliothek, die Modelle wie Llama2, Unet, Yolov5, Resnet und andere unterstützt.
★ 3.499+2Sterne-Änderung der letzten 7 Tage - #45
🚀 Beschleunigen Sie Inference und Training von 🤗 Transformers, Diffusers, TIMM und Sentence Transformers mit einfach zu bedienenden Hardware-Optimierungstools
★ 3.477+4Sterne-Änderung der letzten 7 Tage - #46
📚 Jupyter Notebook Tutorials für OpenVINO™
★ 3.212+3Sterne-Änderung der letzten 7 Tage - #47
Open-Source-Inferenzserver und Produktionscluster für alle Modelle, die Ihr Agent benötigt.
★ 3.030+173Sterne-Änderung der letzten 7 Tage - #48★ 2.961+2Sterne-Änderung der letzten 7 Tage
- #49
Von der Community gepflegtes Hardware-Plugin für vLLM auf Ascend
★ 2.749+19Sterne-Änderung der letzten 7 Tage - #50
Verwende Hugging Face mit JavaScript
★ 2.510+3Sterne-Änderung der letzten 7 Tage - #51★ 2.484+6Sterne-Änderung der letzten 7 Tage
- #52
cubestudio ist eine Open-Source Cloud-Native KI-Plattform für Machine Learning, Deep Learning und Large Language Models (LLM). Sie bietet MLOps, Multi-Tenancy, Ressourcen-Leasing, Pipeline-Orchestrierung, verteiltes Training, Inferenz-Dienste, VGPU-Virtualisierung sowie Unterstützung für heterogene Hardware (Ascend, Cambricon etc.) und private Wissensdatenbanken.
★ 2.469+12Sterne-Änderung der letzten 7 Tage - #53
Hocheffiziente Gleitkomma-Inferenzoperatoren für neuronale Netze für Mobilgeräte, Server und das Web
★ 2.439+2Sterne-Änderung der letzten 7 Tage - #54
Verwandeln Sie jeden Computer oder Edge-Device in ein Kommandozentrum für Ihre Computer-Vision-Projekte.
★ 2.431+2Sterne-Änderung der letzten 7 Tage - #55
Angewandte KI meistern, Konzept für Konzept
★ 2.378+1Sterne-Änderung der letzten 7 Tage - #56
Vendorunabhängige Orchestrierung für Training-, Inferenz- und Agenten-Workloads auf NVIDIA, AMD, TPU und Tenstorrent in Clouds, Kubernetes und auf Bare Metal.
★ 2.233+4Sterne-Änderung der letzten 7 Tage - #57★ 2.177+5Sterne-Änderung der letzten 7 Tage
- #58
Inferenz für Llama 2 in einer einzigen Datei aus purem 🔥
★ 2.126+0Sterne-Änderung der letzten 7 Tage - #59
MII ermöglicht latenzarme und hochdurchsatzfähige Inferenz, unterstützt durch DeepSpeed.
★ 2.112+1Sterne-Änderung der letzten 7 Tage - #60★ 2.076+0Sterne-Änderung der letzten 7 Tage