メインコンテンツへスキップ
buildradar
Sign in
トピック · inference

inference

inference がタグ付けされた追跡中のオープンソースリポジトリを、スター数順に表示します。

120 件のリポジトリ
  • superduper@superduper-io

    Superduper: カスタムAIアプリケーションおよびエージェントを構築するためのエンドツーエンドフレームワーク。

    5,318+1直近 7 日のスター増減
  • cube-studio@tencentmusic

    cube studioは、オープンソースのクラウドネイティブなオールインワン機械学習/深層学習/大規模モデルAIプラットフォームです。MLOpsのアルゴリズムリンク全工程、コンピューティングリソースレンタルプラットフォーム、ノートブックオンライン開発、ドラッグ&ドロップによるタスクフローパイプラインオーケストレーション、マルチマシン/マルチGPU分散学習、ハイパーパラメータ探索、推論サービスVGPU仮想化、エッジコンピューティング、アノテーションプラットフォームの自動アノテーション、deepseekなどの大規模モデルのSFTファインチューニング/報酬モデル/強化学習トレーニング、vllm/ollama/mindieによる大規模モデルのマルチマシン推論、プライベートナレッジベース、AIモデルマーケットをサポートし、国産CPU/GPU/NPU(昇騰エコシステム)をサポート、RDMAをサポート、pytorch/tf/mxnet/deepspeed/paddle/colossalai/horovod/ray/volcanoなどの分散処理をサポートします。

    5,078+3直近 7 日のスター増減
  • torch2trt@NVIDIA-AI-IOT

    使いやすいPyTorchからTensorRTへのコンバーター

    4,882+3直近 7 日のスター増減
  • CTranslate2@OpenNMT

    Transformerモデル向けの高速推論エンジン

    4,658+7直近 7 日のスター増減
  • TNN@Tencent

    TNN: Tencent Youtu LabとGuangying Labによって開発された、モバイル、デスクトップ、サーバー向けの統一的な深層学習推論フレームワーク。TNNは、クロスプラットフォーム対応能力、高性能、モデル圧縮、コードプルーニングなど、いくつかの優れた特徴を際立たせている。ncnnとRapidnetを基盤として、TNNはモバイルデバイス向けのサポートとパフォーマンス最適化をさらに強化している。

    4,649+1直近 7 日のスター増減
  • typedb@typedb

    TypeDB: レコードではなくシステムのために構築

    4,438+8直近 7 日のスター増減
  • open_model_zoo@openvinotoolkit

    事前学習済みディープラーニングモデルとデモ(高品質かつ超高速)

    4,424+0直近 7 日のスター増減
  • llm-d@llm-d

    Kubernetes上で最新のアクセラレータを使用し、最先端の推論パフォーマンスを達成

    4,390+69直近 7 日のスター増減
  • FastVideo@hao-ai-lab

    高速化されたビデオ生成のための統一された推論およびポストトレーニングフレームワーク。

    4,300+150直近 7 日のスター増減
  • csghub@OpenCSGs

    CSGHubは、OpenCSGチームによって開発された全く新しいLLM管理のためのオープンソースプラットフォームです。Hugging Faceに匹敵する機能を備えたオープンソースおよびオンプレミス/SaaSソリューションを提供します。Hugging FaceとのPython SDK互換性により、LLM、データセット、エージェントのライフサイクルを完全に制御できます。ぜひご参加ください! ⭐️

    4,104+3直近 7 日のスター増減
  • zml@zml

    どんなモデルでも。どんなハードウェアでも。妥協なし。@ziglang / @openxla / MLIR / @bazelbuild で構築。

    4,015+5直近 7 日のスター増減
  • FastDeploy@PaddlePaddle

    PaddlePaddleベースのLLMおよびVLM向け高性能推論・デプロイメントツールキット

    3,714+3直近 7 日のスター増減
  • Rapid-MLX@raullenchai

    Apple Silicon 向けの最速ローカル AI エンジン。Ollama の 4.2 倍高速、キャッシュ時 TTFT 0.08 秒、ツール呼び出し 100% 対応。17 個のツールパーサー、プロンプトキャッシュ、推論分離、クラウドローティングを搭載。OpenAI のドロップイン代替。Claude Code、Cursor、Aider と連携可能。

    3,647+81直近 7 日のスター増減
  • KuiperInfer@zjhellofss

    新卒採用、秋採用、春採用、インターンシップに最適なプロジェクト!ゼロから高性能なディープラーニング推論ライブラリの実装を学び、llama2、Unet、Yolov5、Resnetなどの大規模モデルの推論をサポートします。

    3,499+2直近 7 日のスター増減
  • optimum@huggingface

    🚀 使いやすいハードウェア最適化ツールで 🤗 Transformers、Diffusers、TIMM、Sentence Transformersの推論とトレーニングを加速する

    3,477+4直近 7 日のスター増減
  • openvino_notebooks@openvinotoolkit

    OpenVINO™向けのJupyter Notebookチュートリアル集

    3,212+3直近 7 日のスター増減
  • sie@superlinked

    エージェントに必要なすべてのモデルに対応する、オープンソースの推論サーバーおよび本番用クラスター

    3,030+173直近 7 日のスター増減
  • ao@pytorch

    トレーニングおよび推論のための PyTorch ネイティブ量子化

    2,961+2直近 7 日のスター増減
  • vllm-ascend@vllm-project

    Ascend 上の vLLM 向けコミュニティ維持ハードウェアプラグイン

    2,749+19直近 7 日のスター増減
  • huggingface.js@huggingface

    JavaScript で Hugging Face を利用する

    2,510+3直近 7 日のスター増減
  • ort@pykeio

    Rust による ONNX モデルの高速な ML 推論およびトレーニング

    2,484+6直近 7 日のスター増減
  • cube-studio@data-infra

    cubestudioはオープンソースのクラウドネイティブなワンストップ機械学習/ディープラーニング/大規模モデルAIプラットフォーム、MaaS/mlops/AIプラットフォームであり、アルゴリズムの全プロセス、マルチテナント、計算力レンタルプラットフォーム、token中継、ドラッグ&ドロップによるタスクフローpipelineオーケストレーション、マルチマシン・マルチカード分散トレーニング、ハイパーパラメータ探索、推論サービス、VGPU仮想化、クラウド・エッジ・デバイス協調、エッジコンピューティング、自動アノテーションプラットフォーム、deepseekなどの大規模モデルSFTファインチューニング/報酬モデル/強化学習トレーニング、vllm/ollama/mindie大規模モデルマルチマシン推論、プライベートナレッジベースllmopsエージェント、AIモデルマーケットプレイスを提供し、国産の異構計算力スケジューリング(昇騰、寒武紀、海光、摩尔、沐曦など)やib/roce/RDMA、信創に対応しています。

    2,469+12直近 7 日のスター増減
  • XNNPACK@google

    モバイル、サーバー、Web向けの効率的な浮動小数点ニューラルネットワーク推論演算子

    2,439+2直近 7 日のスター増減
  • inference@roboflow

    あらゆるコンピューターやエッジデバイスを、コンピュータビジョンプロジェクトのコマンドセンターに変える

    2,431+2直近 7 日のスター増減
  • AI-Engineering.academy@adithya-s-k

    応用 AI を一つずつマスターする

    2,378+1直近 7 日のスター増減
  • dstack@dstackai

    クラウド、Kubernetes、ベアメタル上で、NVIDIA、AMD、TPU、Tenstorrent に跨るトレーニング、推論、エージェントワークロード向けのベンダーニュートラルなオーケストレーション。

    2,233+4直近 7 日のスター増減
  • any-llm@mozilla-ai

    単一のインターフェースを使用してLLMプロバイダーと通信する

    2,177+5直近 7 日のスター増減
  • llama2.mojo@tairov

    純粋な 🔥 の1ファイルでLlama 2を推論

    2,126+0直近 7 日のスター増減
  • DeepSpeed-MII@deepspeedai

    DeepSpeed を活用し、低レイテンシかつ高スループットな推論を実現する MII

    2,112+1直近 7 日のスター増減
  • aici@microsoft

    AICI: プロンプトとしての(Wasm)プログラム

    2,076+0直近 7 日のスター増減
← トピック一覧に戻る