メインコンテンツへスキップ
buildradar
Sign in
トピック · multimodal-ai

multimodal-ai

multimodal-ai がタグ付けされた追跡中のオープンソースリポジトリを、スター数順に表示します。

リポジトリ
13
総スター数
38,644
平均スター数
2,973
シェア
0.00%

multimodal-ai と同じリポジトリに頻繁に登場するトピック。

最近の急上昇

直近 90 日以内に作成され、multimodal-ai がタグ付けされたリポジトリ。

直近 90 日以内に、このトピックがタグ付けされた新しいリポジトリはありません。

  • 🚀 オフライン動画生成およびデジタルヒューマンクローニングのための真にオープンソースのAIアバター(デジタルヒューマン)ツールキット。

    14,992+65直近 7 日のスター増減
  • AgnesAI-Models@AgnesAI-Labs

    OpenAI互換のテキスト、画像、ビデオ、エージェントワークフローのための公式Agnes AIゲートウェイおよびモデルカタログ。

    5,044+28直近 7 日のスター増減
  • AIエージェント向けのマルチモーダル生成メディアスキル(Claude Code, Cursor, Gemini CLI)。muapi.aiが提供する高品質な画像、動画、音声生成。

    4,205+19直近 7 日のスター増減
  • Mano-P@Mininglamp-AI

    Mano-P: エッジデバイス向けオープンソース GUI-VLA エージェント。OSWorld で 1 位(特化型、58.2%)。Apple M4 Mac mini / MacBook でローカル実行され、データがデバイス外に出ません。

    2,615+15直近 7 日のスター増減
  • EVA-OS@AutoArk

    EVA OS — 次世代ハードウェア向けのリアルタイムマルチモーダルAIOS。デバイスに「命」を吹き込み、本物の脳と同等の知能を持たせます

    1,869+87直近 7 日のスター増減
  • video-search-and-summarization@NVIDIA-AI-Blueprints

    動画検索および要約(VSS)向けのNVIDIA AI Blueprintは、リアルタイムの検証済みアラート、視覚的Q&A、自動レポート機能を備えた動画解析エージェントを構築するためのGPUアクセラレーテッド・リファレンスアーキテクチャです。VSS Blueprintは、NVIDIA Cosmosなどのビジョン言語モデル(VLM)、NVIDIA NemotronなどのLLM、RAG、およびNVIDIA NIMを使用します。

    1,840+10直近 7 日のスター増減
  • OpenGUI@Core-Mate

    OpenGUIは、GUIを通じて実際のモバイルアプリを視認、計画、操作できる、スマホ利用AI向けのAndroid GUIエージェントフレームワークです。

    1,624+38直近 7 日のスター増減
  • vllm-mlx@waybarrios

    Apple Silicon 向けの高性能な OpenAI および Anthropic 互換 LLM 推論サーバー。ネイティブ MLX、連続バッチ処理、マルチモーダルモデル、MCP ツール呼び出し、Claude Code をサポート。

    1,557+6直近 7 日のスター増減
  • 155種類以上のビジョン・言語モデル(VLM/MLLM)アーキテクチャのキュレーションされたビジュアルカタログ:論文、図解、学習レシピ、データセット、マルチモーダルAIエージェントのリリース年表。

    1,310+2直近 7 日のスター増減
  • xiaoyaosearch@dtsola

    XiaoyaoSearch:言葉を理解し、画像を認識し、AIでローカルファイルを検索します。検索をチャットのようにシンプルにします。

    1,085+1直近 7 日のスター増減
  • opendroid@yashab-cyber

    オープンな自律型 Android エージェント — ローカル/リモートの LLM とアクセシビリティ駆動の画面自動化を活用した、本番環境対応の自己計画型 AI アシスタント。

    1,025+44直近 7 日のスター増減
  • vectordb-recipes@lancedb

    ベクトル検索と LLM を使用したマルチモーダル AI、RAG、エージェントのリソース、サンプル、チュートリアル

    973-1直近 7 日のスター増減
  • MOSS-VL@OpenMOSS

    An open-weight 11B model series for long-form and real-time video understanding

    606直近 7 日のスター増減
← トピック一覧に戻る