メインコンテンツへスキップ
buildradar
Sign in
トピック · multi-modal

multi-modal

multi-modal がタグ付けされた追跡中のオープンソースリポジトリを、スター数順に表示します。

リポジトリ
42
総スター数
189,535
平均スター数
4,513
シェア
0.01%

multi-modal と同じリポジトリに頻繁に登場するトピック。

最近の急上昇

直近 90 日以内に作成され、multi-modal がタグ付けされたリポジトリ。

直近 90 日以内に、このトピックがタグ付けされた新しいリポジトリはありません。

  • agentscope@agentscope-ai

    見て、理解し、信頼できるエージェントを構築・実行する。

    30,463+731直近 7 日のスター増減
  • MiniCPM-V@OpenBMB

    スマートフォン上で超効率的な画像・動画理解を実現するポケットサイズのMLLM

    26,283+43直近 7 日のスター増減
  • ten-framework@TEN-framework

    会話型音声AIエージェントのためのオープンソースフレームワーク

    11,102+19直近 7 日のスター増減
  • InternVL@OpenGVLab

    [CVPR 2024 Oral] InternVL Family: GPT-4oに匹敵する画期的なオープンソース代替モデル。GPT-4oの性能に迫るオープンソースのマルチモーダル対話モデル。

    10,150+4直近 7 日のスター増減
  • modelscope@modelscope

    ModelScope: Model-as-a-Serviceの概念を具現化。

    9,121+10直近 7 日のスター増減
  • big-AGI@enricoros

    最先端のモデルを搭載したAIスイート。高度なAI/AGI機能を提供します。AIペルソナ、AGI機能、世界クラスのBeamマルチモデルチャット、テキストから画像、音声、レスポンスストリーミング、コードハイライトと実行、PDFインポート、開発者向けプリセットなど、多数の機能が含まれます。オンプレミスまたはクラウドにデプロイ可能。

    7,108+6直近 7 日のスター増減
  • data-juicer@datajuicer

    基盤モデルのための、そして基盤モデルを使ったデータ処理! 🍎 🍋 🌽 ➡️ ➡️🍸 🍹 🍷

    6,975+35直近 7 日のスター増減
  • CogVLM@zai-org

    最先端レベルのオープンビジュアル言語モデル | マルチモーダル事前学習モデル

    6,744+0直近 7 日のスター増減
  • valhalla@valhalla

    OpenStreetMap向けオープンソースルーティングエンジン

    6,154+31直近 7 日のスター増減
  • Chinese-CLIP@OFA-Sys

    中国語のCLIP版。中国語のクロスモーダル検索と表現生成を実現。

    6,001+2直近 7 日のスター増減
  • DALLE-pytorch@lucidrains

    OpenAIのText to Image TransformerであるDALL-Eの実装/複製をPytorchで行う

    5,626-1直近 7 日のスター増減
  • marqo@marqo-ai

    Eコマースの検索と発見 - marqo.ai

    5,031+4直近 7 日のスター増減
  • DeepKE@zjunlp

    [EMNLP 2022] 知識グラフ抽出および構築のためのオープンツールキット

    4,476+4直近 7 日のスター増減
  • VLMEvalKit@open-compass

    大規模マルチモーダルモデル (LMMs) のオープンソース評価ツールキット。220以上のLMM、80以上のベンチマークをサポート。

    4,375+15直近 7 日のスター増減
  • OmniGen@VectorSpaceLab

    OmniGen: 統合画像生成。https://arxiv.org/pdf/2409.11340

    4,342+2直近 7 日のスター増減
  • VisualGLM-6B@zai-org

    中国語と英語のマルチモーダル対話型言語モデル | 多様な中国語・英語の会話言語モデル

    4,155+1直近 7 日のスター増減
  • LLamaSharp@SciSharp

    LLM (🦙LLaMA/LLaVA) をローカルデバイスで効率的に実行するためのC#/.NETライブラリ。

    3,790+3直近 7 日のスター増減
  • Video-LLaVA@PKU-YuanGroup

    【EMNLP 2024🔥】Video-LLaVA: Learning United Visual Representation by Alignment Before Projection

    3,500+1直近 7 日のスター増減
  • py-xiaozhi@huangjunsen0406

    MCP統合、マルチモーダルワークフロー、IoTサポート、クロスプラットフォーム音声対話を備えたオープンソースAIアシスタントエコシステム。

    3,463+11直近 7 日のスター増減
  • docarray@docarray

    マルチモーダルデータの表現、送信、保存、検索

    3,123-1直近 7 日のスター増減
  • LISA@JIA-Lab-research

    「LISA: Reasoning Segmentation via Large Language Model」のプロジェクトページ

    2,674+0直近 7 日のスター増減
  • CogVLM2@zai-org

    Llama3-8BをベースにしたGPT4Vレベルのオープンソースマルチモーダルモデル

    2,433+0直近 7 日のスター増減
  • MoE-LLaVA@PKU-YuanGroup

    大規模視覚言語モデルのための Mixture-of-Experts

    2,322+0直近 7 日のスター増減
  • RecSysPapers@tangxyw

    推薦、広告、検索分野における業界の古典および最先端の論文集

    2,188-1直近 7 日のスター増減
  • MotionGPT@OpenMotionLab

    [NeurIPS 2023] MotionGPT: LLMを用いた、人間モーションを外国語に見立てた統合型モーション・言語生成モデル

    1,963+2直近 7 日のスター増減
  • GPTDiscord@Kav-K

    Discord 向けの高機能でオールインワンな GPT インターフェース。ChatGPT スタイルの会話、画像生成、AI モデレーション、カスタムインデックス/ナレッジベース、YouTube 要約などに対応!

    1,853-2直近 7 日のスター増減
  • SALMONN@bytedance

    SALMONN ファミリー:高度なマルチモーダル LLM のスイート

    1,521+7直近 7 日のスター増減
  • MedMNIST@MedMNIST

    [pip install medmnist] 2Dおよび3Dの生物医学画像分類向けの18個の標準化されたデータセット

    1,399+0直近 7 日のスター増減
  • transfusion-pytorch@lucidrains

    MetaAIによる論文「Transfusion: Predict the Next Token and Diffuse Images with One Multi-Modal Model」のPytorch実装

    1,398+3直近 7 日のスター増減
  • このリポジトリは「Large Language Models の知識蒸留に関する調査」の論文を集めたものです。知識蒸留を知識誘出と蒸留アルゴリズムに分解し、LLM のスキルおよび垂直方向の蒸留を探索します

    1,306+1直近 7 日のスター増減
← トピック一覧に戻る