メインコンテンツへスキップ
buildradar
Sign in
トピック · vision-and-language

vision-and-language

vision-and-language がタグ付けされた追跡中のオープンソースリポジトリを、スター数順に表示します。

リポジトリ
23
総スター数
63,821
平均スター数
2,775
シェア
0.00%

vision-and-language と同じリポジトリに頻繁に登場するトピック。

最近の急上昇

直近 90 日以内に作成され、vision-and-language がタグ付けされたリポジトリ。

直近 90 日以内に、このトピックがタグ付けされた新しいリポジトリはありません。

  • 生成AIの研究アップデート、面接リソース、ノートブックなどを網羅したワンストップリポジトリ!

    29,211+213直近 7 日のスター増減
  • LAVIS@salesforce

    LAVIS - 言語・視覚知能のためのオールインワンライブラリ

    11,261-1直近 7 日のスター増減
  • maestro@roboflow

    マルチモーダルモデル(PaliGemma 2、Florence-2、Qwen2.5-VL)のファインチューニングプロセスを効率化する

    2,695+1直近 7 日のスター増減
  • OmAgent@om-ai-lab

    [EMNLP-2024] 高速なプロトタイプ作成と本番環境向けマルチモーダル言語エージェントの構築。

    2,666+1直近 7 日のスター増減
  • ViLT@dandelin

    ICML 2021(口頭発表)の論文コード: "ViLT: Vision-and-Language Transformer Without Convolution or Region Supervision"

    1,538+0直近 7 日のスター増減
  • awesome-japanese-llm@llm-jp

    日本語LLMまとめ - 日本語LLMの概要

    1,428+1直近 7 日のスター増減
  • OmDet@om-ai-lab

    リアルタイムかつ高精度なオープンボキャブラリーのエンドツーエンド物体検出。

    1,393+0直近 7 日のスター増減
  • prismer@NVlabs

    「Prismer: A Vision-Language Model with Multi-Task Experts」の実装

    1,309+0直近 7 日のスター増減
  • Aria@rhymes-ai

    オープンマルチモーダルネイティブMoE「Aria」のコードベース

    1,088+1直近 7 日のスター増減
  • ONE-PEACE@OFA-Sys

    ビジョン、オーディオ、言語モダリティを横断する汎用表現モデル。論文:ONE-PEACE: Exploring One General Representation Model Toward Unlimited Modalities

    1,060+0直近 7 日のスター増減
  • PointLLM@InternRobotics

    [ECCV 2024 Best Paper Candidate & TPAMI 2025] PointLLM: 点群を理解できるように大規模言語モデルを拡張

    1,053+2直近 7 日のスター増減
  • DoRA@NVlabs

    [ICML2024 (Oral)] DoRA: Weight-Decomposed Low-Rank Adaptation の公式 PyTorch 実装

    994+4直近 7 日のスター増減
  • calvin@mees

    長期的なロボット操作タスクのための言語条件付きポリシー学習用ベンチマーク「CALVIN」

    985+10直近 7 日のスター増減
  • groundingLMM@mbzuai-oryx

    [CVPR 2024 🔥] Grounding Large Multimodal Model (GLaMM): オブジェクトセグメンテーションマスクとシームレスに統合された自然言語応答を生成できる、類を見ない最初のモデル

    967+0直近 7 日のスター増減
  • CVPR 2025 の最も注目すべき影響力のある論文のキュレーションコレクション 🔥 [論文 + コード + デモ]

    895+1直近 7 日のスター増減
  • AlphaCLIP@SunzeY

    [CVPR 2024] Alpha-CLIP: 任意の領域に注目できる CLIP モデル

    874+0直近 7 日のスター増減
  • CVPR 2024 の最もエキサイティングで影響力のある論文を厳選したコレクション。🔥 [論文 + コード + デモ]

    735+0直近 7 日のスター増減
  • Matterport3DSimulator@peteanderson80

    実世界のパノラマ画像からの強化学習用AIリサーチプラットフォーム

    713+1直近 7 日のスター増減
  • このリポジトリは、最もエキサイティングで影響力のある CVPR 2023 の論文を厳選したコレクションです。🔥 [論文 + コード]

    649+0直近 7 日のスター増減
  • Proctoring-AI@vardanagarwal

    オンライン試験監視の自動モニタリング用ソフトウェアの作成

    634-1直近 7 日のスター増減
  • Vision-and-Language Navigationに関する厳選されたリソースリスト。ACL 2022の論文「Vision-and-Language Navigation: A Survey of Tasks, Methods, and Future Directions」に関連

    607+3直近 7 日のスター増減
  • ビジョンと言語に関する厳選された優れたリソースのリスト(現在構築中... お楽しみに!)

    564+0直近 7 日のスター増減
  • このリポジトリには、サーベイ論文「A Systematic Survey of Prompt Engineering on Vision-Language Foundation Models」でまとめられた関連論文がリストされています。

    513+0直近 7 日のスター増減
← トピック一覧に戻る