メインコンテンツへスキップ
buildradar
Sign in
トピック · diffusion-models

diffusion-models

diffusion-models がタグ付けされた追跡中のオープンソースリポジトリを、スター数順に表示します。

163 件のリポジトリ
  • story-iter@UCSC-VLAA

    [ICLR 2026] 長編ストーリーの視覚化に向けたトレーニング不要の反復型フレームワーク。

    957-2直近 7 日のスター増減
  • Skyfall-GS@jayin92

    [ECCV 2026] Skyfall-GS: 衛星画像から没入型の 3D 都市シーンを合成する

    955+6直近 7 日のスター増減
  • 拡散モデル(Diffusion)ベースの画像処理(修復、拡張、符号化、品質評価など)に関するまとめ

    954-1直近 7 日のスター増減
  • Causal-Forcing@thu-ml

    [ICML 2026] 「Causal Forcing: Autoregressive Diffusion Distillation Done Right for High-Quality Real-Time Interactive Video Generation」および Causal Forcing++ の公式コードベース

    950+12直近 7 日のスター増減
  • ODISE@NVlabs

    ODISEの公式PyTorch実装:テキスト-画像拡散モデルを用いたオープン語彙パノプティックセグメンテーション [CVPR 2023 Highlight]

    943+0直近 7 日のスター増減
  • 拡散モデルに関する主要な論文やブログのまとめ。公開されているすべての拡散ロボティクス論文の詳細リスト。

    920+1直近 7 日のスター増減
  • MindAct@candle-org

    MindSpore + 🤗Huggingface:シームレスな互換性と高速化により、MindSpore上で任意のTransformers/Diffusersモデルを実行

    920+0直近 7 日のスター増減
  • Diffusers を使用した複数のリアルタイム拡散モデルパイプラインを紹介するアプリ

    916-1直近 7 日のスター増減
  • UniPic@SkyworkAI

    オープンソースのSOTAマルチ画像編集モデル

    874+1直近 7 日のスター増減
  • MiniGPT-5@UCSB-AI

    論文「MiniGPT-5: Interleaved Vision-and-Language Generation via Generative Vokens」の公式実装。

    869+0直近 7 日のスター増減
  • OpenWorldLib@OpenDCAI

    高度なワールドモデルのための統合コードベース。

    866+2直近 7 日のスター増減
  • Open-DiffusionGS@caiyuanhao1998

    高速かつスケーラブルな単段階のImage-to-3D生成・再構築に向けた、Diffusion DenoiserへのGaussian Splattingの組み込み (ICCV 2025)

    861+1直近 7 日のスター増減
  • ConsisID@PKU-YuanGroup

    [CVPR 2025 Highlight🔥] 周波数分解によるアイデンティティ保持型テキスト動画生成手法

    857+2直近 7 日のスター増減
  • instruct-nerf2nerf@ayaanzhaque

    Instruct-NeRF2NeRF: 指示による 3D シーンの編集 (ICCV 2023)

    852-1直近 7 日のスター増減
  • 近年のAI関連の学会やジャーナルにおけるニューラルネットワークの量子化に関する論文リスト

    851+6直近 7 日のスター増減
  • DiffuSeq@Shark-NLP

    [ICLR'23] DiffuSeq: 拡散モデルを用いた配列対配列のテキスト生成

    838+0直近 7 日のスター増減
  • MeshDiffusion@lzzcd001

    「MeshDiffusion: Score-based Generative 3D Mesh Modeling」(ICLR 2023 Spotlight)の公式実装

    832+0直近 7 日のスター増減
  • GaussianDreamer@hustvl

    [CVPR 2024] GaussianDreamer: 2Dと3Dの拡散モデルをブリッジすることでテキストから3D Gaussianへ高速生成する手法

    829-1直近 7 日のスター増減
  • 「RIFLEx: A Free Lunch for Length Extrapolation in Video Diffusion Transformers」(ICML 2025)、UltraViCo(ICLR 2026)、および UltraImage の公式実装

    827+2直近 7 日のスター増減
  • 大規模モデル(LLM/VLM)時代におけるロボット工学分野に関連する3Dビジョン論文の厳選リスト。awesome-computer-visionにインスパイアされ、論文、コード、関連ウェブサイトを含む。

    822+2直近 7 日のスター増減
  • daclip-uir@Algolzw

    [ICLR 2024] 汎用画像復元の為の Vision-Language Model の制御。NTIRE 2024 Restore Any Image Model in the Wild Challenge にて 5 位入賞。

    817+1直近 7 日のスター増減
  • Paint3D@OpenTexture

    [CVPR 2024] Paint3D: ライティングのないテクスチャ拡散モデルによる3Dペイントツール、ライティングをベイクしないテクスチャ生成モデル

    808-1直近 7 日のスター増減
  • deepinv@deepinv

    DeepInverse: ディープラーニングを用いた画像逆問題の解決のための PyTorch ライブラリ

    802+6直近 7 日のスター増減
  • audio-diffusion@teticio

    画像ではなく音楽を合成するために、新しい Hugging Face diffusers パッケージを使用して拡散モデルを適用する

    795+1直近 7 日のスター増減
  • smalldiffusion@yuanchenyang

    拡散モデルのトレーニングとサンプリングのための、シンプルで読みやすいコード

    785+2直近 7 日のスター増減
  • 動画生成に関する素晴らしい研究のコレクション。

    783+0直近 7 日のスター増減
  • LLM、MLLM、およびその先のモデルマージ:手法、理論、応用、そして展望。ACM Computing Surveys、2026年。

    780+1直近 7 日のスター増減
  • MagicDance@Boese0601

    [ICML 2024] MagicPose (MagicDance としても知られる): アイデンティティを考慮した Diffusion によるリアルな人物のポーズと表情の再ターゲット

    777+0直近 7 日のスター増減
  • dift@Tsingularity

    [NeurIPS'23] 画像拡散からの創発的対応関係

    775+0直近 7 日のスター増減
  • Attend-and-Excite@yuval-alaluf

    「Attend-and-Excite: Attention-Based Semantic Guidance for Text-to-Image Diffusion Models」の公式実装 (SIGGRAPH 2023)

    770+0直近 7 日のスター増減
← トピック一覧に戻る