メインコンテンツへスキップ
buildradar
Sign in
トピック · diffusion-models

diffusion-models

diffusion-models がタグ付けされた追跡中のオープンソースリポジトリを、スター数順に表示します。

163 件のリポジトリ
  • finetrainers@huggingface

    拡散モデルのスケーラブルかつメモリ最適化されたトレーニング

    1,359+1直近 7 日のスター増減
  • Matcha-TTS@shivammehta25

    [ICASSP 2024] 🍵 Matcha-TTS: 条件付きフローマッチングを用いた高速なTTSアーキテクチャ

    1,353+4直近 7 日のスター増減
  • DDNM@wyhuai

    [ICLR 2023 Oral] Denoising Diffusion Null-Space Model を使用したゼロショット画像復元

    1,351+2直近 7 日のスター増減
  • FireRed-Image-Edit@FireRedTeam

    FireRed-Image-Editは、正確な指示追従、高忠実度の生成、優れたアイデンティティの一貫性、シームレスなマルチ要素融合により、オープンソースの最先端パフォーマンスを実現する強力な画像編集基盤モデルです。

    1,350+6直近 7 日のスター増減
  • IMAGDressing@muzishen

    [AAAI 2025] 👔IMAGDressing👔:バーチャル試着のためのインタラクティブなモジュール型アパレル生成。柔軟な衣服、ポーズ、シーン制御によりカスタマイズ可能な人物画像生成を可能にし、バーチャル試着における高い忠実度と衣服の一貫性を保証します。

    1,343+0直近 7 日のスター増減
  • MagicTime@PKU-YuanGroup

    [TPAMI 2025🔥] MagicTime: 変態シミュレータとしてのタイムラプス動画生成モデル

    1,337-1直近 7 日のスター増減
  • Hunyuan3D-2-WinPortable@YanWenKun

    WindowsでHunyuan3D 2.0/2.1を実行するためのポータブルパッケージ。| 混元 3D 2.0/2.1 整合包

    1,326+5直近 7 日のスター増減
  • pruna@PrunaAI

    Prunaは開発者向けに構築されたモデル最適化フレームワークであり、最小限のオーバーヘッドでより高速かつ効率的なモデルを提供できるようにします。

    1,274+2直近 7 日のスター増減
  • Difix3D@nv-tlabs

    [CVPR 2025 Oral & Best Paper Finalist] Difix3D+: 単一ステップ Diffusion Model による 3D 再構築の改善

    1,267+0直近 7 日のスター増減
  • DragDiffusion@Yujun-Shi

    [CVPR2024, Highlight] DragDiffusion の公式コード

    1,259+0直近 7 日のスター増減
  • tango@declare-lab

    テキストからオーディオを生成する拡散モデルのファミリ。

    1,238-1直近 7 日のスター増減
  • Irodori-TTS@Aratako

    絵文字駆動型スタイル制御を備えたFlow Matchingベースの音声合成モデル

    1,228+8直近 7 日のスター増減
  • HunyuanCustom@Tencent-Hunyuan

    HunyuanCustom: カスタム動画生成のためのマルチモーダル駆動型アーキテクチャ

    1,228+1直近 7 日のスター増減
  • MeanFlow@haidog-yaqub

    MeanFlow & iMF(ワンステップ生成モデリング)のPyTorch実装。

    1,196+0直近 7 日のスター増減
  • wunjo.wladradchenko.ru@wladradchenko

    Wunjo CE:顔の差し替え、リップシンク、オブジェクト・テキスト・背景の削除、スタイル変更、音源分離、音声クローン、動画生成。オープンソース、ローカル実行可能、無料。

    1,170+1直近 7 日のスター増減
  • MagicDrive@cure-lab

    [ICLR24] 論文「MagicDrive: Street View Generation with Diverse 3D Geometry Control」の公式実装

    1,167+1直近 7 日のスター増減
  • テキストフロンティア画像拡散モデルによる制御可能な生成に関するリソースのコレクション

    1,110+0直近 7 日のスター増減
  • MOVA@OpenMOSS

    MOVA: スケーラブルで同期されたビデオ・オーディオ生成に向けて

    1,108+4直近 7 日のスター増減
  • pytorch-stable-diffusion@hkproj

    PyTorch でスクラッチから実装された Stable Diffusion

    1,078-1直近 7 日のスター増減
  • VisCPM@OpenBMB

    [ICLR'24 spotlight] 中国語と英語のマルチモーダル大規模モデルシリーズ(チャットおよびペイント)| CPM基盤モデルに基づく中英バイリンガルマルチモーダル大モデルシリーズ

    1,061+0直近 7 日のスター増減
  • MotionDirector@showlab

    [ECCV 2024 Oral] MotionDirector: Text-to-Video Diffusionモデルのモーションカスタマイズ。

    1,053+3直近 7 日のスター増減
  • Diffusion-Planner@ZhengYinan-AIR

    [ICLR 2025 Oral] 「Diffusion-Based Planning for Autonomous Driving with Flexible Guidance」の公式実装

    1,050+5直近 7 日のスター増減
  • 3DTopia-XL@3DTopia

    [CVPR 2025 Highlight] 3DTopia-XL: プリミティブ拡散による高品質3D PBRアセット生成

    1,046+1直近 7 日のスター増減
  • SyncDreamer@liuyuan-pal

    [ICLR 2024 Spotlight] SyncDreamer: 単一ビュー画像からマルチビュー整合性のある画像を生成する

    1,044+0直近 7 日のスター増減
  • FlowEdit@fallenshock

    論文の公式実装:「FlowEdit: Inversion-Free Text-Based Editing Using Pre-Trained Flow Models」

    1,013-1直近 7 日のスター増減
  • FastGen@NVlabs

    NVIDIA FastGen: 拡散モデルからの高速生成

    986+24直近 7 日のスター増減
  • PIA@open-mmlab

    [CVPR 2024] PIA、パーソナライズされた画像アニメーター。テキストプロンプトで画像をアニメーション化し、Dreamboothと組み合わせることで素晴らしい動画を実現します。

    975+0直近 7 日のスター増減
  • DeepCache@horseee

    [CVPR 2024] DeepCache: Diffusion Models を無料で高速化

    970+0直近 7 日のスター増減
  • diffae@konpatp

    Diffusion Autoencodersの公式実装

    969+0直近 7 日のスター増減
  • story-iter@UCSC-VLAA

    [ICLR 2026] 長編ストーリーの視覚化に向けたトレーニング不要の反復型フレームワーク。

    959+1直近 7 日のスター増減
← トピック一覧に戻る