Zum Hauptinhalt springen
buildradar
Sign in
Thema · diffusion-models

diffusion-models

Erfasste Open-Source-Repos mit dem Tag diffusion-models, sortiert nach Sternen.

163 Repos
  • finetrainers@huggingface

    Skalierbares und speicheroptimiertes Training von Diffusionsmodellen

    1.359+0Sterne-Änderung der letzten 7 Tage
  • Matcha-TTS@shivammehta25

    [ICASSP 2024] 🍵 Matcha-TTS: Eine schnelle TTS-Architektur mit Conditional Flow Matching

    1.353+3Sterne-Änderung der letzten 7 Tage
  • DDNM@wyhuai

    [ICLR 2023 Oral] Zero-Shot Image Restoration Using Denoising Diffusion Null-Space Model

    1.351+2Sterne-Änderung der letzten 7 Tage
  • FireRed-Image-Edit@FireRedTeam

    FireRed-Image-Edit ist ein leistungsstarkes Bildbearbeitungs-Grundlagenmodell, das Open-Source-Spitzenleistung mit präziser Befehlsausführung, treuer Generierung, überlegener Identitätskonsistenz und nahtloser Multielement-Fusion erreicht.

    1.350+3Sterne-Änderung der letzten 7 Tage
  • IMAGDressing@muzishen

    [AAAI 2025]👔IMAGDressing👔: Interaktive modulare Bekleidungsgenerierung für die virtuelle Anprobe. Ermöglicht an Anpassbare menschliche Bildgenerierung mit flexibler Kleidungs-, Posen- und Szenensteuerung, die hohe Wiedergabetreue und Kleidungskonsistenz für die virtuelle Anprobe gewährleistet.

    1.343+0Sterne-Änderung der letzten 7 Tage
  • MagicTime@PKU-YuanGroup

    [TPAMI 2025🔥] MagicTime: Zeitraffer-Videogenerierungsmodelle als metamorphe Simulatoren

    1.337-1Sterne-Änderung der letzten 7 Tage
  • Hunyuan3D-2-WinPortable@YanWenKun

    📦 Portables Paket zum Ausführen von Hunyuan3D 2.0/2.1 unter Windows.

    1.326+4Sterne-Änderung der letzten 7 Tage
  • pruna@PrunaAI

    Pruna ist ein für Entwickler entwickeltes Modelloptimierungs-Framework, mit dem Sie schnellere, effizientere Modelle mit minimalem Overhead bereitstellen können.

    1.274+1Sterne-Änderung der letzten 7 Tage
  • Difix3D@nv-tlabs

    [CVPR 2025 Oral & Best Paper Finalist] Difix3D+: Verbesserung von 3D-Rekonstruktionen mit Single-Step-Diffusion-Modellen

    1.267+1Sterne-Änderung der letzten 7 Tage
  • DragDiffusion@Yujun-Shi

    [CVPR2024, Highlight] Offizieller Code für DragDiffusion

    1.259+0Sterne-Änderung der letzten 7 Tage
  • tango@declare-lab

    Eine Familie von Diffusionsmodellen zur Generierung von Text zu Audio.

    1.238-1Sterne-Änderung der letzten 7 Tage
  • HunyuanCustom@Tencent-Hunyuan

    HunyuanCustom: Eine multimodal gesteuerte Architektur zur personalisierten Videogenerierung

    1.228-1Sterne-Änderung der letzten 7 Tage
  • Irodori-TTS@Aratako

    Ein Flow Matching-basiertes Text-to-Speech-Modell mit Emoji-gesteuerter Stilkontrolle

    1.228+4Sterne-Änderung der letzten 7 Tage
  • MeanFlow@haidog-yaqub

    PyTorch-Implementierung von MeanFlow & iMF (One-Step Generative Modeling).

    1.196-1Sterne-Änderung der letzten 7 Tage
  • wunjo.wladradchenko.ru@wladradchenko

    Wunjo CE: Gesichtstausch, Lippensynchronisation, Entfernen von Steuerelementen, Objekten, Text und Hintergrund, Restyling, Audio-Trenner, Stimmklonung, Videogenerierung. Open Source, lokal & kostenlos.

    1.170+1Sterne-Änderung der letzten 7 Tage
  • MagicDrive@cure-lab

    [ICLR24] Offizielle Implementierung des Papiers „MagicDrive: Street View Generation with Diverse 3D Geometry Control“

    1.167+1Sterne-Änderung der letzten 7 Tage
  • Eine Sammlung von Ressourcen zur steuerbaren Generierung mit Text-to-Image-Diffusion-Modellen.

    1.110+0Sterne-Änderung der letzten 7 Tage
  • MOVA@OpenMOSS

    MOVA: Auf dem Weg zu skalierbarer und synchronisierter Video-Audio-Generierung

    1.110+3Sterne-Änderung der letzten 7 Tage
  • pytorch-stable-diffusion@hkproj

    Stable Diffusion von Grund auf in PyTorch implementiert

    1.078+0Sterne-Änderung der letzten 7 Tage
  • VisCPM@OpenBMB

    [ICLR'24 Spotlight] Chinesische und englische multimodale Large-Model-Serie (Chat and Paint) | Basiert auf dem CPM-Basismodell für multimodale chinesisch-englische Großmodelle

    1.061-1Sterne-Änderung der letzten 7 Tage
  • MotionDirector@showlab

    [ECCV 2024 Oral] MotionDirector: Bewegungskonibierung von Text-zu-Video-Diffusion-Modellen.

    1.053+2Sterne-Änderung der letzten 7 Tage
  • Diffusion-Planner@ZhengYinan-AIR

    [ICLR 2025 Oral] Die offizielle Implementierung von „Diffusion-Based Planning for Autonomous Driving with Flexible Guidance“

    1.053+4Sterne-Änderung der letzten 7 Tage
  • 3DTopia-XL@3DTopia

    [CVPR 2025 Highlight] 3DTopia-XL: Hochwertige 3D-PBR-Asset-Generierung mittels Primitive Diffusion

    1.046+0Sterne-Änderung der letzten 7 Tage
  • SyncDreamer@liuyuan-pal

    [ICLR 2024 Spotlight] SyncDreamer: Generierung multiview-konsistenter Bilder aus einem Einzelbild

    1.044-1Sterne-Änderung der letzten 7 Tage
  • FlowEdit@fallenshock

    Offizielle Implementierung des Papers: „FlowEdit: Inversion-Free Text-Based Editing Using Pre-Trained Flow Models“

    1.014-1Sterne-Änderung der letzten 7 Tage
  • FastGen@NVlabs

    NVIDIA FastGen: Schnelle Generierung aus Diffusionsmodellen

    990+22Sterne-Änderung der letzten 7 Tage
  • PIA@open-mmlab

    [CVPR 2024] PIA, Ihr personalisierter Bild-Animator. Animieren Sie Ihre Bilder durch Text-Prompts in Kombination mit DreamBooth, um atemberaubende Videos zu erstellen.

    975+0Sterne-Änderung der letzten 7 Tage
  • DeepCache@horseee

    [CVPR 2024] DeepCache: Beschleunigung von Diffusionsmodellen zum Nulltarif

    970-1Sterne-Änderung der letzten 7 Tage
  • diffae@konpatp

    Offizielle Implementierung von Diffusion Autoencoders

    969+0Sterne-Änderung der letzten 7 Tage
  • verl-omni@verl-project

    Multimodales RL-Trainingsframework für Diffusions- und Omni-Modelle

    959+60Sterne-Änderung der letzten 7 Tage
← Zurück zu den Themen