Zum Hauptinhalt springen
buildradar
Sign in
Thema · diffusion-models

diffusion-models

Erfasste Open-Source-Repos mit dem Tag diffusion-models, sortiert nach Sternen.

163 Repos
  • Eine Sammlung von Diffusion-Model-Papieren, kategorisiert nach ihren Teilbereichen

    2.224+0Sterne-Änderung der letzten 7 Tage
  • score_sde_pytorch@yang-song

    PyTorch-Implementierung für Score-Based Generative Modeling durch stochastische Differentialgleichungen (ICLR 2021, Oral)

    2.130+0Sterne-Änderung der letzten 7 Tage
  • Helios@PKU-YuanGroup

    Helios: Ein echtes Echtzeit-Modell zur Generierung langer Videos

    2.129+18Sterne-Änderung der letzten 7 Tage
  • Diffusionsmodelle in der medizinischen Bildgebung (Veröffentlicht im Journal Medical Image Analysis)

    2.110+2Sterne-Änderung der letzten 7 Tage
  • ICEdit@River-Zhang

    [NeurIPS 2025] Bildbearbeitung ist ein einzelnes LoRA wert! 0,1 % Trainingsdaten für fantastische Bildbearbeitung! Übertrifft GPT-4o bei der ID-Persistenz ~ MoE-Checkpoint veröffentlicht! Nur 4 GB VRAM zum Ausführen erforderlich!

    2.104+1Sterne-Änderung der letzten 7 Tage
  • diamond@eloialonso

    DIAMOND (DIffusion As a Model Of eNvironment Dreams) ist ein Reinforcement-Learning-Agent, trainiert in einem Diffusions-Weltmodell. NeurIPS 2024 Spotlight.

    2.100+1Sterne-Änderung der letzten 7 Tage
  • zero123plus@SUDO-AI-3D

    Quellcode-Repository für Zero123++: Ein Basismodell für die Diffusion von einem Einzelbild zu konsistenten Mehransichten.

    2.096+0Sterne-Änderung der letzten 7 Tage
  • Awesome-LM-SSP@CryptoAILab

    Eine Leseliste zur Sicherheit, dem Schutz und der Privatsphäre großer Modelle (einschließlich Awesome LLM Security, Safety usw.).

    2.070+0Sterne-Änderung der letzten 7 Tage
  • custom-diffusion@adobe-research

    Custom Diffusion: Multi-Concept Customization von Text-zu-Bild-Diffusion (CVPR 2023)

    1.977-1Sterne-Änderung der letzten 7 Tage
  • Show-o@showlab

    [ICLR & NeurIPS 2025] Repository für die Show-o-Serie, ein einziger Transformer zur Vereinigung multimodaler Verstehensprozesse und Generierung.

    1.975+1Sterne-Änderung der letzten 7 Tage
  • LlamaGen@FoundationVision

    Autoregressives Modell schlägt Diffusion: 🦙 Llama für skalierbare Bildgenerierung

    1.966+0Sterne-Änderung der letzten 7 Tage
  • onediff@siliconflow

    OneDiff: Eine sofort einsatzbereite Beschleunigungsbibliothek für Diffusionsmodelle.

    1.964+0Sterne-Änderung der letzten 7 Tage
  • Make-It-3D@junshutang

    [ICCV 2023] Make-It-3D: Hochpräzise 3D-Erstellung aus einem einzelnen Bild mit Diffusions-Prior

    1.891+0Sterne-Änderung der letzten 7 Tage
  • dpm-solver@LuChengTHU

    Offizieller Code für „DPM-Solver: A Fast ODE Solver for Diffusion Probabilistic Model Sampling in Around 10 Steps“ (NeurIPS 2022 Oral)

    1.852+0Sterne-Änderung der letzten 7 Tage
  • HunyuanVideo-I2V@Tencent-Hunyuan

    HunyuanVideo-I2V: Ein anpassbares Image-to-Video-Modell basierend auf HunyuanVideo

    1.840+0Sterne-Änderung der letzten 7 Tage
  • CatVTON@Zheng-Chong

    [ICLR 2025] CatVTON ist ein einfaches und effizientes Virtual-Try-On-Diffusionsmodell mit 1) einem leichten Netzwerk (insgesamt 899,06 Mio. Parameter), 2) parametereffizientem Training (49,57 Mio. trainierbare Parameter) und 3) vereinfachter Inferenz (< 8 GB VRAM für eine Auflösung von 1024x768).

    1.831+2Sterne-Änderung der letzten 7 Tage
  • FlashVSR@OpenImagingLab

    [CVPR 2026] Für eine echtzeitbasierte, auf Diffusion basierende Streaming-Video-Super-Resolution — Ein effizientes Ein-Schritt-Diffusions-Framework für Streaming-VSR mit lokalitätsbeschränkter, sparsamer Attention und einem winzigen bedingten Decoder.

    1.815+11Sterne-Änderung der letzten 7 Tage
  • RAG-Survey@hymie122

    Sammlung großartiger RAG-Paper für AIGC. Wir schlagen eine Taxonomie der RAG-Grundlagen, -Erweiterungen und -Anwendungen im Paper „Retrieval-Augmented Generation for AI-Generated Content: A Survey“ vor.

    1.789-1Sterne-Änderung der letzten 7 Tage
  • BrushNet@TencentARC

    [ECCV 2024] Die offizielle Implementierung des Papers „BrushNet: A Plug-and-Play Image Inpainting Model with Decomposed Dual-Branch Diffusion“

    1.744-1Sterne-Änderung der letzten 7 Tage
  • REPA@sihyun-yu

    [ICLR'25 Oral] Repräsentationsausrichtung für die Generierung: Das Training von Diffusion Transformers ist einfacher als gedacht

    1.706+2Sterne-Änderung der letzten 7 Tage
  • ImageReward@zai-org

    [NeurIPS 2023] ImageReward: Lernen und Bewerten menschlicher Präferenzen für Text-zu-Bild-Generierung

    1.703+1Sterne-Änderung der letzten 7 Tage
  • MMaDA@Gen-Verse

    MMaDA – Open-Source multimodale Large Diffusion Language Models (dLLMs mit Block-Diffusion, Mixed-CoT, einheitlichem RL)

    1.671+1Sterne-Änderung der letzten 7 Tage
  • Eine kuratierte Liste von Ressourcen zu Diffusion Models im Bereich RL (laufend aktualisiert)

    1.635+2Sterne-Änderung der letzten 7 Tage
  • fantasy-talking@Fantasy-AMAP

    [ACM MM 2025] FantasyTalking: Realistische Generierung sprechender Porträts über kohärente Bewegungssynthese

    1.628+0Sterne-Änderung der letzten 7 Tage
  • Magic123@guochengqian

    [ICLR'24] Offizielle PyTorch-Implementierung von Magic123: Erstellung hochwertiger 3D-Objekte aus einem einzigen Bild mithilfe von 2D- und 3D-Diffusion-Priors

    1.622-1Sterne-Änderung der letzten 7 Tage
  • MIMO@menyifang

    Offizielle Implementierung von „MIMO: Controllable Character Video Synthesis with Spatial Decomposed Modeling“

    1.579+1Sterne-Änderung der letzten 7 Tage
  • DiffDock@gcorso

    Implementierung von DiffDock: Diffusion Steps, Twists, and Turns for Molecular Docking

    1.570-1Sterne-Änderung der letzten 7 Tage
  • Generative_Deep_Learning_2nd_Edition@davidADSP

    Das offizielle Code-Repository für die zweite Auflage des O'Reilly-Buches Generative Deep Learning: Teaching Machines to Paint, Write, Compose and Play.

    1.553+3Sterne-Änderung der letzten 7 Tage
  • LanPaint@scraed

    Hochwertiges, trainingsfreies Inpainting für jedes Stable Diffusion-Modell. Unterstützt ComfyUI

    1.372+4Sterne-Änderung der letzten 7 Tage
  • TeaCache@ali-vilab

    Timestep Embedding Tells: Zeit für Caching bei Video-Diffusionsmodellen

    1.371+2Sterne-Änderung der letzten 7 Tage
← Zurück zu den Themen