Zum Hauptinhalt springen
buildradar
Sign in
Thema · diffusion-models

diffusion-models

Erfasste Open-Source-Repos mit dem Tag diffusion-models, sortiert nach Sternen.

163 Repos
  • MOFA-Video@MyNiuuu

    [ECCV 2024] MOFA-Video: Steuerung der Bildanimation durch generative Bewegungsfeldadaptionen in einem eingefrorenen Image-to-Video-Diffusionsmodell.

    766+0Sterne-Änderung der letzten 7 Tage
  • Eine Sammlung fantastischer Studien zur Text-zu-Bild-Generierung.

    765+0Sterne-Änderung der letzten 7 Tage
  • PMRF@ohayonguy

    [ICLR 2025] Offizielle Implementierung von Posterior-Mean Rectified Flow: Hin zu fotorealistischer Bildwiederherstellung mit minimalem MSE

    754+0Sterne-Änderung der letzten 7 Tage
  • MagicDrive-V2@flymin

    [ICCV 2025] Offizielle Implementierung des Papiers „MagicDrive-V2: High-Resolution Long Video Generation for Autonomous Driving with Adaptive Control“

    729+1Sterne-Änderung der letzten 7 Tage
  • distrifuser@mit-han-lab

    [CVPR 2024 Highlight] DistriFusion: Verteilte parallele Inferenz für hochauflösende Diffusion Models

    728+0Sterne-Änderung der letzten 7 Tage
  • nano-world-model@simchowitzlabpublic

    Ein minimalistisches, funktionsreiches Repository zur Förderung der World-Model-Forschung.

    725+6Sterne-Änderung der letzten 7 Tage
  • DL4Proteins-notebooks@Graylab

    Colab Notebooks zu Deep-Learning-Werkzeugen für die Vorhersage und das Design biomolekularer Strukturen

    724+1Sterne-Änderung der letzten 7 Tage
  • Bildrestaurierung mit Mean-Reverting Stochastic Differential Equations, ICML 2023. Die Siegerlösung der NTIRE 2023 Image Shadow Removal Challenge.

    722+0Sterne-Änderung der letzten 7 Tage
  • mdlm@kuleshov-group

    [NeurIPS 2024] Einfaches und effektives Masked Diffusion Language Model

    711+2Sterne-Änderung der letzten 7 Tage
  • [ICML 2025] Offizielle PyTorch-Implementierung von „History-Guided Video Diffusion“

    709+1Sterne-Änderung der letzten 7 Tage
  • Eine kuratierte Liste fantastischer Video-Weltmodelle mit AR-Diffusion: Umfasst Algorithmen, Anwendungen und Infrastruktur als umfassende Ressource für Forscher, Praktiker und Enthusiasten.

    701+5Sterne-Änderung der letzten 7 Tage
  • CRM@thu-ml

    [ECCV 2024] Einzelbild zu 3D-texturiertem Mesh in 10 Sekunden mit Convolutional Reconstruction Model.

    696+0Sterne-Änderung der letzten 7 Tage
  • Flow-Factory@X-GenGroup

    Ein einheitliches Framework für einfaches Reinforcement Learning in Flow-Matching-Modellen

    690+7Sterne-Änderung der letzten 7 Tage
  • Eine Sammlung von Papers und Code für CVPR2026/CVPR2025/ICCV2025/CVPR2024/ECCV2026/ECCV2024 AIGC

    677+1Sterne-Änderung der letzten 7 Tage
  • HunyuanImage-2.1@Tencent-Hunyuan

    HunyuanImage-2.1: Ein effizientes Diffusionsmodell für hochauflösende (2K) Text-zu-Bild-Generierung

    675+0Sterne-Änderung der letzten 7 Tage
  • Make-An-Audio@Text-to-Audio

    PyTorch-Implementierung von Make-An-Audio (ICML'23) mit einem Text-to-Audio Generative Model

    668+0Sterne-Änderung der letzten 7 Tage
  • OneDiffusion@lehduong

    Offizielle Implementierung des OneDiffusion-Papers (CVPR 2025)

    665+0Sterne-Änderung der letzten 7 Tage
  • FoleyCrafter@open-mmlab

    [IJCV 2026] FoleyCrafter: Erwecken Sie stumme Videos mit lebensechten und synchronisierten Klängen zum Leben

    663+0Sterne-Änderung der letzten 7 Tage
  • flash-diffusion@gojasper

    Flash Diffusion – Beschleunigung bedingter Diffusionsmodelle (AAAI 2025 Oral)

    663+1Sterne-Änderung der letzten 7 Tage
  • NOVA@baaivision

    [ICLR 2025] Autoregressive Videogenerierung ohne Vektorquantisierung.

    660-1Sterne-Änderung der letzten 7 Tage
  • DFloat11@LeanModels

    DFloat11 [NeurIPS '25]: Verlustfreie Komprimierung von LLMs und DiTs für effiziente GPU-Inferenz

    654-1Sterne-Änderung der letzten 7 Tage
  • Open-dLLM@pengzhangzhi

    Offenes Diffusions-Sprachmodell zur Codeergenerierung — veröffentlicht mit Vortraining, Evaluierung, Inferenz und Checkpoints.

    652+3Sterne-Änderung der letzten 7 Tage
  • blended-latent-diffusion@omriav

    Offizielle Implementierung für „Blended Latent Diffusion“ [SIGGRAPH 2023]

    632+0Sterne-Änderung der letzten 7 Tage
  • OpenMusic@ivcylc

    OpenMusic: SOTA Text-to-Music (TTM) Generierung

    631+1Sterne-Änderung der letzten 7 Tage
  • Ditto@EzioBy

    [CVPR'26 Highlight] Ditto: Skalierung der anweisungsbasierten Videobearbeitung mit einem hochwertigen synthetischen Datensatz

    626+2Sterne-Änderung der letzten 7 Tage
  • radial-attention@mit-han-lab

    [NeurIPS 2025] Radial Attention: O(nlogn) Sparse Attention mit Energy Decay für die Generierung langer Videos

    607-1Sterne-Änderung der letzten 7 Tage
  • BrushEdit@TencentARC

    [TPAMI] Die offizielle Implementierung des Papiers „BrushEdit: All-In-One Image Inpainting and Editing“

    590+0Sterne-Änderung der letzten 7 Tage
  • semantic-draw@ironjr

    Offizieller Code für das CVPR 2025 Paper "SemanticDraw: Towards Real-Time Interactive Content Creation from Image Diffusion Models."

    588-1Sterne-Änderung der letzten 7 Tage
  • VEnhancer@Vchitect

    Offizieller Code von VEnhancer: Generative raumzeitliche Verbesserung für die Videogenerierung.

    579+0Sterne-Änderung der letzten 7 Tage
  • EDGE@Stanford-TML

    Offizielle PyTorch-Implementierung von EDGE (CVPR 2023).

    577+2Sterne-Änderung der letzten 7 Tage
← Zurück zu den Themen