Zum Hauptinhalt springen
buildradar
Sign in
Thema · diffusion

diffusion

Erfasste Open-Source-Repos mit dem Tag diffusion, sortiert nach Sternen.

76 Repos
  • Helios@PKU-YuanGroup

    Helios: Ein echtes Echtzeit-Modell zur Generierung langer Videos

    2.129+18Sterne-Änderung der letzten 7 Tage
  • Diffusionsmodelle in der medizinischen Bildgebung (Veröffentlicht im Journal Medical Image Analysis)

    2.110+2Sterne-Änderung der letzten 7 Tage
  • ICEdit@River-Zhang

    [NeurIPS 2025] Bildbearbeitung ist ein einzelnes LoRA wert! 0,1 % Trainingsdaten für fantastische Bildbearbeitung! Übertrifft GPT-4o bei der ID-Persistenz ~ MoE-Checkpoint veröffentlicht! Nur 4 GB VRAM zum Ausführen erforderlich!

    2.104+1Sterne-Änderung der letzten 7 Tage
  • LlamaGen@FoundationVision

    Autoregressives Modell schlägt Diffusion: 🦙 Llama für skalierbare Bildgenerierung

    1.966+0Sterne-Änderung der letzten 7 Tage
  • BrushNet@TencentARC

    [ECCV 2024] Die offizielle Implementierung des Papers „BrushNet: A Plug-and-Play Image Inpainting Model with Decomposed Dual-Branch Diffusion“

    1.744-1Sterne-Änderung der letzten 7 Tage
  • REPA@sihyun-yu

    [ICLR'25 Oral] Repräsentationsausrichtung für die Generierung: Das Training von Diffusion Transformers ist einfacher als gedacht

    1.706+2Sterne-Änderung der letzten 7 Tage
  • fantasy-talking@Fantasy-AMAP

    [ACM MM 2025] FantasyTalking: Realistische Generierung sprechender Porträts über kohärente Bewegungssynthese

    1.628+0Sterne-Änderung der letzten 7 Tage
  • AngelSlim@Tencent

    Modellkomprimierungs-Toolkit für verbesserte Benutzerfreundlichkeit, Vollständigkeit und Effizienz.

    1.619+58Sterne-Änderung der letzten 7 Tage
  • Pallaidium@tin2tin

    PALLAIDIUM – ein generatives KI-Filmstudio, nahtlos integriert in den Blender Video Editor (VSE), das eine durchgängige Produktion vom Drehbuch bis zum Bildschirm ermöglicht.

    1.523+0Sterne-Änderung der letzten 7 Tage
  • UNO@bytedance

    [ICCV 2025] 🔥🔥 UNO: Eine universelle Anpassungsmethode für die Konditionierung auf einzelne und mehrere Subjekte

    1.362+0Sterne-Änderung der letzten 7 Tage
  • finetrainers@huggingface

    Skalierbares und speicheroptimiertes Training von Diffusionsmodellen

    1.359+0Sterne-Änderung der letzten 7 Tage
  • Inpaint Anything-Erweiterung führt Stable-Diffusion-Inpainting in einer Browser-UI mit Masken von Segment Anything aus

    1.298+0Sterne-Änderung der letzten 7 Tage
  • tango@declare-lab

    Eine Familie von Diffusionsmodellen zur Generierung von Text zu Audio.

    1.238-1Sterne-Änderung der letzten 7 Tage
  • MixGRPO@Tencent-Hunyuan

    [ECCV 2026] MixGRPO: Erschließung der Flow-basierten GRPO-Effizienz mit Mixed ODE-SDE

    1.177+0Sterne-Änderung der letzten 7 Tage
  • mlx-serve@ddalcu

    Nativer LLM-Inferenzserver für Apple Silicon. Kompatibel mit der OpenAI- und Anthropic-API. Kein Python. Inklusive MLX Core macOS-App mit Chat, Agentenmodus und Tool-Aufrufen.

    1.115+245Sterne-Änderung der letzten 7 Tage
  • dial-mpc@LeCAR-Lab

    Offizielle Implementierung für das Paper „Full-Order Sampling-Based MPC for Torque-Level Locomotion Control via Diffusion-Style Annealing“. DIAL-MPC ist ein neuartiges, auf Sampling basierendes MPC-Framework für die Drehmoment-Ebene-Steuerung von Laufrobotern, das Präzision und Agilität trainingsfrei vereint.

    997+1Sterne-Änderung der letzten 7 Tage
  • Liste des molekularen und materiellen Designs unter Verwendung von Generative AI und Deep Learning

    952+1Sterne-Änderung der letzten 7 Tage
  • Causal-Forcing@thu-ml

    [ICML 2026] Offizielle Codebasis für „Causal Forcing: Autoregressive Diffusion Distillation Done Right for High-Quality Real-Time Interactive Video Generation“ & Causal Forcing++

    948+10Sterne-Änderung der letzten 7 Tage
  • FireRedTTS@FireRedTeam

    Ein Open-Source-LLM-basiertes TTS-Fundamentalsystem

    921+2Sterne-Änderung der letzten 7 Tage
  • UniWorld@PKU-YuanGroup

    UniWorld: Hochauflösende semantische Encoder für einheitliches visuelles Verstehen und Generieren

    890+0Sterne-Änderung der letzten 7 Tage
  • ConsisID@PKU-YuanGroup

    [CVPR 2025 Highlight🔥] Identitätserhaltende Text-zu-Video-Generierung durch Frequenzzerlegung

    856+1Sterne-Änderung der letzten 7 Tage
  • LION@nv-tlabs

    Latente Punkt-Diffusionsmodelle zur Erstellung von 3D-Formen

    835+0Sterne-Änderung der letzten 7 Tage
  • Offizielle Implementierung für „RIFLEx: A Free Lunch for Length Extrapolation in Video Diffusion Transformers“ (ICML 2025), UltraViCo (ICLR 2026) und UltraImage

    827+2Sterne-Änderung der letzten 7 Tage
  • Adan@sail-sg

    Adan: Adaptiver Nesterov-Momentum-Algorithmus für eine schnellere Optimierung von Deep-Modellen

    822+0Sterne-Änderung der letzten 7 Tage
  • kandinsky-5@kandinskylab

    Kandinsky 5.0: Eine Familie von Diffusionsmodellen für die Video- und Bildgenerierung

    820+3Sterne-Änderung der letzten 7 Tage
  • [TMLR 2025🔥] Eine Übersicht über autoregressive Modelle in der Vision.

    808+1Sterne-Änderung der letzten 7 Tage
  • daam@castorini

    Diffusion-Attentive-Attribution-Karten zur Interpretation von Stable Diffusion.

    802+0Sterne-Änderung der letzten 7 Tage
  • rcm@NVlabs

    rCM & Causal-rCM: Führende und einheitliche Algorithmen/Infrastrukturen für die bidirektionale/autoregressive Video-Diffusion-Destillation im großen Maßstab.

    800+6Sterne-Änderung der letzten 7 Tage
  • smalldiffusion@yuanchenyang

    Einfacher und lesbarer Code zum Trainieren und Sampling von Diffusionsmodellen

    785+2Sterne-Änderung der letzten 7 Tage
  • FRESCO@williamyang1991

    [CVPR 2024] FRESCO: Räumlich-zeitliche Korrespondenz für Zero-Shot Videoübersetzung

    782-1Sterne-Änderung der letzten 7 Tage
← Zurück zu den Themen