diffusion-models
Các kho mã nguồn mở đang theo dõi được gắn thẻ diffusion-models, sắp xếp theo số sao.
- #31
Bộ sưu tập các bài báo về mô hình khuếch tán được phân loại theo các tiểu vùng của chúng.
★ 2.224+0Thay đổi số sao trong 7 ngày qua - #32
Triển khai PyTorch cho Mô hình tạo sinh dựa trên điểm thông qua Phương trình vi phân ngẫu nhiên (ICLR 2021, Oral)
★ 2.130+0Thay đổi số sao trong 7 ngày qua - #33★ 2.129+18Thay đổi số sao trong 7 ngày qua
- #34
Mô hình khuếch tán trong chẩn đoán hình ảnh y tế (Được xuất bản trên tạp chí Medical Image Analysis)
★ 2.110+2Thay đổi số sao trong 7 ngày qua - #35
[NeurIPS 2025] Chỉnh sửa ảnh chỉ đáng giá một LoRA duy nhất! 0.1% dữ liệu huấn luyện cho việc chỉnh sửa ảnh tuyệt vời! Vượt qua GPT-4o về độ duy trì ID~ Đã phát hành MoE ckpt! Chỉ cần 4GB VRAM để chạy!
★ 2.104+1Thay đổi số sao trong 7 ngày qua - #36
DIAMOND (DIffusion As a Model Of eNvironment Dreams) là một tác nhân học tăng cường được huấn luyện dựa trên mô hình thế giới khuếch tán. NeurIPS 2024 Spotlight.
★ 2.100+1Thay đổi số sao trong 7 ngày qua - #37
Kho lưu trữ mã nguồn cho Zero123++: Mô hình cơ sở Diffusion từ một ảnh đơn sang nhiều góc nhìn nhất quán.
★ 2.096+0Thay đổi số sao trong 7 ngày qua - #38
Danh sách tài liệu đọc về tính an toàn, bảo mật và quyền riêng tư của mô hình lớn (bao gồm Awesome LLM Security, Safety, v.v.).
★ 2.070+0Thay đổi số sao trong 7 ngày qua - #39
Custom Diffusion: Tùy chỉnh đa khái niệm cho mô hình khuếch tán văn bản thành hình ảnh (CVPR 2023)
★ 1.977-1Thay đổi số sao trong 7 ngày qua - #40
[ICLR & NeurIPS 2025] Kho lưu trữ cho dòng Show-o, một Transformer duy nhất hợp nhất việc hiểu và tạo đa phương thức.
★ 1.975+1Thay đổi số sao trong 7 ngày qua - #41★ 1.966+0Thay đổi số sao trong 7 ngày qua
- #42★ 1.964+0Thay đổi số sao trong 7 ngày qua
- #43
[ICCV 2023] Make-It-3D: Tạo 3D độ trung thực cao từ một hình ảnh duy nhất với Diffusion Prior
★ 1.891+0Thay đổi số sao trong 7 ngày qua - #44
Mã nguồn chính thức cho "DPM-Solver: A Fast ODE Solver for Diffusion Probabilistic Model Sampling in Around 10 Steps" (Neurips 2022 Oral)
★ 1.852+0Thay đổi số sao trong 7 ngày qua - #45
HunyuanVideo-I2V: Mô hình chuyển đổi hình ảnh thành video có thể tùy chỉnh dựa trên HunyuanVideo
★ 1.840+0Thay đổi số sao trong 7 ngày qua - #46
[ICLR 2025] CatVTON là một mô hình khuếch tán thử đồ ảo đơn giản và hiệu quả với 1) Mạng nhẹ (tổng cộng 899,06M tham số), 2) Đào tạo hiệu quả về tham số (49,57M tham số có thể đào tạo) và 3) Suy luận đơn giản (< 8G VRAM cho độ phân giải 1024X768).
★ 1.831+2Thay đổi số sao trong 7 ngày qua - #47
[CVPR 2026] Hướng tới siêu phân giải video trực tuyến dựa trên khuếch tán thời gian thực — Khung khuếch tán một bước hiệu quả dành cho VSR trực tuyến với cơ chế chú ý thưa thớt bị giới hạn cục bộ và bộ giải mã có điều kiện nhỏ gọn.
★ 1.815+11Thay đổi số sao trong 7 ngày qua - #48
Tổng hợp các bài báo tuyệt vời về RAG cho AIGC. Chúng tôi đề xuất một phân loại về nền tảng, cải tiến và ứng dụng RAG trong bài báo "Retrieval-Augmented Generation for AI-Generated Content: A Survey".
★ 1.789-1Thay đổi số sao trong 7 ngày qua - #49
[ECCV 2024] Mã nguồn chính thức của bài báo "BrushNet: A Plug-and-Play Image Inpainting Model with Decomposed Dual-Branch Diffusion"
★ 1.744-1Thay đổi số sao trong 7 ngày qua - #50
[ICLR'25 Oral] Căn chỉnh biểu diễn cho việc tạo: Huấn luyện Diffusion Transformers dễ hơn bạn nghĩ
★ 1.706+2Thay đổi số sao trong 7 ngày qua - #51
[NeurIPS 2023] ImageReward: Học và Đánh giá Sở thích của Con người đối với Tạo ảnh từ văn bản
★ 1.703+1Thay đổi số sao trong 7 ngày qua - #52
MMaDA - Mô hình ngôn ngữ khuếch đại lớn đa phương thức mã nguồn mở (dLLM với khuếch đại khối, mixed-CoT, RL thống nhất)
★ 1.671+1Thay đổi số sao trong 7 ngày qua - #53
Danh sách tổng hợp các tài nguyên về Diffusion Model trong RL (được cập nhật liên tục)
★ 1.635+2Thay đổi số sao trong 7 ngày qua - #54
[ACM MM 2025] FantasyTalking: Tạo chân dung nói chuyện chân thực thông qua tổng hợp chuyển động mạch lạc
★ 1.628+0Thay đổi số sao trong 7 ngày qua - #55
[ICLR'24] Mã nguồn triển khai chính thức trên PyTorch của Magic123: Tạo đối tượng 3D chất lượng cao từ một ảnh duy nhất sử dụng tiền nghiệm khuếch tán 2D và 3D
★ 1.622-1Thay đổi số sao trong 7 ngày qua - #56
Bản cài đặt chính thức của "MIMO: Controllable Character Video Synthesis with Spatial Decomposed Modeling"
★ 1.579+1Thay đổi số sao trong 7 ngày qua - #57
Triển khai DiffDock: Các bước khuếch tán, xoắn và chuyển hướng cho Molecular Docking.
★ 1.570-1Thay đổi số sao trong 7 ngày qua - #58
Kho mã nguồn chính thức cho ấn bản thứ hai của cuốn sách O'Reilly: Generative Deep Learning: Teaching Machines to Paint, Write, Compose and Play.
★ 1.553+3Thay đổi số sao trong 7 ngày qua - #59
Inpaint chất lượng cao không cần huấn luyện cho mọi mô hình stable diffusion. Hỗ trợ ComfyUI
★ 1.372+4Thay đổi số sao trong 7 ngày qua - #60★ 1.371+2Thay đổi số sao trong 7 ngày qua