diffusion-models
Các kho mã nguồn mở đang theo dõi được gắn thẻ diffusion-models, sắp xếp theo số sao.
- #91
Tổng hợp về xử lý ảnh dựa trên khuếch tán, bao gồm phục hồi, tăng cường, mã hóa và đánh giá chất lượng
★ 954-1Thay đổi số sao trong 7 ngày qua - #92
[ECCV 2026] Skyfall-GS: Tổng hợp cảnh đô thị 3D sống động từ hình ảnh vệ tinh
★ 953+4Thay đổi số sao trong 7 ngày qua - #93★ 949+56Thay đổi số sao trong 7 ngày qua
- #94
Mã nguồn chính thức cho [ICML 2026] "Causal Forcing: Autoregressive Diffusion Distillation Done Right for High-Quality Real-Time Interactive Video Generation" & Causal Forcing++
★ 948+9Thay đổi số sao trong 7 ngày qua - #95
Triển khai chính thức của PyTorch cho ODISE: Phân đoạn toàn cảnh mở với mô hình khuếch tán văn bản thành hình ảnh [CVPR 2023 Highlight]
★ 943+0Thay đổi số sao trong 7 ngày qua - #96
Tóm tắt các bài báo và blog chính về diffusion models để tìm hiểu về chủ đề này. Danh sách chi tiết tất cả các bài báo nghiên cứu về diffusion robotics đã được xuất bản.
★ 920+1Thay đổi số sao trong 7 ngày qua - #97
MindSpore + 🤗Huggingface: Chạy bất kỳ mô hình Transformers/Diffusers nào trên MindSpore với độ tương thích mượt mà và tăng tốc.
★ 920+0Thay đổi số sao trong 7 ngày qua - #98
Ứng dụng trưng bày nhiều pipeline mô hình diffusion thời gian thực với Diffusers
★ 916+0Thay đổi số sao trong 7 ngày qua - #99★ 874+1Thay đổi số sao trong 7 ngày qua
- #100
Triển khai chính thức của bài báo "MiniGPT-5: Interleaved Vision-and-Language Generation via Generative Vokens"
★ 869+0Thay đổi số sao trong 7 ngày qua - #101
Cơ sở mã hợp nhất cho các mô hình thế giới nâng cao.
★ 866+1Thay đổi số sao trong 7 ngày qua - #102
Tích hợp Gaussian Splatting vào Diffusion Denoiser để tạo và tái tạo hình ảnh 3D từ một ảnh đơn lẻ nhanh chóng và có khả năng mở rộng (ICCV 2025).
★ 861-2Thay đổi số sao trong 7 ngày qua - #103
[CVPR 2025 Highlight🔥] Tạo video từ văn bản bảo toàn danh tính bằng phân tách tần số
★ 856+1Thay đổi số sao trong 7 ngày qua - #104
Instruct-NeRF2NeRF: Chỉnh sửa cảnh 3D thông qua hướng dẫn (ICCV 2023)
★ 852+0Thay đổi số sao trong 7 ngày qua - #105
Danh sách các bài báo liên quan đến lượng tử hóa mạng thần kinh tại các hội nghị và tạp chí AI gần đây.
★ 851+5Thay đổi số sao trong 7 ngày qua - #106
[ICLR'23] DiffuSeq: Tạo văn bản từ chuỗi sang chuỗi với các mô hình khuếch tán (Diffusion Models)
★ 838+0Thay đổi số sao trong 7 ngày qua - #107
Triển khai chính thức của "MeshDiffusion: Score-based Generative 3D Mesh Modeling" (ICLR 2023 Spotlight).
★ 832+0Thay đổi số sao trong 7 ngày qua - #108
[CVPR 2024] GaussianDreamer: Tạo nhanh mô hình 3D Gaussians từ văn bản bằng cách kết nối các mô hình khuếch tán 2D và 3D.
★ 829-1Thay đổi số sao trong 7 ngày qua - #109
Triển khai chính thức cho "RIFLEx: A Free Lunch for Length Extrapolation in Video Diffusion Transformers" (ICML 2025), UltraViCo (ICLR 2026) và UltraImage
★ 827+0Thay đổi số sao trong 7 ngày qua - #110
Danh sách tổng hợp các bài báo về 3D Vision trong lĩnh vực Robotics thời đại mô hình lớn (LLMs/VLMs), lấy cảm hứng từ awesome-computer-vision, bao gồm bài báo, mã nguồn và các trang web liên quan
★ 820+1Thay đổi số sao trong 7 ngày qua - #111
[ICLR 2024] Kiểm soát các mô hình ngôn ngữ thị giác (Vision-Language Models) để phục hồi hình ảnh phổ quát. Đạt giải 5 trong thử thách NTIRE 2024 Restore Any Image Model in the Wild.
★ 817+1Thay đổi số sao trong 7 ngày qua - #112
[CVPR 2024] Paint3D: Paint Anything 3D với các mô hình khuếch tán kết cấu không ánh sáng, một mô hình tạo kết cấu không tích hợp ánh sáng.
★ 808-1Thay đổi số sao trong 7 ngày qua - #113
DeepInverse: thư viện PyTorch dùng deep learning để giải quyết các bài toán nghịch đảo trong xử lý ảnh.
★ 802+5Thay đổi số sao trong 7 ngày qua - #114
Áp dụng các mô hình khuếch tán sử dụng gói diffusers mới của Hugging Face để tổng hợp âm nhạc thay vì hình ảnh.
★ 795+1Thay đổi số sao trong 7 ngày qua - #115
Mã nguồn đơn giản và dễ đọc để huấn luyện và lấy mẫu từ các mô hình khuếch tán (diffusion models).
★ 785+0Thay đổi số sao trong 7 ngày qua - #116
Bộ sưu tập các nghiên cứu tuyệt vời về tạo video.
★ 782+0Thay đổi số sao trong 7 ngày qua - #117
Hợp nhất mô hình trong LLM, MLLM và hơn thế nữa: Phương pháp, lý thuyết, ứng dụng và cơ hội. ACM Computing Surveys, 2026.
★ 779+2Thay đổi số sao trong 7 ngày qua - #118
[ICML 2024] MagicPose (còn gọi là MagicDance): Tái tạo tư thế người và biểu cảm khuôn mặt chân thực với Diffusion nhận diện danh tính
★ 776+0Thay đổi số sao trong 7 ngày qua - #119★ 775+0Thay đổi số sao trong 7 ngày qua
- #120
Triển khai chính thức cho "Attend-and-Excite: Attention-Based Semantic Guidance for Text-to-Image Diffusion Models" (SIGGRAPH 2023)
★ 770+0Thay đổi số sao trong 7 ngày qua