diffusion-models
Các kho mã nguồn mở đang theo dõi được gắn thẻ diffusion-models, sắp xếp theo số sao.
- #121
[ECCV 2024] MOFA-Video: Hoạt ảnh hình ảnh có thể kiểm soát thông qua các thích ứng trường chuyển động tạo sinh trong mô hình Image-to-Video Diffusion đã được đóng băng.
★ 766+0Thay đổi số sao trong 7 ngày qua - #122
Bộ sưu tập các nghiên cứu ấn tượng về tạo ảnh từ văn bản
★ 765+0Thay đổi số sao trong 7 ngày qua - #123
[ICLR 2025] Triển khai chính thức của Posterior-Mean Rectified Flow: Hướng tới khôi phục hình ảnh chân thực với MSE tối thiểu
★ 754+0Thay đổi số sao trong 7 ngày qua - #124
Một kho lưu trữ tối giản, đầy đủ tiện ích để thúc đẩy khoa học về mô hình thế giới (World Model).
★ 729+6Thay đổi số sao trong 7 ngày qua - #125
[ICCV 2025] Triển khai chính thức của bài báo “MagicDrive-V2: Tạo video dài độ phân giải cao cho lái xe tự động với điều khiển thích ứng”
★ 729+1Thay đổi số sao trong 7 ngày qua - #126
[CVPR 2024 Highlight] DistriFusion: Suy luận song song phân tán cho các mô hình khuếch tán độ phân giải cao.
★ 728+0Thay đổi số sao trong 7 ngày qua - #127
Các Colab Notebook bao gồm các công cụ học sâu để dự đoán và thiết kế cấu trúc phân tử sinh học
★ 724+1Thay đổi số sao trong 7 ngày qua - #128
Phục hồi hình ảnh bằng phương trình vi phân ngẫu nhiên đảo ngược trung bình (Mean-Reverting SDE), ICML 2023. Giải pháp chiến thắng cuộc thi NTIRE 2023 về loại bỏ bóng đổ trên ảnh.
★ 722+0Thay đổi số sao trong 7 ngày qua - #129
[NeurIPS 2024] Mô hình ngôn ngữ khuếch tán có che (Masked Diffusion Language Model) đơn giản và hiệu quả
★ 711+2Thay đổi số sao trong 7 ngày qua - #130
[ICML 2025] Triển khai PyTorch chính thức cho "History-Guided Video Diffusion"
★ 709+1Thay đổi số sao trong 7 ngày qua - #131
Danh sách tổng hợp các Video World Models với AR Diffusion: Bao gồm thuật toán, ứng dụng và cơ sở hạ tầng, nhằm phục vụ như một tài nguyên toàn diện cho các nhà nghiên cứu, chuyên gia và người đam mê.
★ 701+5Thay đổi số sao trong 7 ngày qua - #132
[ECCV 2024] Chuyển đổi ảnh đơn sang lưới 3D có kết cấu trong 10 giây với Mô hình tái tạo tích chập.
★ 696+0Thay đổi số sao trong 7 ngày qua - #133
Một khung thống nhất giúp học tăng cường dễ dàng trong các mô hình Flow-Matching
★ 690+7Thay đổi số sao trong 7 ngày qua - #134
Bộ sưu tập các bài báo và mã nguồn cho AIGC tại CVPR2026/CVPR2025/ICCV2025/CVPR2024/ECCV2026/ECCV2024
★ 677+1Thay đổi số sao trong 7 ngày qua - #135
HunyuanImage-2.1: Mô hình khuếch tán hiệu quả cho việc tạo văn bản thành hình ảnh độ phân giải cao (2K)
★ 675+0Thay đổi số sao trong 7 ngày qua - #136
Triển khai PyTorch của Make-An-Audio (ICML'23) với mô hình tạo văn bản thành âm thanh (Text-to-Audio)
★ 668+0Thay đổi số sao trong 7 ngày qua - #137
Triển khai chính thức của bài báo OneDiffusion (CVPR 2025)
★ 665+0Thay đổi số sao trong 7 ngày qua - #138
Flash Diffusion — tăng tốc các mô hình khuếch tán có điều kiện (AAAI 2025 Oral)
★ 663+1Thay đổi số sao trong 7 ngày qua - #139
[IJCV 2026] FoleyCrafter: Thổi hồn vào video câm bằng âm thanh sống động và đồng bộ
★ 663+0Thay đổi số sao trong 7 ngày qua - #140★ 660-1Thay đổi số sao trong 7 ngày qua
- #141
DFloat11 [NeurIPS '25]: Nén không mất dữ liệu cho LLM và DiT để suy luận GPU hiệu quả.
★ 654-1Thay đổi số sao trong 7 ngày qua - #142
Mô hình ngôn ngữ khuếch tán mở cho việc tạo mã — phát hành tiền huấn luyện, đánh giá, suy luận và các checkpoint.
★ 652+3Thay đổi số sao trong 7 ngày qua - #143
Triển khai chính thức cho "Blended Latent Diffusion" [SIGGRAPH 2023].
★ 632+0Thay đổi số sao trong 7 ngày qua - #144★ 631+1Thay đổi số sao trong 7 ngày qua
- #145
[CVPR'26 Highlight] Ditto: Mở rộng quy mô chỉnh sửa video dựa trên hướng dẫn với tập dữ liệu tổng hợp chất lượng cao
★ 628+2Thay đổi số sao trong 7 ngày qua - #146
[NeurIPS 2025] Radial Attention: Cơ chế chú ý thưa O(nlogn) với sự suy giảm năng lượng cho tạo video dài
★ 607-1Thay đổi số sao trong 7 ngày qua - #147
[TPAMI] Triển khai chính thức của bài báo "BrushEdit: Chỉnh sửa và tô màu ảnh tất cả trong một"
★ 590+0Thay đổi số sao trong 7 ngày qua - #148
Mã nguồn chính thức cho bài báo CVPR 2025 "SemanticDraw: Hướng tới sáng tạo nội dung tương tác thời gian thực từ các mô hình khuếch tán hình ảnh"
★ 588-1Thay đổi số sao trong 7 ngày qua - #149
Mã nguồn chính thức của VEnhancer: Tăng cường không gian-thời gian tạo sinh cho tạo video
★ 579+0Thay đổi số sao trong 7 ngày qua - #150★ 577+2Thay đổi số sao trong 7 ngày qua