Chuyển tới nội dung chính
buildradar
Sign in
Chủ đề · diffusion-models

diffusion-models

Các kho mã nguồn mở đang theo dõi được gắn thẻ diffusion-models, sắp xếp theo số sao.

163 kho mã
  • MOFA-Video@MyNiuuu

    [ECCV 2024] MOFA-Video: Hoạt ảnh hình ảnh có thể kiểm soát thông qua các thích ứng trường chuyển động tạo sinh trong mô hình Image-to-Video Diffusion đã được đóng băng.

    766+0Thay đổi số sao trong 7 ngày qua
  • Bộ sưu tập các nghiên cứu ấn tượng về tạo ảnh từ văn bản

    765+0Thay đổi số sao trong 7 ngày qua
  • PMRF@ohayonguy

    [ICLR 2025] Triển khai chính thức của Posterior-Mean Rectified Flow: Hướng tới khôi phục hình ảnh chân thực với MSE tối thiểu

    754+0Thay đổi số sao trong 7 ngày qua
  • nano-world-model@simchowitzlabpublic

    Một kho lưu trữ tối giản, đầy đủ tiện ích để thúc đẩy khoa học về mô hình thế giới (World Model).

    729+6Thay đổi số sao trong 7 ngày qua
  • MagicDrive-V2@flymin

    [ICCV 2025] Triển khai chính thức của bài báo “MagicDrive-V2: Tạo video dài độ phân giải cao cho lái xe tự động với điều khiển thích ứng”

    729+1Thay đổi số sao trong 7 ngày qua
  • distrifuser@mit-han-lab

    [CVPR 2024 Highlight] DistriFusion: Suy luận song song phân tán cho các mô hình khuếch tán độ phân giải cao.

    728+0Thay đổi số sao trong 7 ngày qua
  • DL4Proteins-notebooks@Graylab

    Các Colab Notebook bao gồm các công cụ học sâu để dự đoán và thiết kế cấu trúc phân tử sinh học

    724+1Thay đổi số sao trong 7 ngày qua
  • Phục hồi hình ảnh bằng phương trình vi phân ngẫu nhiên đảo ngược trung bình (Mean-Reverting SDE), ICML 2023. Giải pháp chiến thắng cuộc thi NTIRE 2023 về loại bỏ bóng đổ trên ảnh.

    722+0Thay đổi số sao trong 7 ngày qua
  • mdlm@kuleshov-group

    [NeurIPS 2024] Mô hình ngôn ngữ khuếch tán có che (Masked Diffusion Language Model) đơn giản và hiệu quả

    711+2Thay đổi số sao trong 7 ngày qua
  • [ICML 2025] Triển khai PyTorch chính thức cho "History-Guided Video Diffusion"

    709+1Thay đổi số sao trong 7 ngày qua
  • Danh sách tổng hợp các Video World Models với AR Diffusion: Bao gồm thuật toán, ứng dụng và cơ sở hạ tầng, nhằm phục vụ như một tài nguyên toàn diện cho các nhà nghiên cứu, chuyên gia và người đam mê.

    701+5Thay đổi số sao trong 7 ngày qua
  • CRM@thu-ml

    [ECCV 2024] Chuyển đổi ảnh đơn sang lưới 3D có kết cấu trong 10 giây với Mô hình tái tạo tích chập.

    696+0Thay đổi số sao trong 7 ngày qua
  • Flow-Factory@X-GenGroup

    Một khung thống nhất giúp học tăng cường dễ dàng trong các mô hình Flow-Matching

    690+7Thay đổi số sao trong 7 ngày qua
  • Bộ sưu tập các bài báo và mã nguồn cho AIGC tại CVPR2026/CVPR2025/ICCV2025/CVPR2024/ECCV2026/ECCV2024

    677+1Thay đổi số sao trong 7 ngày qua
  • HunyuanImage-2.1@Tencent-Hunyuan

    HunyuanImage-2.1: Mô hình khuếch tán hiệu quả cho việc tạo văn bản thành hình ảnh độ phân giải cao (2K)

    675+0Thay đổi số sao trong 7 ngày qua
  • Make-An-Audio@Text-to-Audio

    Triển khai PyTorch của Make-An-Audio (ICML'23) với mô hình tạo văn bản thành âm thanh (Text-to-Audio)

    668+0Thay đổi số sao trong 7 ngày qua
  • OneDiffusion@lehduong

    Triển khai chính thức của bài báo OneDiffusion (CVPR 2025)

    665+0Thay đổi số sao trong 7 ngày qua
  • flash-diffusion@gojasper

    Flash Diffusion — tăng tốc các mô hình khuếch tán có điều kiện (AAAI 2025 Oral)

    663+1Thay đổi số sao trong 7 ngày qua
  • FoleyCrafter@open-mmlab

    [IJCV 2026] FoleyCrafter: Thổi hồn vào video câm bằng âm thanh sống động và đồng bộ

    663+0Thay đổi số sao trong 7 ngày qua
  • NOVA@baaivision

    [ICLR 2025] Tạo video tự hồi quy không cần lượng tử hóa vector

    660-1Thay đổi số sao trong 7 ngày qua
  • DFloat11@LeanModels

    DFloat11 [NeurIPS '25]: Nén không mất dữ liệu cho LLM và DiT để suy luận GPU hiệu quả.

    654-1Thay đổi số sao trong 7 ngày qua
  • Open-dLLM@pengzhangzhi

    Mô hình ngôn ngữ khuếch tán mở cho việc tạo mã — phát hành tiền huấn luyện, đánh giá, suy luận và các checkpoint.

    652+3Thay đổi số sao trong 7 ngày qua
  • blended-latent-diffusion@omriav

    Triển khai chính thức cho "Blended Latent Diffusion" [SIGGRAPH 2023].

    632+0Thay đổi số sao trong 7 ngày qua
  • OpenMusic@ivcylc

    OpenMusic: Công nghệ tạo văn bản thành âm nhạc (TTM) hiện đại nhất (SOTA).

    631+1Thay đổi số sao trong 7 ngày qua
  • Ditto@EzioBy

    [CVPR'26 Highlight] Ditto: Mở rộng quy mô chỉnh sửa video dựa trên hướng dẫn với tập dữ liệu tổng hợp chất lượng cao

    628+2Thay đổi số sao trong 7 ngày qua
  • radial-attention@mit-han-lab

    [NeurIPS 2025] Radial Attention: Cơ chế chú ý thưa O(nlogn) với sự suy giảm năng lượng cho tạo video dài

    607-1Thay đổi số sao trong 7 ngày qua
  • BrushEdit@TencentARC

    [TPAMI] Triển khai chính thức của bài báo "BrushEdit: Chỉnh sửa và tô màu ảnh tất cả trong một"

    590+0Thay đổi số sao trong 7 ngày qua
  • semantic-draw@ironjr

    Mã nguồn chính thức cho bài báo CVPR 2025 "SemanticDraw: Hướng tới sáng tạo nội dung tương tác thời gian thực từ các mô hình khuếch tán hình ảnh"

    588-1Thay đổi số sao trong 7 ngày qua
  • VEnhancer@Vchitect

    Mã nguồn chính thức của VEnhancer: Tăng cường không gian-thời gian tạo sinh cho tạo video

    579+0Thay đổi số sao trong 7 ngày qua
  • EDGE@Stanford-TML

    Triển khai chính thức PyTorch của EDGE (CVPR 2023)

    577+2Thay đổi số sao trong 7 ngày qua
← Quay lại danh sách chủ đề