跳到主要內容
buildradar
登入
主題 · video-generation

video-generation

標記 video-generation 主題、收錄中的開源專案,依星數排序。

共 156 個專案
  • Lance@bytedance

    具備 3B 活躍參數的原生統一多模態模型,支援影像與影片的理解、生成及編輯。

    1,343+0近 7 天星數變化
  • short-video-maker@gyoridavid

    使用 Model Context Protocol (MCP) 與 REST API 為 TikTok、Instagram Reels 和 YouTube Shorts 建立短片。

    1,341+0近 7 天星數變化
  • MagicTime@PKU-YuanGroup

    [TPAMI 2025🔥] MagicTime:作為變形模擬器的縮時影片生成模型

    1,336+0近 7 天星數變化
  • Bernini@bytedance

    Bernini 是一個用於影片生成與編輯的統一框架,結合了基於 MLLM 的語意規劃器與基於 DiT 的渲染器。

    1,310+0近 7 天星數變化
  • articulated-animation@snap-research

    Articulated Animation 論文的動作表示法程式碼

    1,277+0近 7 天星數變化
  • Motus@thu-ml

    Motus 的官方程式碼:統一隱空間動作世界模型(A Unified Latent Action World Model)

    1,276+0近 7 天星數變化
  • 4DAnyone@ant-research

    [SIGGRAPH Asia 2026] 4DAnyone: Create Anyone in 4D from a Casual Monocular Video

    1,271+142近 7 天星數變化
  • gbro-collage-broll@pyang5166

    半調紙拼貼 B-roll 生成 skill:三閘門審批,Gemini Omni Flash 首尾幀組裝動畫 | Editorial halftone paper-collage B-roll agent skill

    1,270+0近 7 天星數變化
  • StableAvatar@Francis-Rings

    我們介紹 StableAvatar,這是第一個端到端影片擴散 Transformer,在給定參考圖像和音訊的條件下,無需任何後處理即可合成無限長度的高品質音訊驅動虛擬形象影片。

    1,258+0近 7 天星數變化
  • HunyuanCustom@Tencent-Hunyuan

    HunyuanCustom:用於自訂影片生成的多模態驅動架構

    1,229+0近 7 天星數變化
  • mlx-serve@ddalcu

    適用於 Apple Silicon 的原生 LLM 推論伺服器。相容 OpenAI + Anthropic API。無須 Python。包含具備聊天、agent 模式與工具呼叫功能的 MLX Core macOS 應用程式。

    1,227+39近 7 天星數變化
  • Free open-source project designed for turning youtube-viedos into viral short videos. Highlight detection, subtitles, translation, voiceover, all in one for your content.

    1,219近 7 天星數變化
  • UniAnimate@ali-vilab

    SCIS-2025 論文「UniAnimate: Taming Unified Video Diffusion Models for Consistent Human Image Animation」的程式碼。

    1,188+0近 7 天星數變化
  • wunjo.wladradchenko.ru@wladradchenko

    Wunjo CE:臉部交換、對嘴、控制移除物件與文字及背景、風格重塑、音訊分離、語音複製、影片生成。開源、本機執行且免費。

    1,169+0近 7 天星數變化
  • MagicDrive@cure-lab

    [ICLR24] 論文「MagicDrive: Street View Generation with Diverse 3D Geometry Control」的官方實作

    1,168+0近 7 天星數變化
  • MOVA@OpenMOSS

    MOVA:邁向可擴充且同步的視訊-音訊生成

    1,111+2近 7 天星數變化
  • MotionDirector@showlab

    [ECCV 2024 Oral] MotionDirector:文字轉影片擴散模型的動作客製化。

    1,054+1近 7 天星數變化
  • SCAIL@zai-org

    SCAIL:透過 3D 一致姿態表示的內文學習實現錄音室級角色動畫(CVPR 2026 Findings)

    1,051+2近 7 天星數變化
  • SpargeAttn@thu-ml

    [ICML2025] SpargeAttention:一種無需訓練的稀疏注意力機制,可加速任何模型的推論。

    1,050+4近 7 天星數變化
  • echomimic_v3@antgroup

    [AAAI 2026] EchoMimicV3:統一多模態與多任務人類動畫僅需 1.3B 參數

    1,048+8近 7 天星數變化
  • awesome-agent-apis@Anil-matcha

    OpenClaw 資源、工具、技能、教學與文章的精選列表。OpenClaw(前稱 Moltbot / Clawdbot)— 適用於 WhatsApp、Telegram、Discord 及 50 多種整合的開源自託管 AI agent。

    1,007+8近 7 天星數變化
  • Provider-neutral Codex Skill for producing verified AI presenter videos from a script and an authorized presenter image.

    1,000+4近 7 天星數變化
  • [TPAMI 2026] 3D 與 4D 世界建模:綜述

    983+4近 7 天星數變化
  • :fire: :fire: :fire: 近期電腦視覺 (CV) 相關論文清單

    973+1近 7 天星數變化
  • animate-anything@alibaba

    基於動作引導的細粒度開域圖像動畫

    971-1近 7 天星數變化
  • SEINE@Vchitect

    [ICLR 2024] SEINE: 用於生成式過渡與預測的由短至長影片擴散模型

    967+0近 7 天星數變化
  • 一個透過自訂過濾器自動收集短片、讓您輕鬆瀏覽這些短片,並將其組合為可直接上傳至任何社群媒體平臺的精華影片的機器人系統。提供完整的 VPS 支援以及帳戶系統,讓多個使用者可以同時使用該機器人。此機器人分為三個獨立程式:伺服器端、客戶端與 T。

    962+4近 7 天星數變化
  • Causal-Forcing@thu-ml

    [ICML 2026]「Causal Forcing: Autoregressive Diffusion Distillation Done Right for High-Quality Real-Time Interactive Video Generation」與 Causal Forciiing++ 的官方程式碼庫

    957+9近 7 天星數變化
  • lingbot-video@Robbyant

    擴展混合專家模型(MoE)視訊預訓練以實現具身智能

    950+11近 7 天星數變化
  • 在 ComfyUI 中為 MiniMax H3 提供片段串連功能——動作與音訊在拼接處自然延續

    937+121近 7 天星數變化
← 返回主題列表