跳到主要内容
buildradar
登录
主题 · video-generation

video-generation

标记 video-generation 主题、收录中的开源项目,按星标数排序。

共 156 个项目
  • MagicTime@PKU-YuanGroup

    [TPAMI 2025🔥] MagicTime:作为变形模拟器的时移视频生成模型

    1,337+0近 7 天星标变化
  • Lance@bytedance

    具备 3B 活跃参数的原生统一多模态模型,支持图像与视频的理解、生成及编辑。

    1,334+0近 7 天星标变化
  • short-video-maker@gyoridavid

    使用 Model Context Protocol (MCP) 与 REST API 为 TikTok、Instagram Reels 和 YouTube Shorts 创建短视频。

    1,327+0近 7 天星标变化
  • Bernini@bytedance

    Bernini 是一个用于视频生成与编辑的统一框架,结合了基于 MLLM 的语义规划器与基于 DiT 的渲染器。

    1,300+0近 7 天星标变化
  • articulated-animation@snap-research

    Articulated Animation 论文的动作表示法代码

    1,277+0近 7 天星标变化
  • 4DAnyone@ant-research

    [SIGGRAPH Asia 2026] 4DAnyone: Create Anyone in 4D from a Casual Monocular Video

    1,260+142近 7 天星标变化
  • Motus@thu-ml

    Motus 的官方代码:统一隐空间动作世界模型(A Unified Latent Action World Model)

    1,260+0近 7 天星标变化
  • StableAvatar@Francis-Rings

    我们介绍 StableAvatar,这是第一个端到端视频扩散 Transformer,在给定参考图像和音频的条件下,无需任何后处理即可合成无限长度的高质量音频驱动数字人视频。

    1,258+0近 7 天星标变化
  • gbro-collage-broll@pyang5166

    半调纸拼贴 B-roll 生成 skill:三闸门审批,Gemini Omni Flash 首尾帧组装动画 | Editorial halftone paper-collage B-roll agent skill

    1,238+0近 7 天星标变化
  • HunyuanCustom@Tencent-Hunyuan

    HunyuanCustom:用于定制视频生成的多模态驱动架构

    1,228+0近 7 天星标变化
  • Free open-source project designed for turning youtube-viedos into viral short videos. Highlight detection, subtitles, translation, voiceover, all in one for your content.

    1,219近 7 天星标变化
  • UniAnimate@ali-vilab

    SCIS-2025 论文“UniAnimate: Taming Unified Video Diffusion Models for Consistent Human Image Animation”的代码。

    1,189+0近 7 天星标变化
  • wunjo.wladradchenko.ru@wladradchenko

    Wunjo CE:面部交换、对嘴、控制移除对象与文字及背景、风格重塑、音频分离、语音复制、视频生成。开源、本地运行且免费。

    1,170+0近 7 天星标变化
  • MagicDrive@cure-lab

    [ICLR24] 论文“MagicDrive: Street View Generation with Diverse 3D Geometry Control”的官方实现

    1,167+0近 7 天星标变化
  • mlx-serve@ddalcu

    适用于 Apple Silicon 的原生 LLM 推理服务器。兼容 OpenAI + Anthropic API。无 Python。包含带聊天、agent 模式和工具调用功能的 MLX Core macOS 应用。

    1,115+39近 7 天星标变化
  • MOVA@OpenMOSS

    MOVA:迈向可扩展且同步的音视频生成

    1,110+2近 7 天星标变化
  • MotionDirector@showlab

    [ECCV 2024 Oral] MotionDirector:文本到视频扩散模型的动作定制。

    1,054+1近 7 天星标变化
  • SCAIL@zai-org

    SCAIL:通过 3D 一致姿态表示的上下文学习实现录音室级角色动画(CVPR 2026 Findings)

    1,051+2近 7 天星标变化
  • SpargeAttn@thu-ml

    [ICML2025] SpargeAttention:一种无需训练的稀疏注意力机制,可加速任何模型的推理。

    1,050+4近 7 天星标变化
  • echomimic_v3@antgroup

    [AAAI 2026] EchoMimicV3:统一多模态与多任务人类动画仅需 1.3B 参数

    1,048+8近 7 天星标变化
  • awesome-agent-apis@Anil-matcha

    OpenClaw 资源、工具、技能、教程与文章的精选列表。OpenClaw(前称 Moltbot / Clawdbot)— 适用于 WhatsApp、Telegram、Discord 及 50 多种集成的开源自托管 AI agent。

    1,007+8近 7 天星标变化
  • Provider-neutral Codex Skill for producing verified AI presenter videos from a script and an authorized presenter image.

    1,000+4近 7 天星标变化
  • [TPAMI 2026] 3D 与 4D 世界建模:综述

    983+4近 7 天星标变化
  • :fire: :fire: :fire: 近期计算机视觉 (CV) 相关论文列表

    973+1近 7 天星标变化
  • animate-anything@alibaba

    基于动作引导的细粒度开域图像动画

    971-1近 7 天星标变化
  • SEINE@Vchitect

    [ICLR 2024] SEINE: 用于生成式过渡与预测的由短至长视频扩散模型

    967+0近 7 天星标变化
  • 一个通过自定义过滤器自动收集短片、让您轻松浏览这些短片,并将其组合为可直接上传至任何社交媒体平台的集锦视频的机器人系统。提供完整的 VPS 支持以及账户系统,允许多个用户同时使用该机器人。此机器人分为三个独立程序:服务器端、客户端与 T。

    962+4近 7 天星标变化
  • Causal-Forcing@thu-ml

    [ICML 2026]“Causal Forcing: Autoregressive Diffusion Distillation Done Right for High-Quality Real-Time Interactive Video Generation”与 Causal Forcing++ 的官方代码库

    957+9近 7 天星标变化
  • lingbot-video@Robbyant

    扩展混合专家模型(MoE)视频预训练以实现具身智能

    950+11近 7 天星标变化
  • 在 ComfyUI 中为 MiniMax H3 提供片段串连功能——动作与音频在拼接处自然延续

    937+121近 7 天星标变化
← 返回主题列表