video-generation
标记 video-generation 主题、收录中的开源项目,按星标数排序。
- #91
基于文字与图片的视频生成(第一代)
★ 918-2近 7 天星标变化 - #92
用于图像、视频、音频、文字、制作名单与模型探索的 Flatkey 媒体生成 CLI
★ 908+144近 7 天星标变化 - #93
[AAAI 2025] Follow-Your-Click:此仓库为“Follow-Your-Click: Open-domain Regional Image Animation via Short Prompts”的官方实现
★ 908+0近 7 天星标变化 - #94★ 897+1近 7 天星标变化
- #95
[ACM MM 2025] Ditto:用于可控实时虚拟人像合成的运动空间扩散模型。
★ 884+6近 7 天星标变化 - #96★ 871+10近 7 天星标变化
- #97★ 857+1近 7 天星标变化
- #98
UniAnimate-DiT:基于大规模视频扩散Transformer的人像动画生成
★ 851-1近 7 天星标变化 - #99
[SIGGRAPH 2025] Diffusion as Shader: 用于多功能视频生成控制的 3D 感知视频 Diffusion
★ 835+2近 7 天星标变化 - #100
Topic in, narrated explainer video out. A Claude Code / Codex skill that turns any topic into a black-canvas motion-graphics explainer video with TTS voiceover, subtitles and a chapter progress bar. Chinese or English; every frame drawn in code with Remotion.
★ 830—近 7 天星标变化 - #101
“RIFLEx: A Free Lunch for Length Extrapolation in Video Diffusion Transformers”(ICML 2025)、UltraViCo (ICLR 2026) 与 UltraImage 的官方实现
★ 827+2近 7 天星标变化 - #102
一个简单、统一的多模态模型训练引擎。精简、灵活,专为大规模修改与实验打造。
★ 825+1近 7 天星标变化 - #103
Kandinsky 5.0:用于视频与图像生成的扩散模型系列
★ 824+5近 7 天星标变化 - #104
使用 AI 从文字生成视频
★ 822+4近 7 天星标变化 - #105★ 817+1近 7 天星标变化
- #106
Open‑WebUI Tools 是一个模块化工具包,旨在扩充并丰富您的 Open WebUI 实例,将其转化为强大的 AI 工作站。项目内含超过 15 种专门工具、函数管线与过滤器,支持学术研究、代理自主性、多模态创造力、工作流程等功能。
★ 808+5近 7 天星标变化 - #107
[TMLR 2025🔥] 视觉自回归模型综述。
★ 808+0近 7 天星标变化 - #108★ 805+0近 7 天星标变化
- #109★ 803+3近 7 天星标变化
- #110
[NeurIPS 2025 Oral] Infinity⭐️:用于视觉生成的统一时空自回归建模。
★ 785+3近 7 天星标变化 - #111
精选的视频生成研究集合。
★ 783+1近 7 天星标变化 - #112
[ICML 2024] MagicPose (也称 MagicDance):具备身份感知能力的 Diffusion 实现真实人类姿态与面部表情重定向
★ 777+1近 7 天星标变化 - #113★ 759+21近 7 天星标变化
- #114
文本转视频生成/合成技术综述。
★ 744+3近 7 天星标变化 - #115
本地优先、Agent 原生的 ComfyUI 控制平面——内含 MCP 服务器与侧边栏 Agent,可使用任何 LLM(Claude、ChatGPT、Gemini、离线 Ollama 或任何托管模型)以自然语言生成图片、视频与音频,编写并执行工作流程,以及编辑实时图表。具备 178 种工具、36 种 AI 技能、55 种安装套件。支持本地、局域网、VPS 或 Comfy Cloud。
★ 739+21近 7 天星标变化 - #116
Cosmos-Transfer2.5 基于 Cosmos-Predict2.5 构建,可根据多种空间控制输入产生高质量的世界模拟。
★ 737+4近 7 天星标变化 - #117
一个极简、功能齐全的存储库,用于推进世界模型科学。
★ 734+9近 7 天星标变化 - #118
[ICCV 2025] 论文「MagicDrive-V2: High-Resolution Long Video Generation for Autonomous Driving with Adaptive Control」的官方实现。
★ 729+0近 7 天星标变化 - #119
[ICML 2025] 「History-Guided Video Diffusion」的官方 PyTorch 实现
★ 709+0近 7 天星标变化 - #120
[ICLR 2026] ChronoEdit:迈向图像编辑与世界模拟的时间推理
★ 706+2近 7 天星标变化