text-to-video
Erfasste Open-Source-Repos mit dem Tag text-to-video, sortiert nach Sternen.
- #31
✨ Hotshot-XL: Modernstes KI-Text-zu-GIF-Modell, trainiert für den Einsatz neben Stable Diffusion XL
★ 1.110-1Sterne-Änderung der letzten 7 Tage - #32
[NeurIPS 2024] Eine offizielle Implementierung von „ShareGPT4Video: Improving Video Understanding and Generation with Better Captions“
★ 1.094+1Sterne-Änderung der letzten 7 Tage - #33
HunyuanVideo-Foley: Multimodale Diffusion mit Repräsentationsausrichtung zur treuen Foley-Audioerzeugung.
★ 1.057+3Sterne-Änderung der letzten 7 Tage - #34
[ECCV 2024 Oral] MotionDirector: Bewegungskonibierung von Text-zu-Video-Diffusion-Modellen.
★ 1.054+1Sterne-Änderung der letzten 7 Tage - #35
Eine kuratierte Liste von OpenClaw-Ressourcen, Tools, Fähigkeiten, Tutorials und Artikeln. OpenClaw (ehemals Moltbot / Clawdbot) – ein Open-Source, selbst gehosteter KI-Agent für WhatsApp, Telegram, Discord und über 50 Integrationen.
★ 1.005+8Sterne-Änderung der letzten 7 Tage - #36
Text-zu-Video-Generator im Brainrot-Stil. Lernen Sie jedes Thema von Ihren Lieblingspersönlichkeiten 😼.
★ 960+0Sterne-Änderung der letzten 7 Tage - #37
[ICML 2026] Offizielle Codebasis für „Causal Forcing: Autoregressive Diffusion Distillation Done Right for High-Quality Real-Time Interactive Video Generation“ & Causal Forcing++
★ 953+9Sterne-Änderung der letzten 7 Tage - #38
Videogenerierung aus Text und Bild, 1. Generation
★ 918-2Sterne-Änderung der letzten 7 Tage - #39
[CVPR 2025 Highlight🔥] Identitätserhaltende Text-zu-Video-Generierung durch Frequenzzerlegung
★ 857+1Sterne-Änderung der letzten 7 Tage - #40
Kandinsky 5.0: Eine Familie von Diffusionsmodellen für die Video- und Bildgenerierung
★ 823+5Sterne-Änderung der letzten 7 Tage - #41
Generieren Sie Videos aus Text mithilfe von KI
★ 821+4Sterne-Änderung der letzten 7 Tage - #42
Generieren Sie groß angelegte, erkundbare 3D-Szenen mit hochwertigen Panoramavideos aus einem einzigen Bild oder Texteingabeaufforderung.
★ 816+1Sterne-Änderung der letzten 7 Tage - #43
CLIP + FFT/DWT/RGB = Text zu Bild/Video
★ 789+0Sterne-Änderung der letzten 7 Tage - #44
Implementierung von Phenaki Video in Pytorch, das Mask GIT verwendet, um textgesteuerte Videos mit einer Länge von bis zu 2 Minuten zu erzeugen
★ 789+0Sterne-Änderung der letzten 7 Tage - #45
ClipForge: Open-Source-KI-Tool für E-Commerce-Kurzvideos. Lädt ein Produktbild hoch, extrahiert Verkaufsargumente, schreibt Skripte, generiert Bildmaterial, Voiceover und Untertitel für Plattformen wie TikTok, Douyin oder Xiaohongshu. Unterstützt Batch-Verarbeitung, lokale Bereitstellung und One-Sentence-Videoerstellung.
★ 748+67Sterne-Änderung der letzten 7 Tage - #46
Eine Übersicht zur Text-zu-Video-Generierung/-Synthese.
★ 744+3Sterne-Änderung der letzten 7 Tage - #47
Paddle Multimodal Integration and eXploration, unterstützt gängige multimodale Aufgaben, einschließlich End-to-End-Trainingsmodellen für große multimodale Daten und einer Diffusion-Model-Toolbox. Ausgezeichnet durch hohe Leistung und Flexibilität.
★ 723-1Sterne-Änderung der letzten 7 Tage - #48★ 685+0Sterne-Änderung der letzten 7 Tage
- #49
Topic in, narrated explainer video out. A Claude Code / Codex skill that turns any topic into a black-canvas motion-graphics explainer video with TTS voiceover, subtitles and a chapter progress bar. Chinese or English; every frame drawn in code with Remotion.
★ 612—Sterne-Änderung der letzten 7 Tage - #50
GPT Image 2 to Seedance 2.5 Early Access workflow guide.
★ 589+2Sterne-Änderung der letzten 7 Tage - #51
Offizieller Code von VEnhancer: Generative raumzeitliche Verbesserung für die Videogenerierung.
★ 579+0Sterne-Änderung der letzten 7 Tage - #52★ 553+0Sterne-Änderung der letzten 7 Tage
- #53
Eine kuratierte Liste von Forschungsarbeiten zur LLM-basierten multimodalen Generierung (Bild, Video, 3D und Audio).
★ 552+0Sterne-Änderung der letzten 7 Tage - #54
[ECCV 2024] FreeInit: Überbrückung der Initialisierungslücke in Video-Diffusionsmodellen.
★ 543+0Sterne-Änderung der letzten 7 Tage - #55
Multi-Modell DAG-gesteuerte parallele KI-Filmgenerierung – parallele Beschleunigung skaliert mit Szenenunabhängigkeit; Filmsequenzen werden simultan statt nacheinander generiert; eine Film-Generierungs-Engine, die Szenen-Narrativ-Abhängigkeiten als DAG modelliert und die parallele Planung mittels CPM-Algorithmus steuert.
★ 537+2Sterne-Änderung der letzten 7 Tage - #56
Verwandeln Sie Ihren Coding-Agenten in ein Videostudio: Beschreiben Sie ein Video in einfacher Sprache, und Ihr Agent erstellt die Timeline und produziert die Datei.
★ 525+0Sterne-Änderung der letzten 7 Tage - #57
An all-in-one, 100% local AI video, image, and music studio. Director mode plans full music videos and short films from a single prompt. Built on the WanGP pipeline. Install via Pinokio.
★ 524—Sterne-Änderung der letzten 7 Tage - #58
Eine Sammlung von Google Colab Notebooks für verschiedene Projekte
★ 519+1Sterne-Änderung der letzten 7 Tage - #59
Open-source AI video workbench. Bring any model or your local ComfyUI, and let Claude Code / Codex / Cursor direct it over MCP — storyboard, references, generation, editable first cut on a real timeline. Local-first: projects, prompts, and keys stay on your machine. No account, no telemetry.
★ 505—Sterne-Änderung der letzten 7 Tage