text-to-video
Dépôts open source suivis étiquetés text-to-video, triés par étoiles.
- #31
✨ Hotshot-XL : Modèle d'IA texte-vers-GIF de pointe entraîné pour fonctionner avec Stable Diffusion XL
★ 1 110-1Évolution des étoiles sur les 7 derniers jours - #32
[NeurIPS 2024] Implémentation officielle de "ShareGPT4Video: Improving Video Understanding and Generation with Better Captions"
★ 1 094+1Évolution des étoiles sur les 7 derniers jours - #33
HunyuanVideo-Foley : diffusion multimodale avec alignement de représentation pour la génération audio Foley haute fidélité.
★ 1 057+3Évolution des étoiles sur les 7 derniers jours - #34
[ECCV 2024 Oral] MotionDirector : Personnalisation de mouvement pour les modèles de diffusion texte-vidéo.
★ 1 054+1Évolution des étoiles sur les 7 derniers jours - #35
Une liste organisée de ressources, outils, compétences, tutoriels et articles sur OpenClaw. OpenClaw (anciennement Moltbot / Clawdbot) est un agent IA open-source auto-hébergé pour WhatsApp, Telegram, Discord et plus de 50 intégrations.
★ 1 005+8Évolution des étoiles sur les 7 derniers jours - #36
Générateur de texte en vidéo sous forme de brainrot. Apprenez n'importe quel sujet avec vos personnalités préférées 😼.
★ 960+0Évolution des étoiles sur les 7 derniers jours - #37
[ICML 2026] Base de code officielle pour "Causal Forcing: Autoregressive Diffusion Distillation Done Right for High-Quality Real-Time Interactive Video Generation" & Causal Forcing++
★ 953+9Évolution des étoiles sur les 7 derniers jours - #38
Génération de vidéo à partir de texte et d'image, 1ère génération
★ 918-2Évolution des étoiles sur les 7 derniers jours - #39
[CVPR 2025 Highlight] Génération de texte vers vidéo préservant l'identité par décomposition fréquentielle.
★ 857+1Évolution des étoiles sur les 7 derniers jours - #40
Kandinsky 5.0 : Une famille de modèles de diffusion pour la génération d'images et de vidéos.
★ 823+5Évolution des étoiles sur les 7 derniers jours - #41
Générer des vidéos à partir de texte grâce à l'IA
★ 821+4Évolution des étoiles sur les 7 derniers jours - #42
Générez des scènes 3D explorables à grande échelle avec des vidéos panoramiques de haute qualité à partir d'une seule image ou d'une invite textuelle.
★ 816+1Évolution des étoiles sur les 7 derniers jours - #43
CLIP + FFT/DWT/RGB = texte vers image/vidéo.
★ 789+0Évolution des étoiles sur les 7 derniers jours - #44
Implémentation en Pytorch de Phenaki Video, utilisant Mask GIT pour générer des vidéos guidées par texte d'une durée maximale de 2 minutes.
★ 789+0Évolution des étoiles sur les 7 derniers jours - #45
Générateur open-source de courtes vidéos e-commerce/UGC propulsé par l'IA — Téléchargez une image de produit, l'IA extrait automatiquement les arguments de vente, rédige le script promotionnel, préserve l'image originale sans déformation, génère les visuels, la voix off et les sous-titres, pour produire en un clic des vidéos de vente pour TikTok Shop, Douyin, Kuaishou ou Xiaohongshu. Production en lot à coût zéro, open-source sans filigrane, auto-hébergé en local. Prend également en charge la création de vidéos à partir d'un thème en une phrase.
★ 748+67Évolution des étoiles sur les 7 derniers jours - #46
Une étude sur la génération et la synthèse de texte vers vidéo.
★ 744+3Évolution des étoiles sur les 7 derniers jours - #47
Paddle Multimodal Integration and eXploration, prenant en charge les tâches multimodales courantes, incluant des modèles de pré-entraînement multimodaux à grande échelle et une boîte à outils de modèles de diffusion, alliant haute performance et flexibilité.
★ 723-1Évolution des étoiles sur les 7 derniers jours - #48★ 685+0Évolution des étoiles sur les 7 derniers jours
- #49
Topic in, narrated explainer video out. A Claude Code / Codex skill that turns any topic into a black-canvas motion-graphics explainer video with TTS voiceover, subtitles and a chapter progress bar. Chinese or English; every frame drawn in code with Remotion.
★ 683—Évolution des étoiles sur les 7 derniers jours - #50
GPT Image 2 to Seedance 2.5 Early Access workflow guide.
★ 589+2Évolution des étoiles sur les 7 derniers jours - #51
Codes officiels de VEnhancer : Amélioration spatio-temporelle générative pour la génération de vidéo
★ 579+0Évolution des étoiles sur les 7 derniers jours - #52★ 553+0Évolution des étoiles sur les 7 derniers jours
- #53
Une liste organisée d'articles sur la génération multimodale basée sur les LLM (image, vidéo, 3D et audio).
★ 552+0Évolution des étoiles sur les 7 derniers jours - #54
[ECCV 2024] FreeInit : Combler l'écart d'initialisation dans les modèles de diffusion vidéo
★ 543+0Évolution des étoiles sur les 7 derniers jours - #55
Génération de films IA en parallèle pilotée par DAG multi-modèles : accélération parallèle proportionnelle à l'indépendance des scènes ; génération simultanée de scènes de film ; moteur de génération cinématographique modélisant les dépendances narratives sous forme de DAG et utilisant l'algorithme CPM pour l'ordonnancement parallèle.
★ 537+2Évolution des étoiles sur les 7 derniers jours - #56
Transformez votre agent de codage en studio vidéo : décrivez une vidéo en langage clair, et votre agent rédige la chronologie et produit le fichier.
★ 525+0Évolution des étoiles sur les 7 derniers jours - #57
An all-in-one, 100% local AI video, image, and music studio. Director mode plans full music videos and short films from a single prompt. Built on the WanGP pipeline. Install via Pinokio.
★ 524—Évolution des étoiles sur les 7 derniers jours - #58
Une collection de notebooks Google Colab pour divers projets
★ 521+1Évolution des étoiles sur les 7 derniers jours - #59
Open-source AI video workbench. Bring any model or your local ComfyUI, and let Claude Code / Codex / Cursor direct it over MCP — storyboard, references, generation, editable first cut on a real timeline. Local-first: projects, prompts, and keys stay on your machine. No account, no telemetry.
★ 505—Évolution des étoiles sur les 7 derniers jours