text-to-image
Repositórios de código aberto acompanhados marcados com text-to-image, ordenados por estrelas.
Tópicos relacionados
Tópicos que aparecem com frequência ao lado de text-to-image no mesmo repositório.
Em ascensão recentemente
Repositórios criados nos últimos 90 dias e marcados com text-to-image.
Nenhum repositório novo marcado com este tópico nos últimos 90 dias.
- #1
Alternativa open-source sem restrições para plataformas de vídeo com IA — Estúdio gratuito de geração de imagens e vídeos com IA com mais de 500 modelos (Flux, Midjourney, Kling, Sora, Veo). Sem filtros de conteúdo. Auto-hospedado, licença MIT.
★ 27.600+241Variação de estrelas nos últimos 7 dias - #2
GPT-Image-2 API and Prompts
★ 17.062+56Variação de estrelas nos últimos 7 dias - #3
Implementação em PyTorch do DALL-E 2, a rede neural de síntese de texto para imagem atualizada da OpenAI
★ 11.301-4Variação de estrelas nos últimos 7 dias - #4
Implementação do Imagen, a rede neural de texto para imagem do Google, em PyTorch
★ 8.425+0Variação de estrelas nos últimos 7 dias - #5
Coleção curada de imagens e prompts gerados pelo GPT-4o e gpt-image-1. Explore visuais gerados por IA criados com ChatGPT e Sora, demonstrando as capacidades avançadas de geração de imagem da OpenAI.
★ 8.138+5Variação de estrelas nos últimos 7 dias - #6
Este repositório contém recursos selecionados manualmente para Prompt Engineering com foco em Generative Pre-trained Transformer (GPT), ChatGPT, PaLM, etc.
★ 6.306+7Variação de estrelas nos últimos 7 dias - #7
Implementação/replicação do DALL-E, o Transformer de texto para imagem da OpenAI, em PyTorch
★ 5.626-2Variação de estrelas nos últimos 7 dias - #8
Red Ink - Um gerador de texto e imagem para o Xiaohongshu baseado no 🍌Nano Banana Pro🍌, "Uma Frase, Uma Imagem: Gere Textos e Imagens para o Xiaohongshu."
★ 5.502+15Variação de estrelas nos últimos 7 dias - #9
Galeria de prompts GPT Image 2, biblioteca de prompts de imagem, habilidade de agente e CLI para geração/edição de imagens da OpenAI
★ 5.058+71Variação de estrelas nos últimos 7 dias - #10
Habilidades de mídia generativa multimodal para agentes de IA (Claude Code, Cursor, Gemini CLI). Geração de imagem, vídeo e áudio de alta qualidade com tecnologia muapi.ai.
★ 4.205+19Variação de estrelas nos últimos 7 dias - #11
Suporte a LTX-Video para ComfyUI.
★ 4.113+8Variação de estrelas nos últimos 7 dias - #12
[CVPR 2026] PromptEnhancer é uma ferramenta de reescrita de prompts, refinando prompts em versões mais claras e estruturadas para uma melhor geração de imagens.
★ 3.766+5Variação de estrelas nos últimos 7 dias - #13
Uma lista curada de ferramentas, trabalhos, modelos e referências de IA Generativa
★ 3.531+2Variação de estrelas nos últimos 7 dias - #14★ 3.494+0Variação de estrelas nos últimos 7 dias
- #15
Artigos, pesquisas e taxonomia sobre modelos de difusão
★ 3.364+0Variação de estrelas nos últimos 7 dias - #16
Mais de 50 aplicativos de IA generativa de código aberto que você pode clonar, implantar e monetizar — geradores de imagem, ferramentas de vídeo, provadores virtuais, templates SaaS de IA e integrações de plataforma. Implantação com um clique no Vercel para cada template.
★ 3.122+35Variação de estrelas nos últimos 7 dias - #17
Kandinsky 2 — modelo de difusão latente multilingue de texto para imagem
★ 2.814+0Variação de estrelas nos últimos 7 dias - #18
FLUX, Stable Diffusion, SDXL, SD3, LoRA, Fine Tuning, DreamBooth, Treinamento, Automatic1111, Forge WebUI, SwarmUI, DeepFake, TTS, Animação, Texto para Vídeo, Tutoriais, Guias, Palestras, Cursos, ComfyUI, Google Colab, RunPod, Kaggle, NoteBooks, ControlNet, TTS, Clonagem de Voz, IA, Notícias de IA, ML, Notícias de ML, Notícias, Tecnologia, Notícias de Tecnologia, Kohya, Midjourney, RunPod
★ 2.762-1Variação de estrelas nos últimos 7 dias - #19
Um ambiente para gerar imagens a partir de qualquer prompt de texto usando Stable Diffusion (anteriormente: usando DALL-E Mini).
★ 2.740-1Variação de estrelas nos últimos 7 dias - #20
🔥 [ICCV 2025 Highlight] InfiniteYou: Recriação flexível de fotos preservando sua identidade
★ 2.684-2Variação de estrelas nos últimos 7 dias - #21
(ෆ`꒳´ෆ) Um levantamento sobre geração/síntese de texto para imagem.
★ 2.444+0Variação de estrelas nos últimos 7 dias - #22
Implementação e extensão de código aberto do PaperBanana do Google Research para figuras acadêmicas, diagramas e visuais de pesquisa automatizados, expandido para novos domínios como a geração de slides.
★ 2.298+10Variação de estrelas nos últimos 7 dias - #23
A magia da IA encontra um quadro de desenho infinito.
★ 1.934-1Variação de estrelas nos últimos 7 dias - #24
[ICML 2024] Dominando a Difusão de Texto para Imagem: Re-legenda, Planejamento e Geração com LLMs Multimodais (RPG)
★ 1.844+0Variação de estrelas nos últimos 7 dias - #25
[ECCV 2024] Implementação oficial do artigo "BrushNet: A Plug-and-Play Image Inpainting Model with Decomposed Dual-Branch Diffusion"
★ 1.744-1Variação de estrelas nos últimos 7 dias - #26
Implementação oficial em PyTorch para "TokenFlow: Consistent Diffusion Features for Consistent Video Editing" apresentando "TokenFlow" (ICLR 2024)
★ 1.707-1Variação de estrelas nos últimos 7 dias - #27
[CVPR 2025 Oral] Infinity ∞: Escalando modelagem autorregressiva bitwise para síntese de imagens de alta resolução.
★ 1.587+0Variação de estrelas nos últimos 7 dias - #28
Servidor oficial do MiniMax Model Context Protocol (MCP) que permite a interação com poderosas APIs de conversão de texto em fala, geração de imagens e geração de vídeo.
★ 1.573+2Variação de estrelas nos últimos 7 dias - #29
[ICCV 2025] UNO: Um método de personalização universal para condicionamento de sujeito único e múltiplo
★ 1.362+0Variação de estrelas nos últimos 7 dias - #30
Transforme qualquer rosto em um personagem de videogame, pixel art, claymation, 3D ou brinquedo
★ 1.360-1Variação de estrelas nos últimos 7 dias