text-to-image
Repositórios de código aberto acompanhados marcados com text-to-image, ordenados por estrelas.
- #31
WebAI2API: Ferramenta baseada em Camoufox para converter IA web em API, com suporte a LMArena/Gemini, concorrência multi-janela e isolamento de contas.
★ 1.315+16Variação de estrelas nos últimos 7 dias - #32
Motor de inferência offline para arte, conversas de voz em tempo real, chatbots baseados em LLM e fluxos de trabalho automatizados
★ 1.314+0Variação de estrelas nos últimos 7 dias - #33
Uma coleção de recursos sobre geração controlável com modelos de difusão text-to-image.
★ 1.110+0Variação de estrelas nos últimos 7 dias - #34★ 1.102+1Variação de estrelas nos últimos 7 dias
- #35
Uma lista curada de recursos, ferramentas, habilidades, tutoriais e artigos sobre OpenClaw. OpenClaw (anteriormente Moltbot / Clawdbot) — agente de IA open-source auto-hospedado para WhatsApp, Telegram, Discord e mais de 50 integrações.
★ 1.005+7Variação de estrelas nos últimos 7 dias - #36
Implementação do Muse: Geração de Texto para Imagem via Transformers Generativos Mascarados, em Pytorch
★ 918+0Variação de estrelas nos últimos 7 dias - #37★ 913+4Variação de estrelas nos últimos 7 dias
- #38
O tutorial mais fácil de entender para usar LoRA (Low-Rank Adaptation) dentro do framework diffusers para pesquisadores de geração por IA🔥
★ 822-1Variação de estrelas nos últimos 7 dias - #39
[ICCV 2023] "TF-ICON: Diffusion-Based Training-Free Cross-Domain Image Composition" (Implementação oficial)
★ 814+0Variação de estrelas nos últimos 7 dias - #40
[TMLR 2025🔥] Uma pesquisa sobre modelos autorregressivos em visão.
★ 808+1Variação de estrelas nos últimos 7 dias - #41
CLIP + FFT/DWT/RGB = texto para imagem/vídeo
★ 789+0Variação de estrelas nos últimos 7 dias - #42
Implementação oficial de "Attend-and-Excite: Attention-Based Semantic Guidance for Text-to-Image Diffusion Models" (SIGGRAPH 2023)
★ 770+0Variação de estrelas nos últimos 7 dias - #43
Uma coleção de estudos incríveis sobre geração de texto para imagem.
★ 765+0Variação de estrelas nos últimos 7 dias - #44
Um Levantamento sobre Geração/Síntese de Texto para Vídeo.
★ 744+2Variação de estrelas nos últimos 7 dias - #45
Integração e Exploração Multimodal do Paddle, dando suporte a tarefas multimodais principais, incluindo modelos de pré-treinamento multimodal em larga escala de ponta a ponta e caixa de ferramentas de modelos de difusão. Equipado com alto desempenho e flexibilidade.
★ 723-1Variação de estrelas nos últimos 7 dias - #46
O aplicativo gerador e editor de imagens Nano Banana mais avançado. Seu hub central para geração e revisões de imagens por IA. A interface intuitiva apresenta imagens de referência, edição com máscaras de imagem, histórico de versões e muito mais. Alimentado pela API de imagens do Gemini 2.5 Flash.
★ 710+0Variação de estrelas nos últimos 7 dias - #47
HunyuanImage-2.1: Um Modelo de Difusão Eficiente para Geração de Texto para Imagem em Alta Resolução (2K)
★ 675+0Variação de estrelas nos últimos 7 dias - #48
Implementação oficial do artigo OneDiffusion (CVPR 2025)
★ 665+0Variação de estrelas nos últimos 7 dias - #49
Flash Diffusion — acelerando modelos de difusão condicional (AAAI 2025 Oral)
★ 663+1Variação de estrelas nos últimos 7 dias - #50
face-to-sticker
★ 641+0Variação de estrelas nos últimos 7 dias - #51
(Aceito no IJCV) Liquid: Modelos de linguagem são geradores multimodais escaláveis e unificados
★ 640+0Variação de estrelas nos últimos 7 dias - #52
Implementação oficial para "Blended Latent Diffusion" [SIGGRAPH 2023]
★ 632+0Variação de estrelas nos últimos 7 dias - #53★ 614+0Variação de estrelas nos últimos 7 dias
- #54
Coleção curada de modelos de prompt JSON reutilizáveis e referências de estilo para geração de imagens por IA. Atualizado diariamente.
★ 593+18Variação de estrelas nos últimos 7 dias - #55
Implementação oficial de "Blended Diffusion for Text-driven Editing of Natural Images" [CVPR 2022]
★ 589+0Variação de estrelas nos últimos 7 dias - #56
Código oficial para o artigo do CVPR 2025 "SemanticDraw: Towards Real-Time Interactive Content Creation from Image Diffusion Models."
★ 588-1Variação de estrelas nos últimos 7 dias - #57
🔥🔥🔥 Uma lista selecionada de artigos sobre geração multimodal baseada em LLMs (imagem, vídeo, 3D e áudio).
★ 552+0Variação de estrelas nos últimos 7 dias - #58
AI Plugin é uma extensão poderosa para o Payload CMS, integrando recursos avançados de IA para aprimorar a criação e o gerenciamento de conteúdo.
★ 548+1Variação de estrelas nos últimos 7 dias - #59
[NeurIPS 2025 Spotlight] Um Tokenizador Unificado para Geração e Compreensão Visual
★ 529+0Variação de estrelas nos últimos 7 dias - #60
A Collection of Google Colab Notebooks for various projects
★ 520+6Variação de estrelas nos últimos 7 dias