image-generation
Repositórios de código aberto acompanhados marcados com image-generation, ordenados por estrelas.
- #31
Biblioteca PHP que permite a geração de miniaturas, capturas de tela ou PDFs a partir de uma URL ou página HTML. Wrapper para wkhtmltopdf/wkhtmltoimage.
★ 4.474+0Variação de estrelas nos últimos 7 dias - #32★ 4.342+1Variação de estrelas nos últimos 7 dias
- #33
Um framework Ruby para todos os principais provedores de IA. Crie agentes de IA, chatbots, aplicativos RAG e fluxos de trabalho multimodais com um código elegante e expressivo.
★ 4.335+8Variação de estrelas nos últimos 7 dias - #34
Implementações oficiais do artigo: Anydoor: personalização de imagem em nível de objeto zero-shot
★ 4.239+0Variação de estrelas nos últimos 7 dias - #35
Habilidades de mídia generativa multimodal para agentes de IA (Claude Code, Cursor, Gemini CLI). Geração de imagem, vídeo e áudio de alta qualidade com tecnologia muapi.ai.
★ 4.205+19Variação de estrelas nos últimos 7 dias - #36
Ferramenta de geração e edição de imagens baseada na API gpt-image-2 da OpenAI.
★ 3.599+29Variação de estrelas nos últimos 7 dias - #37
API Python de engenharia reversa para o aplicativo web do Google Gemini.
★ 3.468+19Variação de estrelas nos últimos 7 dias - #38
HunyuanImage-3.0: Um poderoso modelo multimodal nativo para geração de imagens
★ 3.256+2Variação de estrelas nos últimos 7 dias - #39
Implementação de Dreambooth (https://arxiv.org/abs/2208.12242) por meio de Textual Inversion (https://arxiv.org/abs/2208.01618) para Stable Diffusion (https://arxiv.org/abs/2112.10752). Ajustes focados no treinamento de rostos, objetos e estilos.
★ 3.212+0Variação de estrelas nos últimos 7 dias - #40
Mais de 50 aplicativos de IA generativa de código aberto que você pode clonar, implantar e monetizar — geradores de imagem, ferramentas de vídeo, provadores virtuais, templates SaaS de IA e integrações de plataforma. Implantação com um clique no Vercel para cada template.
★ 3.122+35Variação de estrelas nos últimos 7 dias - #41
Automatiza a geração de ativos e declaração de imagens para PWA. Gera automaticamente ícones, telas de splash, favicons e imagens mstile. Atualiza os arquivos manifest.json e index.html com as imagens geradas de acordo com as especificações do Web App Manifest e as diretrizes de interface humana da Apple.
★ 3.032+2Variação de estrelas nos últimos 7 dias - #42
Renderize imagens OG e PDFs paginados a partir de JSX, HTML e CSS. Sem navegador headless. Executa em Node.js, Cloudflare Workers, navegadores e Rust.
★ 2.912+17Variação de estrelas nos últimos 7 dias - #43
One-ink editorial print image skill — warm paper, halftone photography, active negative space, and restrained typography.
★ 2.901—Variação de estrelas nos últimos 7 dias - #44
Kandinsky 2 — modelo de difusão latente multilingue de texto para imagem
★ 2.814+0Variação de estrelas nos últimos 7 dias - #45
🔥 [ICCV 2025 Highlight] InfiniteYou: Recriação flexível de fotos preservando sua identidade
★ 2.684-2Variação de estrelas nos últimos 7 dias - #46
(ෆ`꒳´ෆ) Um levantamento sobre geração/síntese de texto para imagem.
★ 2.444+0Variação de estrelas nos últimos 7 dias - #47
Uma ferramenta poderosa que traduz fluxos de trabalho do ComfyUI em código Python executável.
★ 2.377-1Variação de estrelas nos últimos 7 dias - #48
Este projeto é a implementação oficial do 'DreamOmni2: Multimodal Instruction-based Editing and Generation (CVPR2026 Highlight)'
★ 1.982+3Variação de estrelas nos últimos 7 dias - #49
Modelo autorregressivo supera difusão: 🦙 Llama para geração de imagens escalável
★ 1.966+0Variação de estrelas nos últimos 7 dias - #50
Skill de IA para OpenClaw e Claude Code — recomendações a partir de mais de 10.000 prompts de imagem Nano Banana Pro (Gemini). Busca inteligente por caso de uso, remix de conteúdo e imagens de exemplo.
★ 1.843+6Variação de estrelas nos últimos 7 dias - #51
Funcionário de geração de vídeo totalmente automatizado por IA | Seu primeiro colega de trabalho AIGC. Converse uma ideia. Obtenha um filme.
★ 1.749+14Variação de estrelas nos últimos 7 dias - #52
Rastreamento e coleta de artigos, projetos e outros materiais relacionados ao Segment Anything.
★ 1.699+0Variação de estrelas nos últimos 7 dias - #53
[CVPR 2025 Oral] Infinity ∞: Escalando modelagem autorregressiva bitwise para síntese de imagens de alta resolução.
★ 1.587+0Variação de estrelas nos últimos 7 dias - #54
Servidor oficial do MiniMax Model Context Protocol (MCP) que permite a interação com poderosas APIs de conversão de texto em fala, geração de imagens e geração de vídeo.
★ 1.573+2Variação de estrelas nos últimos 7 dias - #55
Um conjunto de dados de galeria de prompts de texto para imagem em larga escala baseado em Stable Diffusion.
★ 1.392-1Variação de estrelas nos últimos 7 dias - #56
Implementação de aplicação com casos de uso de negócios para utilizar IA generativa com segurança em operações empresariais
★ 1.381+0Variação de estrelas nos últimos 7 dias - #57
Skill para geração de imagens de slides técnicos desenhados à mão | Capa 21:9 + ilustrações de conteúdo 16:9 | Saída em PNG
★ 1.381+17Variação de estrelas nos últimos 7 dias - #58
[ICCV 2025] UNO: Um método de personalização universal para condicionamento de sujeito único e múltiplo
★ 1.362+0Variação de estrelas nos últimos 7 dias - #59
Estúdio de IA local plug-and-play: chat sem censura, geração de imagens e vídeos, agente de código. Executa LLMs deslimitados + ComfyUI 100% offline. Um instalador, sem Docker, sem nuvem.
★ 1.351+185Variação de estrelas nos últimos 7 dias - #60
FireRed-Image-Edit é um poderoso modelo base de edição de imagem que alcança desempenho de ponta de código aberto com seguimento preciso de instruções, geração de alta fidelidade, consistência de identidade superior e fusão perfeita de múltiplos elementos.
★ 1.350+3Variação de estrelas nos últimos 7 dias