clip
Repositórios de código aberto acompanhados marcados com clip, ordenados por estrelas.
Tópicos relacionados
Tópicos que aparecem com frequência ao lado de clip no mesmo repositório.
Em ascensão recentemente
Repositórios criados nos últimos 90 dias e marcados com clip.
Nenhum repositório novo marcado com este tópico nos últimos 90 dias.
- #1
X-AnyLabeling: Uma aplicação desktop multiplataforma leve, eficiente e unificada para anotação de texto, imagem, vídeo e dados multimodais, combinando ferramentas integradas versáteis com modelos de IA de última geração e exportação flexível em múltiplos formatos.
★ 10.313+59Variação de estrelas nos últimos 7 dias - #2
Versão chinesa do CLIP que alcança recuperação transmodal e geração de representação em chinês.
★ 6.001+1Variação de estrelas nos últimos 7 dias - #3
Serviço de notificação push de código aberto, pronto para uso no iOS 14+ via QR code. Também suporta Quick Apps, clientes iOS/Mac, clientes Android e dispositivos personalizados.
★ 5.022-1Variação de estrelas nos últimos 7 dias - #4
Kit de ferramentas de avaliação de código aberto para grandes modelos multimodais (LMMs), com suporte a mais de 220 LMMs e mais de 80 benchmarks.
★ 4.375+13Variação de estrelas nos últimos 7 dias - #5
Caixa de ferramentas e benchmark de pré-treinamento da OpenMMLab
★ 3.850-1Variação de estrelas nos últimos 7 dias - #6★ 3.836+2Variação de estrelas nos últimos 7 dias
- #7
Coleção de modelos de visão e linguagem (vision-language models) para tarefas de visão computacional.
★ 3.126+0Variação de estrelas nos últimos 7 dias - #8
Conversão de imagem para prompt com BLIP e CLIP
★ 2.984+1Variação de estrelas nos últimos 7 dias - #9
Calcule facilmente embeddings CLIP e construa um sistema de recuperação CLIP com eles
★ 2.796+1Variação de estrelas nos últimos 7 dias - #10
🥂 Resolva desafios do hCaptcha de forma elegante com um modelo de linguagem multimodal de grande escala.
★ 2.483-1Variação de estrelas nos últimos 7 dias - #11
Cambrian-1 é uma família de LLMs multimodais com um design centrado em visão.
★ 2.014+1Variação de estrelas nos últimos 7 dias - #12
Desenvolvimento rápido de UI para Android, focado em resolver problemas com controles nativos
★ 1.958+0Variação de estrelas nos últimos 7 dias - #13
Recurso essencial para quem deseja experimentar e construir sobre a API de visão da OpenAI
★ 1.690+0Variação de estrelas nos últimos 7 dias - #14
Adicione detecção de objetos, rastreamento, notificações móveis e pesquisa a qualquer câmera de segurança.
★ 1.557+255Variação de estrelas nos últimos 7 dias - #15
[ACL 2024 🔥] Video-ChatGPT é um modelo de conversação de vídeo capaz de gerar conversas significativas sobre vídeos. Ele combina as capacidades de LLMs com um codificador visual pré-treinado adaptado para representação de vídeo espaço-temporal. Também apresentamos um 'Benchmarking de Avaliação Quantitativa' rigoroso para modelos de conversação baseados em vídeo.
★ 1.507+1Variação de estrelas nos últimos 7 dias - #16
IA multimodal de bolso para compreensão e geração de conteúdo em textos multilíngues, imagens e 🔜 vídeo, até 5x mais rápida que o OpenAI CLIP e LLaVA 🖼️ & 🖋️
★ 1.247+1Variação de estrelas nos últimos 7 dias - #17
Lista incrível para pesquisa sobre CLIP (Contrastive Language-Image Pre-Training).
★ 1.227+0Variação de estrelas nos últimos 7 dias - #18
Esta série levará você em uma jornada desde os fundamentos de NLP e Visão Computacional até o estado da arte em Modelos de Visão-Linguagem.
★ 1.179+0Variação de estrelas nos últimos 7 dias - #19
Uma implementação oficial para "CLIP4Clip: An Empirical Study of CLIP for End to End Video Clip Retrieval"
★ 1.032+0Variação de estrelas nos últimos 7 dias - #20
Caixa de ferramentas de algoritmos de IA offline gratuita em Java, suporta reconhecimento facial, deteção de vivacidade, reconhecimento de expressões, deteção de objetos, segmentação de instâncias, deteção de pedestres, reconhecimento de texto OCR, reconhecimento de matrículas, reconhecimento de tabelas, ASR+TTS, tradução automática e outras funções, disponível através de dependência Maven. Suporta PyTorch e TensorFlow, com modelos principais integrados como Mtcnn, InsightFace, SeetaFace6, YOLOv8~v12, PaddleOCR(PPOCRv5) e Whisper
★ 908+3Variação de estrelas nos últimos 7 dias - #21
CLIP + FFT/DWT/RGB = texto para imagem/vídeo
★ 789+0Variação de estrelas nos últimos 7 dias - #22
Nova geração do CLIP com forte capacidade de discriminação de granulação fina, ICML2026 e ICML2025
★ 733+2Variação de estrelas nos últimos 7 dias - #23
Integração e Exploração Multimodal do Paddle, dando suporte a tarefas multimodais principais, incluindo modelos de pré-treinamento multimodal em larga escala de ponta a ponta e caixa de ferramentas de modelos de difusão. Equipado com alto desempenho e flexibilidade.
★ 723-1Variação de estrelas nos últimos 7 dias - #24
TrailSnap | Álbum de fotos de código aberto alimentado por IA para memórias de viagens e da vida.
★ 711+13Variação de estrelas nos últimos 7 dias - #25
Uma coleção abrangente de frontend e levantamento de artigos e modelos de repositórios GitHub sobre modelos de visão e linguagem. Atualizações contínuas.
★ 706+3Variação de estrelas nos últimos 7 dias - #26★ 688+1Variação de estrelas nos últimos 7 dias
- #27
Downloader/Gravador de Streams, Vídeos e Clipes do Twitch. Este downloader com interface gráfica ajuda você a baixar e gravar vídeos do Twitch, incluindo transmissões e VODs.
★ 681+4Variação de estrelas nos últimos 7 dias - #28
Extraia características de vídeos brutos usando múltiplas GPUs. Suportamos quadros de fluxo RAFT, bem como modelos S3D, I3D, R(2+1)D, VGGish, CLIP e TIMM.
★ 656+0Variação de estrelas nos últimos 7 dias - #29
👁️ + 💬 + 🎧 = 🤖 Lista selecionada dos principais modelos de fundação e multimodais! [Artigo + Código + Exemplos + Tutoriais]
★ 637+0Variação de estrelas nos últimos 7 dias - #30
Keras beit, caformer, CMT, CoAtNet, convnext, davit, dino, efficientdet, edgenext, efficientformer, efficientnet, eva, fasternet, fastervit, fastvit, flexivit, gcvit, ghostnet, gpvit, hornet, hiera, iformer, inceptionnext, lcnet, levit, maxvit, mobilevit, moganet, nat, nfnets, pvt, swin, tinynet, tinyvit, uniformer, volo, vanillanet, yolor, yolov7, yolov8, yolox, gpt2, llama2, conhecido como kecam
★ 626+0Variação de estrelas nos últimos 7 dias