Pular para o conteúdo principal
buildradar
Sign in
Tópico · clip

clip

Repositórios de código aberto acompanhados marcados com clip, ordenados por estrelas.

Repositórios
36
Total de estrelas
69.310
Média de estrelas
1.925
Participação
0,00%

Tópicos que aparecem com frequência ao lado de clip no mesmo repositório.

Em ascensão recentemente

Repositórios criados nos últimos 90 dias e marcados com clip.

Nenhum repositório novo marcado com este tópico nos últimos 90 dias.

  • X-AnyLabeling@CVHub520

    X-AnyLabeling: Uma aplicação desktop multiplataforma leve, eficiente e unificada para anotação de texto, imagem, vídeo e dados multimodais, combinando ferramentas integradas versáteis com modelos de IA de última geração e exportação flexível em múltiplos formatos.

    10.313+59Variação de estrelas nos últimos 7 dias
  • Chinese-CLIP@OFA-Sys

    Versão chinesa do CLIP que alcança recuperação transmodal e geração de representação em chinês.

    6.001+1Variação de estrelas nos últimos 7 dias
  • pushdeer@easychen

    Serviço de notificação push de código aberto, pronto para uso no iOS 14+ via QR code. Também suporta Quick Apps, clientes iOS/Mac, clientes Android e dispositivos personalizados.

    5.022-1Variação de estrelas nos últimos 7 dias
  • VLMEvalKit@open-compass

    Kit de ferramentas de avaliação de código aberto para grandes modelos multimodais (LMMs), com suporte a mais de 220 LMMs e mais de 80 benchmarks.

    4.375+13Variação de estrelas nos últimos 7 dias
  • mmpretrain@open-mmlab

    Caixa de ferramentas e benchmark de pré-treinamento da OpenMMLab

    3.850-1Variação de estrelas nos últimos 7 dias
  • zero_nlp@yuanzhoulvpi2017

    Soluções de NLP em chinês (LLMs, dados, modelos, treinamento, inferência)

    3.836+2Variação de estrelas nos últimos 7 dias
  • VLM_survey@jingyi0000

    Coleção de modelos de visão e linguagem (vision-language models) para tarefas de visão computacional.

    3.126+0Variação de estrelas nos últimos 7 dias
  • clip-interrogator@pharmapsychotic

    Conversão de imagem para prompt com BLIP e CLIP

    2.984+1Variação de estrelas nos últimos 7 dias
  • clip-retrieval@rom1504

    Calcule facilmente embeddings CLIP e construa um sistema de recuperação CLIP com eles

    2.796+1Variação de estrelas nos últimos 7 dias
  • 🥂 Resolva desafios do hCaptcha de forma elegante com um modelo de linguagem multimodal de grande escala.

    2.483-1Variação de estrelas nos últimos 7 dias
  • cambrian@cambrian-mllm

    Cambrian-1 é uma família de LLMs multimodais com um design centrado em visão.

    2.014+1Variação de estrelas nos últimos 7 dias
  • RWidgetHelper@RuffianZhong

    Desenvolvimento rápido de UI para Android, focado em resolver problemas com controles nativos

    1.958+0Variação de estrelas nos últimos 7 dias
  • Recurso essencial para quem deseja experimentar e construir sobre a API de visão da OpenAI

    1.690+0Variação de estrelas nos últimos 7 dias
  • clearcam@roryclear

    Adicione detecção de objetos, rastreamento, notificações móveis e pesquisa a qualquer câmera de segurança.

    1.557+255Variação de estrelas nos últimos 7 dias
  • Video-ChatGPT@mbzuai-oryx

    [ACL 2024 🔥] Video-ChatGPT é um modelo de conversação de vídeo capaz de gerar conversas significativas sobre vídeos. Ele combina as capacidades de LLMs com um codificador visual pré-treinado adaptado para representação de vídeo espaço-temporal. Também apresentamos um 'Benchmarking de Avaliação Quantitativa' rigoroso para modelos de conversação baseados em vídeo.

    1.507+1Variação de estrelas nos últimos 7 dias
  • UForm@unum-cloud

    IA multimodal de bolso para compreensão e geração de conteúdo em textos multilíngues, imagens e 🔜 vídeo, até 5x mais rápida que o OpenAI CLIP e LLaVA 🖼️ & 🖋️

    1.247+1Variação de estrelas nos últimos 7 dias
  • Awesome-CLIP@yzhuoning

    Lista incrível para pesquisa sobre CLIP (Contrastive Language-Image Pre-Training).

    1.227+0Variação de estrelas nos últimos 7 dias
  • vlms-zero-to-hero@SkalskiP

    Esta série levará você em uma jornada desde os fundamentos de NLP e Visão Computacional até o estado da arte em Modelos de Visão-Linguagem.

    1.179+0Variação de estrelas nos últimos 7 dias
  • CLIP4Clip@ArrowLuo

    Uma implementação oficial para "CLIP4Clip: An Empirical Study of CLIP for End to End Video Clip Retrieval"

    1.032+0Variação de estrelas nos últimos 7 dias
  • SmartJavaAI@geekwenjie

    Caixa de ferramentas de algoritmos de IA offline gratuita em Java, suporta reconhecimento facial, deteção de vivacidade, reconhecimento de expressões, deteção de objetos, segmentação de instâncias, deteção de pedestres, reconhecimento de texto OCR, reconhecimento de matrículas, reconhecimento de tabelas, ASR+TTS, tradução automática e outras funções, disponível através de dependência Maven. Suporta PyTorch e TensorFlow, com modelos principais integrados como Mtcnn, InsightFace, SeetaFace6, YOLOv8~v12, PaddleOCR(PPOCRv5) e Whisper

    908+3Variação de estrelas nos últimos 7 dias
  • aphantasia@eps696

    CLIP + FFT/DWT/RGB = texto para imagem/vídeo

    789+0Variação de estrelas nos últimos 7 dias
  • FG-CLIP@360CVGroup

    Nova geração do CLIP com forte capacidade de discriminação de granulação fina, ICML2026 e ICML2025

    733+2Variação de estrelas nos últimos 7 dias
  • PaddleMIX@PaddlePaddle

    Integração e Exploração Multimodal do Paddle, dando suporte a tarefas multimodais principais, incluindo modelos de pré-treinamento multimodal em larga escala de ponta a ponta e caixa de ferramentas de modelos de difusão. Equipado com alto desempenho e flexibilidade.

    723-1Variação de estrelas nos últimos 7 dias
  • TrailSnap@LC044

    TrailSnap | Álbum de fotos de código aberto alimentado por IA para memórias de viagens e da vida.

    711+13Variação de estrelas nos últimos 7 dias
  • Uma coleção abrangente de frontend e levantamento de artigos e modelos de repositórios GitHub sobre modelos de visão e linguagem. Atualizações contínuas.

    706+3Variação de estrelas nos últimos 7 dias
  • LLM2CLIP@microsoft

    O LLM2CLIP melhora significativamente modelos CLIP que já são de última geração.

    688+1Variação de estrelas nos últimos 7 dias
  • TwitchLink@devhotteok

    Downloader/Gravador de Streams, Vídeos e Clipes do Twitch. Este downloader com interface gráfica ajuda você a baixar e gravar vídeos do Twitch, incluindo transmissões e VODs.

    681+4Variação de estrelas nos últimos 7 dias
  • video_features@v-iashin

    Extraia características de vídeos brutos usando múltiplas GPUs. Suportamos quadros de fluxo RAFT, bem como modelos S3D, I3D, R(2+1)D, VGGish, CLIP e TIMM.

    656+0Variação de estrelas nos últimos 7 dias
  • 👁️ + 💬 + 🎧 = 🤖 Lista selecionada dos principais modelos de fundação e multimodais! [Artigo + Código + Exemplos + Tutoriais]

    637+0Variação de estrelas nos últimos 7 dias
  • Keras beit, caformer, CMT, CoAtNet, convnext, davit, dino, efficientdet, edgenext, efficientformer, efficientnet, eva, fasternet, fastervit, fastvit, flexivit, gcvit, ghostnet, gpvit, hornet, hiera, iformer, inceptionnext, lcnet, levit, maxvit, mobilevit, moganet, nat, nfnets, pvt, swin, tinynet, tinyvit, uniformer, volo, vanillanet, yolor, yolov7, yolov8, yolox, gpt2, llama2, conhecido como kecam

    626+0Variação de estrelas nos últimos 7 dias
← Voltar para os tópicos