Aller au contenu principal
buildradar
Sign in
Sujet · clip

clip

Dépôts open source suivis étiquetés clip, triés par étoiles.

Dépôts
36
Total d'étoiles
69 310
Étoiles en moyenne
1 925
Part
0,00%

Sujets qui apparaissent souvent aux côtés de clip sur un même dépôt.

Ascensions récentes

Dépôts créés au cours des 90 derniers jours et étiquetés clip.

Aucun nouveau dépôt étiqueté avec ce sujet au cours des 90 derniers jours.

  • X-AnyLabeling@CVHub520

    X-AnyLabeling : une application de bureau multiplateforme légère, efficace et unifiée pour l'annotation de texte, d'images, de vidéos et de données multimodales, combinant des outils intégrés polyvalents avec des modèles d'IA de pointe et une exportation flexible multi-format.

    10 313+59Évolution des étoiles sur les 7 derniers jours
  • Chinese-CLIP@OFA-Sys

    Version chinoise de CLIP permettant la recherche intermodale et la génération de représentations en chinois

    6 001+1Évolution des étoiles sur les 7 derniers jours
  • pushdeer@easychen

    Service de notification push open-source sans application, utilisable via QR code sur iOS 14+. Prend également en charge les Quick Apps, les clients iOS, Mac et Android, ainsi que les appareils personnalisés.

    5 022-1Évolution des étoiles sur les 7 derniers jours
  • VLMEvalKit@open-compass

    Boîte à outils d'évaluation open-source pour grands modèles multimodaux (LMM), prenant en charge plus de 220 LMM et 80 benchmarks

    4 375+13Évolution des étoiles sur les 7 derniers jours
  • mmpretrain@open-mmlab

    Boîte à outils et benchmark de pré-entraînement OpenMMLab.

    3 850-1Évolution des étoiles sur les 7 derniers jours
  • zero_nlp@yuanzhoulvpi2017

    Solutions NLP en chinois (grands modèles, données, modèles, entraînement, inférence).

    3 836+2Évolution des étoiles sur les 7 derniers jours
  • VLM_survey@jingyi0000

    Collection de modèles vision-langage impressionnants pour les tâches de vision par ordinateur.

    3 126+0Évolution des étoiles sur les 7 derniers jours
  • clip-interrogator@pharmapsychotic

    Génération de prompts à partir d'images avec BLIP et CLIP.

    2 984+1Évolution des étoiles sur les 7 derniers jours
  • clip-retrieval@rom1504

    Calculez facilement des embeddings CLIP et construisez un système de recherche basé sur ces derniers.

    2 796+1Évolution des étoiles sur les 7 derniers jours
  • 🥂 Résolvez les défis hCaptcha avec élégance grâce à un modèle de langage multimodal.

    2 483-1Évolution des étoiles sur les 7 derniers jours
  • cambrian@cambrian-mllm

    Cambrian-1 est une famille de LLM multimodaux avec une conception centrée sur la vision.

    2 014+1Évolution des étoiles sur les 7 derniers jours
  • RWidgetHelper@RuffianZhong

    Développement rapide d'interfaces Android, conçu pour surmonter les limitations des composants natifs

    1 958+0Évolution des étoiles sur les 7 derniers jours
  • Ressource indispensable pour quiconque souhaite expérimenter et construire sur l'API vision d'OpenAI.

    1 690+0Évolution des étoiles sur les 7 derniers jours
  • clearcam@roryclear

    Ajoutez la détection d'objets, le suivi, les notifications mobiles et la recherche à n'importe quelle caméra de sécurité.

    1 557+255Évolution des étoiles sur les 7 derniers jours
  • Video-ChatGPT@mbzuai-oryx

    [ACL 2024 🔥] Video-ChatGPT est un modèle de conversation vidéo capable de générer des échanges pertinents sur des vidéos. Il combine les capacités des LLM avec un encodeur visuel pré-entraîné adapté à la représentation spatio-temporelle des vidéos. Nous introduisons également un banc d'essai d'évaluation quantitative rigoureux pour les modèles conversationnels basés sur la vidéo.

    1 507+1Évolution des étoiles sur les 7 derniers jours
  • UForm@unum-cloud

    IA multimodale de poche pour la compréhension et la génération de contenu textuel, image et bientôt vidéo, jusqu'à 5 fois plus rapide qu'OpenAI CLIP et LLaVA

    1 247+1Évolution des étoiles sur les 7 derniers jours
  • Awesome-CLIP@yzhuoning

    Liste de ressources pour la recherche sur CLIP (Contrastive Language-Image Pre-Training).

    1 227+0Évolution des étoiles sur les 7 derniers jours
  • vlms-zero-to-hero@SkalskiP

    Cette série vous emmène des fondamentaux du NLP et de la vision par ordinateur jusqu'à la pointe des modèles vision-langage.

    1 179+0Évolution des étoiles sur les 7 derniers jours
  • CLIP4Clip@ArrowLuo

    Implémentation officielle pour CLIP4Clip : une étude empirique de CLIP pour la recherche de clips vidéo de bout en bout.

    1 031+0Évolution des étoiles sur les 7 derniers jours
  • SmartJavaAI@geekwenjie

    Boîte à outils d'algorithmes d'IA hors ligne gratuite pour Java, prenant en charge la reconnaissance faciale, la détection de vivant, la reconnaissance d'expressions, la détection d'objets, la segmentation d'instances, la détection de piétons, l'OCR, la reconnaissance de plaques d'immatriculation, la reconnaissance de tableaux, ASR+TTS, la traduction automatique, etc. Utilisable via Maven. Supporte PyTorch et Tensorflow, avec intégration de modèles tels que Mtcnn, InsightFace, SeetaFace6, YOLOv8~v12, PaddleOCR (PPOCRv5) et Whisper.

    908+3Évolution des étoiles sur les 7 derniers jours
  • aphantasia@eps696

    CLIP + FFT/DWT/RGB = texte vers image/vidéo.

    789+0Évolution des étoiles sur les 7 derniers jours
  • FG-CLIP@360CVGroup

    Nouvelle génération de CLIP avec une forte capacité de discrimination fine, ICML2026 et ICML2025

    733+2Évolution des étoiles sur les 7 derniers jours
  • PaddleMIX@PaddlePaddle

    Paddle Multimodal Integration and eXploration, prenant en charge les tâches multimodales courantes, incluant des modèles de pré-entraînement multimodaux à grande échelle et une boîte à outils de modèles de diffusion, alliant haute performance et flexibilité.

    723-1Évolution des étoiles sur les 7 derniers jours
  • TrailSnap@LC044

    TrailSnap (行影集) | Album photo open-source alimenté par l'IA pour les souvenirs de voyage et de vie(AI赋能的开源相册工具,珍藏旅行与生活点滴)

    711+13Évolution des étoiles sur les 7 derniers jours
  • Une collection frontend et un état de l'art complets des articles et modèles vision-langage sur GitHub. Mises à jour continues.

    706+3Évolution des étoiles sur les 7 derniers jours
  • LLM2CLIP@microsoft

    LLM2CLIP améliore significativement les modèles CLIP déjà à la pointe de la technologie.

    688+1Évolution des étoiles sur les 7 derniers jours
  • TwitchLink@devhotteok

    Téléchargeur/Enregistreur de flux, vidéos et clips Twitch. Cette interface graphique vous permet de télécharger et d'enregistrer des vidéos Twitch, y compris les diffusions en direct et les VOD

    681+4Évolution des étoiles sur les 7 derniers jours
  • video_features@v-iashin

    Extraction de caractéristiques vidéo à partir de vidéos brutes utilisant plusieurs GPU. Nous prenons en charge les frames de flux RAFT ainsi que les modèles S3D, I3D, R(2+1)D, VGGish, CLIP, et TIMM

    656+0Évolution des étoiles sur les 7 derniers jours
  • 👁️ + 💬 + 🎧 = 🤖 Liste sélectionnée des principaux modèles de fondation et multimodaux ! [Article + Code + Exemples + Tutoriels]

    637+0Évolution des étoiles sur les 7 derniers jours
  • Keras beit, caformer, CMT, CoAtNet, convnext, davit, dino, efficientdet, edgenext, efficientformer, efficientnet, eva, fasternet, fastervit, fastvit, flexivit, gcvit, ghostnet, gpvit, hornet, hiera, iformer, inceptionnext, lcnet, levit, maxvit, mobilevit, moganet, nat, nfnets, pvt, swin, tinynet, tinyvit, uniformer, volo, vanillanet, yolor, yolov7, yolov8, yolox, gpt2, llama2, alias kecam

    626+0Évolution des étoiles sur les 7 derniers jours
← Retour aux sujets