clip
Dépôts open source suivis étiquetés clip, triés par étoiles.
Sujets associés
Sujets qui apparaissent souvent aux côtés de clip sur un même dépôt.
Ascensions récentes
Dépôts créés au cours des 90 derniers jours et étiquetés clip.
Aucun nouveau dépôt étiqueté avec ce sujet au cours des 90 derniers jours.
- #1
X-AnyLabeling : une application de bureau multiplateforme légère, efficace et unifiée pour l'annotation de texte, d'images, de vidéos et de données multimodales, combinant des outils intégrés polyvalents avec des modèles d'IA de pointe et une exportation flexible multi-format.
★ 10 313+59Évolution des étoiles sur les 7 derniers jours - #2
Version chinoise de CLIP permettant la recherche intermodale et la génération de représentations en chinois
★ 6 001+1Évolution des étoiles sur les 7 derniers jours - #3
Service de notification push open-source sans application, utilisable via QR code sur iOS 14+. Prend également en charge les Quick Apps, les clients iOS, Mac et Android, ainsi que les appareils personnalisés.
★ 5 022-1Évolution des étoiles sur les 7 derniers jours - #4
Boîte à outils d'évaluation open-source pour grands modèles multimodaux (LMM), prenant en charge plus de 220 LMM et 80 benchmarks
★ 4 375+13Évolution des étoiles sur les 7 derniers jours - #5
Boîte à outils et benchmark de pré-entraînement OpenMMLab.
★ 3 850-1Évolution des étoiles sur les 7 derniers jours - #6
Solutions NLP en chinois (grands modèles, données, modèles, entraînement, inférence).
★ 3 836+2Évolution des étoiles sur les 7 derniers jours - #7
Collection de modèles vision-langage impressionnants pour les tâches de vision par ordinateur.
★ 3 126+0Évolution des étoiles sur les 7 derniers jours - #8
Génération de prompts à partir d'images avec BLIP et CLIP.
★ 2 984+1Évolution des étoiles sur les 7 derniers jours - #9
Calculez facilement des embeddings CLIP et construisez un système de recherche basé sur ces derniers.
★ 2 796+1Évolution des étoiles sur les 7 derniers jours - #10
🥂 Résolvez les défis hCaptcha avec élégance grâce à un modèle de langage multimodal.
★ 2 483-1Évolution des étoiles sur les 7 derniers jours - #11
Cambrian-1 est une famille de LLM multimodaux avec une conception centrée sur la vision.
★ 2 014+1Évolution des étoiles sur les 7 derniers jours - #12
Développement rapide d'interfaces Android, conçu pour surmonter les limitations des composants natifs
★ 1 958+0Évolution des étoiles sur les 7 derniers jours - #13
Ressource indispensable pour quiconque souhaite expérimenter et construire sur l'API vision d'OpenAI.
★ 1 690+0Évolution des étoiles sur les 7 derniers jours - #14
Ajoutez la détection d'objets, le suivi, les notifications mobiles et la recherche à n'importe quelle caméra de sécurité.
★ 1 557+255Évolution des étoiles sur les 7 derniers jours - #15
[ACL 2024 🔥] Video-ChatGPT est un modèle de conversation vidéo capable de générer des échanges pertinents sur des vidéos. Il combine les capacités des LLM avec un encodeur visuel pré-entraîné adapté à la représentation spatio-temporelle des vidéos. Nous introduisons également un banc d'essai d'évaluation quantitative rigoureux pour les modèles conversationnels basés sur la vidéo.
★ 1 507+1Évolution des étoiles sur les 7 derniers jours - #16
IA multimodale de poche pour la compréhension et la génération de contenu textuel, image et bientôt vidéo, jusqu'à 5 fois plus rapide qu'OpenAI CLIP et LLaVA
★ 1 247+1Évolution des étoiles sur les 7 derniers jours - #17
Liste de ressources pour la recherche sur CLIP (Contrastive Language-Image Pre-Training).
★ 1 227+0Évolution des étoiles sur les 7 derniers jours - #18
Cette série vous emmène des fondamentaux du NLP et de la vision par ordinateur jusqu'à la pointe des modèles vision-langage.
★ 1 179+0Évolution des étoiles sur les 7 derniers jours - #19
Implémentation officielle pour CLIP4Clip : une étude empirique de CLIP pour la recherche de clips vidéo de bout en bout.
★ 1 031+0Évolution des étoiles sur les 7 derniers jours - #20
Boîte à outils d'algorithmes d'IA hors ligne gratuite pour Java, prenant en charge la reconnaissance faciale, la détection de vivant, la reconnaissance d'expressions, la détection d'objets, la segmentation d'instances, la détection de piétons, l'OCR, la reconnaissance de plaques d'immatriculation, la reconnaissance de tableaux, ASR+TTS, la traduction automatique, etc. Utilisable via Maven. Supporte PyTorch et Tensorflow, avec intégration de modèles tels que Mtcnn, InsightFace, SeetaFace6, YOLOv8~v12, PaddleOCR (PPOCRv5) et Whisper.
★ 908+3Évolution des étoiles sur les 7 derniers jours - #21
CLIP + FFT/DWT/RGB = texte vers image/vidéo.
★ 789+0Évolution des étoiles sur les 7 derniers jours - #22
Nouvelle génération de CLIP avec une forte capacité de discrimination fine, ICML2026 et ICML2025
★ 733+2Évolution des étoiles sur les 7 derniers jours - #23
Paddle Multimodal Integration and eXploration, prenant en charge les tâches multimodales courantes, incluant des modèles de pré-entraînement multimodaux à grande échelle et une boîte à outils de modèles de diffusion, alliant haute performance et flexibilité.
★ 723-1Évolution des étoiles sur les 7 derniers jours - #24
TrailSnap (行影集) | Album photo open-source alimenté par l'IA pour les souvenirs de voyage et de vie(AI赋能的开源相册工具,珍藏旅行与生活点滴)
★ 711+13Évolution des étoiles sur les 7 derniers jours - #25
Une collection frontend et un état de l'art complets des articles et modèles vision-langage sur GitHub. Mises à jour continues.
★ 706+3Évolution des étoiles sur les 7 derniers jours - #26
LLM2CLIP améliore significativement les modèles CLIP déjà à la pointe de la technologie.
★ 688+1Évolution des étoiles sur les 7 derniers jours - #27
Téléchargeur/Enregistreur de flux, vidéos et clips Twitch. Cette interface graphique vous permet de télécharger et d'enregistrer des vidéos Twitch, y compris les diffusions en direct et les VOD
★ 681+4Évolution des étoiles sur les 7 derniers jours - #28
Extraction de caractéristiques vidéo à partir de vidéos brutes utilisant plusieurs GPU. Nous prenons en charge les frames de flux RAFT ainsi que les modèles S3D, I3D, R(2+1)D, VGGish, CLIP, et TIMM
★ 656+0Évolution des étoiles sur les 7 derniers jours - #29
👁️ + 💬 + 🎧 = 🤖 Liste sélectionnée des principaux modèles de fondation et multimodaux ! [Article + Code + Exemples + Tutoriels]
★ 637+0Évolution des étoiles sur les 7 derniers jours - #30
Keras beit, caformer, CMT, CoAtNet, convnext, davit, dino, efficientdet, edgenext, efficientformer, efficientnet, eva, fasternet, fastervit, fastvit, flexivit, gcvit, ghostnet, gpvit, hornet, hiera, iformer, inceptionnext, lcnet, levit, maxvit, mobilevit, moganet, nat, nfnets, pvt, swin, tinynet, tinyvit, uniformer, volo, vanillanet, yolor, yolov7, yolov8, yolox, gpt2, llama2, alias kecam
★ 626+0Évolution des étoiles sur les 7 derniers jours