跳到主要内容
buildradar
Sign in
主题 · clip

clip

标记 clip 主题、收录中的开源项目,按星标数排序。

项目数
36
总星标数
69,310
平均星标数
1,925
占比
0.00%

常跟 clip 一起出现在同一个项目上的主题。

近期新秀

近 90 天内创建、标记 clip 主题的项目。

近 90 天内还没有新项目标记这个主题。

  • X-AnyLabeling@CVHub520

    X-AnyLabeling:轻量、高效、统一的跨平台桌面标注应用,支持文字、图像、视频与多模态数据,结合多功能内置工具、最先进 AI 模型与灵活多格式导出

    10,313+59近 7 天星标变化
  • Chinese-CLIP@OFA-Sys

    中文版本的 CLIP,实现中文跨模态检索与表征生成。

    6,001+1近 7 天星标变化
  • pushdeer@easychen

    开源无 App 推送服务,iOS14+ 二维码即用;亦支持快应用/iOS 与 Mac 客户端、Android 客户端、自制设备

    5,022-1近 7 天星标变化
  • VLMEvalKit@open-compass

    开源大型多模态模型评估工具包,支持220+ LMMs与80+基准测试

    4,375+13近 7 天星标变化
  • mmpretrain@open-mmlab

    OpenMMLab 预训练工具箱与基准测试

    3,850-1近 7 天星标变化
  • zero_nlp@yuanzhoulvpi2017

    中文 NLP 解决方案(大模型、数据、模型、训练、推理)

    3,836+2近 7 天星标变化
  • VLM_survey@jingyi0000

    用於視覺任務的精選視覺語言模型合集

    3,126+0近 7 天星标变化
  • clip-interrogator@pharmapsychotic

    使用 BLIP 与 CLIP 将图像转为提示

    2,984+1近 7 天星标变化
  • clip-retrieval@rom1504

    轻松计算 clip embeddings 并使用它们构建 clip 检索系统

    2,796+1近 7 天星标变化
  • 🥂 利用多模态大型语言模型优雅地应对 hCaptcha 验证。

    2,483-1近 7 天星标变化
  • cambrian@cambrian-mllm

    Cambrian-1 是一个采用视觉中心设计的多模态 LLM 系列。

    2,014+1近 7 天星标变化
  • RWidgetHelper@RuffianZhong

    Android UI 快速开发,专治原生控件各种不服

    1,958+0近 7 天星标变化
  • 任何想要实验并基于 OpenAI vision API 者的必备资源 🔥

    1,690+0近 7 天星标变化
  • clearcam@roryclear

    为任何安全摄像头新增对象检测、追踪、移动通知与搜索功能。

    1,557+255近 7 天星标变化
  • Video-ChatGPT@mbzuai-oryx

    [ACL 2024 🔥] Video-ChatGPT 是一个能够针对视频生成有意义对话的视频对话模型。它结合了 LLM 的能力与适应时空视频表示的预训练视觉编码器。我们也为基于视频的对话模型引入了严格的“量化评估基准”。

    1,507+1近 7 天星标变化
  • UForm@unum-cloud

    袖珍型多模态 AI,用于跨多语言文字、图片和视频的内容理解与生成,速度比 OpenAI CLIP 和 LLaVA 快达 5 倍

    1,247+1近 7 天星标变化
  • Awesome-CLIP@yzhuoning

    关于 CLIP(对比语言—图像预训练)研究的 Awesome 资源列表。

    1,227+0近 7 天星标变化
  • vlms-zero-to-hero@SkalskiP

    本系列将带领您从 NLP 与 Computer Vision 的基础,一路探索至 Vision-Language Models 的尖端技术。

    1,179+0近 7 天星标变化
  • CLIP4Clip@ArrowLuo

    「CLIP4Clip: An Empirical Study of CLIP for End to End Video Clip Retrieval」的官方实现

    1,032+1近 7 天星标变化
  • SmartJavaAI@geekwenjie

    🔥🔥🔥Java免费离线AI算法工具箱,支持人脸识别、活体检测、表情识别、目标检测、实例分割、行人检测、OCR文字识别、车牌识别、表格识别、ASR+TTS、机器翻译等功能,Maven引用即可使用。支持PyTorch、Tensorflow,已集成 Mtcnn、InsightFace、SeetaFace6、YOLOv8~v12、PaddleOCR(PPOCRv5)、Whisper等主流模型

    909+3近 7 天星标变化
  • aphantasia@eps696

    CLIP + FFT/DWT/RGB = 文字转图像/视频

    789+0近 7 天星标变化
  • FG-CLIP@360CVGroup

    新一代具备强大细粒度判别能力的 CLIP,ICML2026 与 ICML2025

    733+2近 7 天星标变化
  • PaddleMIX@PaddlePaddle

    Paddle 多模态整合与探索,支持主流多模态任务,包含端到端大型多模态预训练模型与扩散模型工具箱。具备高性能与灵活性。

    723-1近 7 天星标变化
  • TrailSnap@LC044

    TrailSnap (行影集) | AI 驱动的开源相簿工具,珍藏旅行与生活点滴。

    716+15近 7 天星标变化
  • 视觉语言模型论文与模型的顶级前端收集与调查 GitHub 仓库。持续更新中。

    706+3近 7 天星标变化
  • LLM2CLIP@microsoft

    LLM2CLIP 显著提升了原本已属顶尖的 CLIP 模型。

    688+1近 7 天星标变化
  • TwitchLink@devhotteok

    Twitch 直播、视频与剪辑下载/录制器。此图形界面下载器可协助你下载与录制 Twitch 视频,包含直播与 VOD。

    683+4近 7 天星标变化
  • video_features@v-iashin

    使用多张 GPU 从原始视频中提取视频特征。支持 RAFT 光流帧,以及 S3D、I3D、R(2+1)D、VGGish、CLIP 与 TIMM 模型。

    656+1近 7 天星标变化
  • 👁️ + 💬 + 🎧 = 🤖 精选顶级基础与多模态模型列表![论文 + 代码 + 示例 + 教程]

    637+0近 7 天星标变化
  • Keras beit,caformer,CMT,CoAtNet,convnext,davit,dino,efficientdet,edgenext,efficientformer,efficientnet,eva,fasternet,fastervit,fastvit,flexivit,gcvit,ghostnet,gpvit,hornet,hiera,iformer,inceptionnext,lcnet,levit,maxvit,mobilevit,moganet,nat,nfnets,pvt,swin,tinynet,tinyvit,uniformer,volo,vanillanet,yolor,yolov7,yolov8,yolox,gpt2,llama2, 别名 kecam

    626+0近 7 天星标变化
← 返回主题列表