Lompat ke konten utama
buildradar
Sign in
Topik · clip

clip

Repositori open source terpantau bertanda clip, diurutkan berdasarkan bintang.

Repositori
36
Total bintang
69.310
Rata-rata bintang
1.925
Porsi
0,00%

Topik yang sering muncul berdampingan dengan clip di repositori yang sama.

Yang sedang naik

Repositori yang dibuat dalam 90 hari terakhir dan bertanda clip.

Tidak ada repositori baru bertanda topik ini dalam 90 hari terakhir.

  • X-AnyLabeling@CVHub520

    X-AnyLabeling: Aplikasi desktop lintas platform yang ringan, efisien, dan terpadu untuk menganotasi data teks, gambar, video, dan multimodal, menggabungkan alat bawaan yang serbaguna dengan model AI mutakhir serta ekspor multi-format yang fleksibel.

    10.313+59Perubahan bintang dalam 7 hari terakhir
  • Chinese-CLIP@OFA-Sys

    Versi bahasa Mandarin dari CLIP yang mencapai pengambilan lintas modal dan pembuatan representasi dalam bahasa Mandarin.

    6.001+1Perubahan bintang dalam 7 hari terakhir
  • pushdeer@easychen

    Layanan push notification open-source tanpa aplikasi, siap digunakan dengan memindai kode QR di iOS 14+. Mendukung Quick App, klien iOS/Mac, klien Android, dan perangkat kustom.

    5.022-1Perubahan bintang dalam 7 hari terakhir
  • VLMEvalKit@open-compass

    Toolkit evaluasi open-source untuk large multi-modality models (LMMs), mendukung 220+ LMM, 80+ benchmark

    4.375+13Perubahan bintang dalam 7 hari terakhir
  • mmpretrain@open-mmlab

    Kotak Alat Pra-pelatihan dan Tolok Ukur OpenMMLab

    3.850-1Perubahan bintang dalam 7 hari terakhir
  • zero_nlp@yuanzhoulvpi2017

    Solusi NLP bahasa Mandarin (LLM, data, model, pelatihan, inferensi)

    3.836+2Perubahan bintang dalam 7 hari terakhir
  • VLM_survey@jingyi0000

    Koleksi model vision-language yang luar biasa untuk tugas-tugas visi komputer

    3.126+0Perubahan bintang dalam 7 hari terakhir
  • clip-interrogator@pharmapsychotic

    Gambar ke prompt dengan BLIP dan CLIP

    2.984+1Perubahan bintang dalam 7 hari terakhir
  • clip-retrieval@rom1504

    Hitung embedding CLIP dengan mudah dan bangun sistem temu kembali CLIP menggunakannya.

    2.796+1Perubahan bintang dalam 7 hari terakhir
  • 🥂 Menghadapi tantangan hCaptcha dengan elegan menggunakan model bahasa besar multimodal.

    2.483-1Perubahan bintang dalam 7 hari terakhir
  • cambrian@cambrian-mllm

    Cambrian-1 adalah keluarga LLM multimodal dengan desain yang berpusat pada visi.

    2.014+1Perubahan bintang dalam 7 hari terakhir
  • RWidgetHelper@RuffianZhong

    Pengembangan UI Android yang cepat untuk mengatasi berbagai kendala kontrol bawaan

    1.958+0Perubahan bintang dalam 7 hari terakhir
  • Sumber daya wajib bagi siapa saja yang ingin bereksperimen dan membangun di atas vision API OpenAI 🔥

    1.690+0Perubahan bintang dalam 7 hari terakhir
  • clearcam@roryclear

    Tambahkan deteksi objek, pelacakan, notifikasi seluler, dan pencarian ke kamera keamanan apa pun.

    1.557+255Perubahan bintang dalam 7 hari terakhir
  • Video-ChatGPT@mbzuai-oryx

    [ACL 2024 🔥] Video-ChatGPT adalah model percakapan video yang mampu menghasilkan percakapan bermakna tentang video. Model ini menggabungkan kemampuan LLM dengan visual encoder praterkait yang diadaptasi untuk representasi video spatiotemporal. Kami juga memperkenalkan 'Quantitative Evaluation Benchmarking' yang ketat untuk model percakapan berbasis video.

    1.507+1Perubahan bintang dalam 7 hari terakhir
  • UForm@unum-cloud

    AI Multimodal Berukuran Saku untuk pemahaman dan pembuatan konten lintas teks multibahasa, gambar, dan 🔜 video, hingga 5x lebih cepat dari OpenAI CLIP dan LLaVA 🖼️ & 🖋️

    1.247+1Perubahan bintang dalam 7 hari terakhir
  • Awesome-CLIP@yzhuoning

    Daftar keren untuk penelitian tentang CLIP (Contrastive Language-Image Pre-Training).

    1.227+0Perubahan bintang dalam 7 hari terakhir
  • vlms-zero-to-hero@SkalskiP

    Seri ini akan membawa Anda dalam perjalanan dari dasar-dasar NLP dan Computer Vision hingga Vision-Language Models terkini.

    1.179+0Perubahan bintang dalam 7 hari terakhir
  • CLIP4Clip@ArrowLuo

    Implementasi resmi untuk "CLIP4Clip: An Empirical Study of CLIP for End to End Video Clip Retrieval"

    1.032+0Perubahan bintang dalam 7 hari terakhir
  • SmartJavaAI@geekwenjie

    Toolbox algoritma AI offline gratis untuk Java, mendukung pengenalan wajah, deteksi liveness, pengenalan ekspresi, deteksi objek, segmentasi instans, deteksi pejalan kaki, pengenalan teks OCR, pengenalan pelat nomor, pengenalan tabel, ASR+TTS, terjemahan mesin, dan lainnya. Dapat digunakan melalui Maven. Mendukung PyTorch, Tensorflow, serta telah mengintegrasikan model utama seperti Mtcnn, InsightFace, SeetaFace6, YOLOv8~v12, PaddleOCR(PPOCRv5), dan Whisper.

    908+3Perubahan bintang dalam 7 hari terakhir
  • aphantasia@eps696

    CLIP + FFT/DWT/RGB = teks ke gambar/video

    789+0Perubahan bintang dalam 7 hari terakhir
  • FG-CLIP@360CVGroup

    Generasi baru CLIP dengan kemampuan diskriminasi tingkat lanjut yang kuat, ICML2026 dan ICML2025

    733+2Perubahan bintang dalam 7 hari terakhir
  • PaddleMIX@PaddlePaddle

    Integrasi dan Eksplorasi Multimodal Paddle, mendukung tugas multimodal arus utama, termasuk model pra-pelatihan multimodal skala besar end-to-end dan kotak alat model difusi. Dilengkapi dengan kinerja tinggi dan fleksibilitas.

    723-1Perubahan bintang dalam 7 hari terakhir
  • TrailSnap@LC044

    TrailSnap | Album foto sumber terbuka bertenaga AI untuk kenangan perjalanan & kehidupan.

    711+13Perubahan bintang dalam 7 hari terakhir
  • Koleksi Frontend dan survei makalah vision-language model serta repositori GitHub model. Pembaruan berkelanjutan.

    706+3Perubahan bintang dalam 7 hari terakhir
  • LLM2CLIP@microsoft

    LLM2CLIP secara signifikan meningkatkan model CLIP yang sudah canggih.

    688+1Perubahan bintang dalam 7 hari terakhir
  • TwitchLink@devhotteok

    Pewaris/Perekam Siaran, Video, & Klip Twitch. Pengunduh GUI ini membantu Anda mengunduh dan merekam video Twitch, termasuk siaran dan VOD.

    681+4Perubahan bintang dalam 7 hari terakhir
  • video_features@v-iashin

    Ekstrak fitur video dari video mentah menggunakan beberapa GPU. Kami mendukung bingkai alur RAFT serta model S3D, I3D, R(2+1)D, VGGish, CLIP, dan TIMM.

    656+0Perubahan bintang dalam 7 hari terakhir
  • 👁️ + 💬 + 🎧 = 🤖 Daftar pilihan model fondasi dan multimodal teratas! [Makalah + Kode + Contoh + Tutorial]

    637+0Perubahan bintang dalam 7 hari terakhir
  • Keras beit, caformer, CMT, CoAtNet, convnext, davit, dino, efficientdet, edgenext, efficientformer, efficientnet, eva, fasternet, fastervit, fastvit, flexivit, gcvit, ghostnet, gpvit, hornet, hiera, iformer, inceptionnext, lcnet, levit, maxvit, mobilevit, moganet, nat, nfnets, pvt, swin, tinynet, tinyvit, uniformer, volo, vanillanet, yolor, yolov7, yolov8, yolox, gpt2, llama2, alias kecam

    626+0Perubahan bintang dalam 7 hari terakhir
← Kembali ke topik