clip
Repositori open source terpantau bertanda clip, diurutkan berdasarkan bintang.
Topik terkait
Topik yang sering muncul berdampingan dengan clip di repositori yang sama.
Yang sedang naik
Repositori yang dibuat dalam 90 hari terakhir dan bertanda clip.
Tidak ada repositori baru bertanda topik ini dalam 90 hari terakhir.
- #1
X-AnyLabeling: Aplikasi desktop lintas platform yang ringan, efisien, dan terpadu untuk menganotasi data teks, gambar, video, dan multimodal, menggabungkan alat bawaan yang serbaguna dengan model AI mutakhir serta ekspor multi-format yang fleksibel.
★ 10.313+59Perubahan bintang dalam 7 hari terakhir - #2
Versi bahasa Mandarin dari CLIP yang mencapai pengambilan lintas modal dan pembuatan representasi dalam bahasa Mandarin.
★ 6.001+1Perubahan bintang dalam 7 hari terakhir - #3
Layanan push notification open-source tanpa aplikasi, siap digunakan dengan memindai kode QR di iOS 14+. Mendukung Quick App, klien iOS/Mac, klien Android, dan perangkat kustom.
★ 5.022-1Perubahan bintang dalam 7 hari terakhir - #4
Toolkit evaluasi open-source untuk large multi-modality models (LMMs), mendukung 220+ LMM, 80+ benchmark
★ 4.375+13Perubahan bintang dalam 7 hari terakhir - #5
Kotak Alat Pra-pelatihan dan Tolok Ukur OpenMMLab
★ 3.850-1Perubahan bintang dalam 7 hari terakhir - #6★ 3.836+2Perubahan bintang dalam 7 hari terakhir
- #7
Koleksi model vision-language yang luar biasa untuk tugas-tugas visi komputer
★ 3.126+0Perubahan bintang dalam 7 hari terakhir - #8
Gambar ke prompt dengan BLIP dan CLIP
★ 2.984+1Perubahan bintang dalam 7 hari terakhir - #9
Hitung embedding CLIP dengan mudah dan bangun sistem temu kembali CLIP menggunakannya.
★ 2.796+1Perubahan bintang dalam 7 hari terakhir - #10
🥂 Menghadapi tantangan hCaptcha dengan elegan menggunakan model bahasa besar multimodal.
★ 2.483-1Perubahan bintang dalam 7 hari terakhir - #11
Cambrian-1 adalah keluarga LLM multimodal dengan desain yang berpusat pada visi.
★ 2.014+1Perubahan bintang dalam 7 hari terakhir - #12
Pengembangan UI Android yang cepat untuk mengatasi berbagai kendala kontrol bawaan
★ 1.958+0Perubahan bintang dalam 7 hari terakhir - #13
Sumber daya wajib bagi siapa saja yang ingin bereksperimen dan membangun di atas vision API OpenAI 🔥
★ 1.690+0Perubahan bintang dalam 7 hari terakhir - #14
Tambahkan deteksi objek, pelacakan, notifikasi seluler, dan pencarian ke kamera keamanan apa pun.
★ 1.557+255Perubahan bintang dalam 7 hari terakhir - #15
[ACL 2024 🔥] Video-ChatGPT adalah model percakapan video yang mampu menghasilkan percakapan bermakna tentang video. Model ini menggabungkan kemampuan LLM dengan visual encoder praterkait yang diadaptasi untuk representasi video spatiotemporal. Kami juga memperkenalkan 'Quantitative Evaluation Benchmarking' yang ketat untuk model percakapan berbasis video.
★ 1.507+1Perubahan bintang dalam 7 hari terakhir - #16
AI Multimodal Berukuran Saku untuk pemahaman dan pembuatan konten lintas teks multibahasa, gambar, dan 🔜 video, hingga 5x lebih cepat dari OpenAI CLIP dan LLaVA 🖼️ & 🖋️
★ 1.247+1Perubahan bintang dalam 7 hari terakhir - #17
Daftar keren untuk penelitian tentang CLIP (Contrastive Language-Image Pre-Training).
★ 1.227+0Perubahan bintang dalam 7 hari terakhir - #18
Seri ini akan membawa Anda dalam perjalanan dari dasar-dasar NLP dan Computer Vision hingga Vision-Language Models terkini.
★ 1.179+0Perubahan bintang dalam 7 hari terakhir - #19
Implementasi resmi untuk "CLIP4Clip: An Empirical Study of CLIP for End to End Video Clip Retrieval"
★ 1.032+0Perubahan bintang dalam 7 hari terakhir - #20
Toolbox algoritma AI offline gratis untuk Java, mendukung pengenalan wajah, deteksi liveness, pengenalan ekspresi, deteksi objek, segmentasi instans, deteksi pejalan kaki, pengenalan teks OCR, pengenalan pelat nomor, pengenalan tabel, ASR+TTS, terjemahan mesin, dan lainnya. Dapat digunakan melalui Maven. Mendukung PyTorch, Tensorflow, serta telah mengintegrasikan model utama seperti Mtcnn, InsightFace, SeetaFace6, YOLOv8~v12, PaddleOCR(PPOCRv5), dan Whisper.
★ 908+3Perubahan bintang dalam 7 hari terakhir - #21
CLIP + FFT/DWT/RGB = teks ke gambar/video
★ 789+0Perubahan bintang dalam 7 hari terakhir - #22
Generasi baru CLIP dengan kemampuan diskriminasi tingkat lanjut yang kuat, ICML2026 dan ICML2025
★ 733+2Perubahan bintang dalam 7 hari terakhir - #23
Integrasi dan Eksplorasi Multimodal Paddle, mendukung tugas multimodal arus utama, termasuk model pra-pelatihan multimodal skala besar end-to-end dan kotak alat model difusi. Dilengkapi dengan kinerja tinggi dan fleksibilitas.
★ 723-1Perubahan bintang dalam 7 hari terakhir - #24
TrailSnap | Album foto sumber terbuka bertenaga AI untuk kenangan perjalanan & kehidupan.
★ 711+13Perubahan bintang dalam 7 hari terakhir - #25
Koleksi Frontend dan survei makalah vision-language model serta repositori GitHub model. Pembaruan berkelanjutan.
★ 706+3Perubahan bintang dalam 7 hari terakhir - #26★ 688+1Perubahan bintang dalam 7 hari terakhir
- #27
Pewaris/Perekam Siaran, Video, & Klip Twitch. Pengunduh GUI ini membantu Anda mengunduh dan merekam video Twitch, termasuk siaran dan VOD.
★ 681+4Perubahan bintang dalam 7 hari terakhir - #28
Ekstrak fitur video dari video mentah menggunakan beberapa GPU. Kami mendukung bingkai alur RAFT serta model S3D, I3D, R(2+1)D, VGGish, CLIP, dan TIMM.
★ 656+0Perubahan bintang dalam 7 hari terakhir - #29
👁️ + 💬 + 🎧 = 🤖 Daftar pilihan model fondasi dan multimodal teratas! [Makalah + Kode + Contoh + Tutorial]
★ 637+0Perubahan bintang dalam 7 hari terakhir - #30
Keras beit, caformer, CMT, CoAtNet, convnext, davit, dino, efficientdet, edgenext, efficientformer, efficientnet, eva, fasternet, fastervit, fastvit, flexivit, gcvit, ghostnet, gpvit, hornet, hiera, iformer, inceptionnext, lcnet, levit, maxvit, mobilevit, moganet, nat, nfnets, pvt, swin, tinynet, tinyvit, uniformer, volo, vanillanet, yolor, yolov7, yolov8, yolox, gpt2, llama2, alias kecam
★ 626+0Perubahan bintang dalam 7 hari terakhir