speaker-diarization
Repositori open source terpantau bertanda speaker-diarization, diurutkan berdasarkan bintang.
Topik terkait
Topik yang sering muncul berdampingan dengan speaker-diarization di repositori yang sama.
Yang sedang naik
Repositori yang dibuat dalam 90 hari terakhir dan bertanda speaker-diarization.
Tidak ada repositori baru bertanda topik ini dalam 90 hari terakhir.
- #1
Toolkit pengenalan suara open source untuk pelatihan, inferensi, streaming ASR, VAD, tanda baca, pipeline diarization pembicara, dan penyajian yang kompatibel dengan OpenAI/MCP.
★ 20.136+64Perubahan bintang dalam 7 hari terakhir - #2
Toolkit ucapan berbasis PyTorch
★ 11.802+10Perubahan bintang dalam 7 hari terakhir - #3
Speech-to-text lokal waktu nyata dengan streaming ASR, diarization pembicara, penerjemahan, dan API yang kompatibel dengan OpenAI/Deepgram
★ 10.990+16Perubahan bintang dalam 7 hari terakhir - #4
Blok bangunan neural untuk diarisasi pembicara: deteksi aktivitas suara, deteksi perubahan pembicara, deteksi ucapan tumpang tindih, embedding pembicara
★ 10.500+16Perubahan bintang dalam 7 hari terakhir - #5★ 9.949+3Perubahan bintang dalam 7 hari terakhir
- #6
AI Suara On-device untuk Apple Silicon
★ 6.353+8Perubahan bintang dalam 7 hari terakhir - #7
Pengenalan Ucapan Otomatis (ASR) dengan Speaker Diarization berbasis OpenAI Whisper
★ 5.634+1Perubahan bintang dalam 7 hari terakhir - #8
Executable mandiri Whisper & Faster-Whisper bagi mereka yang tidak ingin repot dengan Python.
★ 3.171+2Perubahan bintang dalam 7 hari terakhir - #9
Repositori untuk verifikasi pembicara, pengenalan pembicara, dan diarisasi pembicara berbasis single-modal dan multi-modal
★ 3.128+3Perubahan bintang dalam 7 hari terakhir - #10
Pengenalan Ucapan Otomatis Multibahasa dengan stempel waktu tingkat kata dan tingkat kepercayaan.
★ 2.842+1Perubahan bintang dalam 7 hari terakhir - #11
Model audio CoreML mutakhir di aplikasi Anda — teks-ke-suara, suara-ke-teks, deteksi aktivitas suara, dan diarisasi pembicara. Dalam Swift, didukung oleh open source SOTA.
★ 2.723+13Perubahan bintang dalam 7 hari terakhir - #12★ 2.024+1Perubahan bintang dalam 7 hari terakhir
- #13
Daftar kurasi makalah, pustaka, dataset, dan sumber daya Speaker Diarization yang luar biasa.
★ 1.894+1Perubahan bintang dalam 7 hari terakhir - #14
Keluarga model ASR berbasis LLM open-source untuk bahasa Mandarin, dialek, aksen, dan ucapan multilingual, lengkap dengan runtime FunASR, vLLM, streaming, dan llama.cpp.
★ 1.512+10Perubahan bintang dalam 7 hari terakhir - #15
Toolkit Verifikasi, Pengenalan, dan Diarisasi Speaker Berorientasi Penelitian dan Produksi
★ 1.402+8Perubahan bintang dalam 7 hari terakhir - #16
Toolkit bicara AI untuk Apple Silicon — ASR, TTS, speech-to-speech, VAD, dan diarisasi yang didukung oleh MLX dan CoreML
★ 1.161+4Perubahan bintang dalam 7 hari terakhir - #17
Layanan transkripsi dan diarisasi luring mandiri yang siap pakai dengan ringkasan LLM
★ 948+2Perubahan bintang dalam 7 hari terakhir - #18
Perangkat lunak generator subtitle otomatis satu-atap, mencakup seluruh proses pengunduhan, transkripsi, penerjemahan, dan hardcode, tanpa intervensi manual
★ 810+3Perubahan bintang dalam 7 hari terakhir - #19★ 677+0Perubahan bintang dalam 7 hari terakhir
- #20
Implementasi ulang Python dari algoritma clustering spektral (terbatas) yang digunakan dalam makalah diarisasi pembicara Google.
★ 555+0Perubahan bintang dalam 7 hari terakhir