voice-activity-detection
Repositori open source terpantau bertanda voice-activity-detection, diurutkan berdasarkan bintang.
Topik terkait
Topik yang sering muncul berdampingan dengan voice-activity-detection di repositori yang sama.
Yang sedang naik
Repositori yang dibuat dalam 90 hari terakhir dan bertanda voice-activity-detection.
Tidak ada repositori baru bertanda topik ini dalam 90 hari terakhir.
- #1
Toolkit pengenalan suara open source untuk pelatihan, inferensi, streaming ASR, VAD, tanda baca, pipeline diarization pembicara, dan penyajian yang kompatibel dengan OpenAI/MCP.
★ 20.136+64Perubahan bintang dalam 7 hari terakhir - #2
Blok bangunan neural untuk diarisasi pembicara: deteksi aktivitas suara, deteksi perubahan pembicara, deteksi ucapan tumpang tindih, embedding pembicara
★ 10.500+16Perubahan bintang dalam 7 hari terakhir - #3
Peredam kebisingan mikrofon secara real-time di Linux.
★ 10.315+2Perubahan bintang dalam 7 hari terakhir - #4
Silero VAD: Voice Activity Detector tingkat perusahaan yang telah dilatih sebelumnya
★ 10.112+29Perubahan bintang dalam 7 hari terakhir - #5★ 7.864+7Perubahan bintang dalam 7 hari terakhir
- #6
Model audio CoreML mutakhir di aplikasi Anda — teks-ke-suara, suara-ke-teks, deteksi aktivitas suara, dan diarisasi pembicara. Dalam Swift, didukung oleh open source SOTA.
★ 2.723+13Perubahan bintang dalam 7 hari terakhir - #7
Alternatif Open Source untuk Cluely - Asisten AI yang sangat cepat dan mengutamakan privasi, bekerja lancar saat rapat, wawancara, dan percakapan tanpa diketahui siapa pun. Dibangun dengan Tauri untuk performa natif, hanya 10MB. Sepenuhnya tidak terdeteksi dalam panggilan video, berbagi layar, dan rekaman.
★ 2.619+12Perubahan bintang dalam 7 hari terakhir - #8★ 2.256+7Perubahan bintang dalam 7 hari terakhir
- #9
🔊 Daftar lengkap dataset sumber terbuka untuk komputasi suara dan audio (95+ dataset).
★ 2.223+1Perubahan bintang dalam 7 hari terakhir - #10★ 2.046+1Perubahan bintang dalam 7 hari terakhir
- #11★ 2.024+1Perubahan bintang dalam 7 hari terakhir
- #12
Pengenalan suara waktu nyata dan deteksi aktivitas suara (VAD) menggunakan Kaldi generasi berikutnya dengan ncnn tanpa koneksi Internet. Mendukung iOS, Android, Linux, macOS, Windows, Raspberry Pi, VisionFive2, LicheePi4A, dll.
★ 1.777-1Perubahan bintang dalam 7 hari terakhir - #13
💎 Daftar korpus ucapan yang dapat diakses untuk ASR, TTS, dan Teknologi Ucapan lainnya
★ 1.399+0Perubahan bintang dalam 7 hari terakhir - #14
Toolkit bicara AI untuk Apple Silicon — ASR, TTS, speech-to-speech, VAD, dan diarisasi yang didukung oleh MLX dan CoreML
★ 1.161+4Perubahan bintang dalam 7 hari terakhir - #15
Asisten AI berbasis Python
★ 1.014+0Perubahan bintang dalam 7 hari terakhir - #16
Whisper.net. Konversi ucapan ke teks menjadi mudah menggunakan Whisper Models
★ 941+1Perubahan bintang dalam 7 hari terakhir - #17
Toolkit segmentasi audio berbasis CNN. Memungkinkan pendeteksian ucapan, musik, kebisingan, dan jenis kelamin pembicara. Dirancang untuk studi kesetaraan gender skala besar berdasarkan waktu bicara per gender.
★ 910+1Perubahan bintang dalam 7 hari terakhir - #18★ 860+1Perubahan bintang dalam 7 hari terakhir
- #19
Sistem ASR All-in-One Kelas Industri SOTA dengan modul ASR, VAD, LID, dan Punc. FireRedASR2 mendukung bahasa Mandarin (Mandarin, 20+ dialek/aksen), Inggris, pencampuran kode, serta ASR ucapan dan nyanyian. FireRedVAD mendukung ucapan/nyanyian/musik dalam 100+ bahasa. FireRedLID mendukung 100+ bahasa dan 20+ dialek Mandarin. FireRedPunc mendukung Mandarin dan Inggris.
★ 670+13Perubahan bintang dalam 7 hari terakhir - #20
Pipeline Speech-to-Text yang dioptimalkan untuk Model Whisper yang mendukung berbagai Inference Engine
★ 578+1Perubahan bintang dalam 7 hari terakhir - #21
Deteksi Aktivitas Suara & Deteksi Acara Audio Kelas Industri SOTA, mendukung 100+ bahasa, mengungguli Silero-VAD, TEN-VAD, FunASR-VAD, dan WebRTC-VAD
★ 521+6Perubahan bintang dalam 7 hari terakhir - #22
Secara otomatis menyinkronkan dan menerjemahkan subtitle, atau membuat yang baru dengan transkripsi, menggunakan DNN terlatih, Forced Alignments, dan Transformers. https://subaligner.readthedocs.io/
★ 509+0Perubahan bintang dalam 7 hari terakhir - #23
Pustaka Android Voice Activity Detection (VAD). Mendukung model WebRTC VAD GMM, Silero VAD DNN, Yamnet VAD DNN.
★ 506+1Perubahan bintang dalam 7 hari terakhir