Lompat ke konten utama
buildradar
Sign in
Topik · voice-activity-detection

voice-activity-detection

Repositori open source terpantau bertanda voice-activity-detection, diurutkan berdasarkan bintang.

Repositori
23
Total bintang
83.655
Rata-rata bintang
3.637
Porsi
0,00%

Topik yang sering muncul berdampingan dengan voice-activity-detection di repositori yang sama.

Yang sedang naik

Repositori yang dibuat dalam 90 hari terakhir dan bertanda voice-activity-detection.

Tidak ada repositori baru bertanda topik ini dalam 90 hari terakhir.

  • FunASR@modelscope

    Toolkit pengenalan suara open source untuk pelatihan, inferensi, streaming ASR, VAD, tanda baca, pipeline diarization pembicara, dan penyajian yang kompatibel dengan OpenAI/MCP.

    20.136+64Perubahan bintang dalam 7 hari terakhir
  • pyannote-audio@pyannote

    Blok bangunan neural untuk diarisasi pembicara: deteksi aktivitas suara, deteksi perubahan pembicara, deteksi ucapan tumpang tindih, embedding pembicara

    10.500+16Perubahan bintang dalam 7 hari terakhir
  • NoiseTorch@noisetorch

    Peredam kebisingan mikrofon secara real-time di Linux.

    10.315+2Perubahan bintang dalam 7 hari terakhir
  • silero-vad@snakers4

    Silero VAD: Voice Activity Detector tingkat perusahaan yang telah dilatih sebelumnya

    10.112+29Perubahan bintang dalam 7 hari terakhir
  • ffsubsync@smacke

    Sinkronisasi subtitle dengan video secara otomatis.

    7.864+7Perubahan bintang dalam 7 hari terakhir
  • FluidAudio@FluidInference

    Model audio CoreML mutakhir di aplikasi Anda — teks-ke-suara, suara-ke-teks, deteksi aktivitas suara, dan diarisasi pembicara. Dalam Swift, didukung oleh open source SOTA.

    2.723+13Perubahan bintang dalam 7 hari terakhir
  • pluely@iamsrikanthnani

    Alternatif Open Source untuk Cluely - Asisten AI yang sangat cepat dan mengutamakan privasi, bekerja lancar saat rapat, wawancara, dan percakapan tanpa diketahui siapa pun. Dibangun dengan Tauri untuk performa natif, hanya 10MB. Sepenuhnya tidak terdeteksi dalam panggilan video, berbagi layar, dan rekaman.

    2.619+12Perubahan bintang dalam 7 hari terakhir
  • ten-vad@TEN-framework

    Voice Activity Detector (VAD): latensi rendah, performa tinggi, dan ringan

    2.256+7Perubahan bintang dalam 7 hari terakhir
  • voice_datasets@jim-schwoebel

    🔊 Daftar lengkap dataset sumber terbuka untuk komputasi suara dan audio (95+ dataset).

    2.223+1Perubahan bintang dalam 7 hari terakhir
  • vad@ricky0123

    Detektor aktivitas suara (VAD) untuk browser dengan API yang sederhana

    2.046+1Perubahan bintang dalam 7 hari terakhir
  • diart@juanmc2005

    Paket Python untuk membangun aplikasi audio waktu nyata berbasis AI.

    2.024+1Perubahan bintang dalam 7 hari terakhir
  • sherpa-ncnn@k2-fsa

    Pengenalan suara waktu nyata dan deteksi aktivitas suara (VAD) menggunakan Kaldi generasi berikutnya dengan ncnn tanpa koneksi Internet. Mendukung iOS, Android, Linux, macOS, Windows, Raspberry Pi, VisionFive2, LicheePi4A, dll.

    1.777-1Perubahan bintang dalam 7 hari terakhir
  • 💎 Daftar korpus ucapan yang dapat diakses untuk ASR, TTS, dan Teknologi Ucapan lainnya

    1.399+0Perubahan bintang dalam 7 hari terakhir
  • speech-swift@soniqo

    Toolkit bicara AI untuk Apple Silicon — ASR, TTS, speech-to-speech, VAD, dan diarisasi yang didukung oleh MLX dan CoreML

    1.161+4Perubahan bintang dalam 7 hari terakhir
  • Asisten AI berbasis Python

    1.014+0Perubahan bintang dalam 7 hari terakhir
  • whisper.net@sandrohanea

    Whisper.net. Konversi ucapan ke teks menjadi mudah menggunakan Whisper Models

    941+1Perubahan bintang dalam 7 hari terakhir
  • inaSpeechSegmenter@ina-foss

    Toolkit segmentasi audio berbasis CNN. Memungkinkan pendeteksian ucapan, musik, kebisingan, dan jenis kelamin pembicara. Dirancang untuk studi kesetaraan gender skala besar berdasarkan waktu bicara per gender.

    910+1Perubahan bintang dalam 7 hari terakhir
  • auditok@amsehili

    Alat deteksi aktivitas suara dan segmentasi audio

    860+1Perubahan bintang dalam 7 hari terakhir
  • FireRedASR2S@FireRedTeam

    Sistem ASR All-in-One Kelas Industri SOTA dengan modul ASR, VAD, LID, dan Punc. FireRedASR2 mendukung bahasa Mandarin (Mandarin, 20+ dialek/aksen), Inggris, pencampuran kode, serta ASR ucapan dan nyanyian. FireRedVAD mendukung ucapan/nyanyian/musik dalam 100+ bahasa. FireRedLID mendukung 100+ bahasa dan 20+ dialek Mandarin. FireRedPunc mendukung Mandarin dan Inggris.

    670+13Perubahan bintang dalam 7 hari terakhir
  • WhisperS2T@shashikg

    Pipeline Speech-to-Text yang dioptimalkan untuk Model Whisper yang mendukung berbagai Inference Engine

    578+1Perubahan bintang dalam 7 hari terakhir
  • FireRedVAD@FireRedTeam

    Deteksi Aktivitas Suara & Deteksi Acara Audio Kelas Industri SOTA, mendukung 100+ bahasa, mengungguli Silero-VAD, TEN-VAD, FunASR-VAD, dan WebRTC-VAD

    521+6Perubahan bintang dalam 7 hari terakhir
  • subaligner@baxtree

    Secara otomatis menyinkronkan dan menerjemahkan subtitle, atau membuat yang baru dengan transkripsi, menggunakan DNN terlatih, Forced Alignments, dan Transformers. https://subaligner.readthedocs.io/

    509+0Perubahan bintang dalam 7 hari terakhir
  • android-vad@gkonovalov

    Pustaka Android Voice Activity Detection (VAD). Mendukung model WebRTC VAD GMM, Silero VAD DNN, Yamnet VAD DNN.

    506+1Perubahan bintang dalam 7 hari terakhir
← Kembali ke topik