speech-processing
Repositori open source terpantau bertanda speech-processing, diurutkan berdasarkan bintang.
Topik terkait
Topik yang sering muncul berdampingan dengan speech-processing di repositori yang sama.
Yang sedang naik
Repositori yang dibuat dalam 90 hari terakhir dan bertanda speech-processing.
Tidak ada repositori baru bertanda topik ini dalam 90 hari terakhir.
- #1
Toolkit ucapan berbasis PyTorch
★ 11.792+22Perubahan bintang dalam 7 hari terakhir - #2
Blok bangunan neural untuk diarisasi pembicara: deteksi aktivitas suara, deteksi perubahan pembicara, deteksi ucapan tumpang tindih, embedding pembicara
★ 10.484+38Perubahan bintang dalam 7 hari terakhir - #3
Silero VAD: Voice Activity Detector tingkat perusahaan yang telah dilatih sebelumnya
★ 10.083+52Perubahan bintang dalam 7 hari terakhir - #4
Menjadi peneliti/insinyur AI/ML yang mahir dengan buku teks tidak konvensional yang mencakup matematika, komputasi, dan ML dengan pendekatan intuitif.
★ 7.379+33Perubahan bintang dalam 7 hari terakhir - #5
Daftar bacaan untuk topik penelitian dalam machine learning multimodal.
★ 6.925+0Perubahan bintang dalam 7 hari terakhir - #6
Arsitektur fondasi untuk (M)LLM
★ 3.138+1Perubahan bintang dalam 7 hari terakhir - #7
Pengenalan Ucapan Otomatis Multibahasa dengan stempel waktu tingkat kata dan tingkat kepercayaan.
★ 2.841+2Perubahan bintang dalam 7 hari terakhir - #8
Peredaman dan peningkatan kualitas suara berbasis AI.
★ 2.401+6Perubahan bintang dalam 7 hari terakhir - #9★ 2.250+4Perubahan bintang dalam 7 hari terakhir
- #10
Text-to-Speech yang cepat dan dapat dikontrol untuk lebih dari 7000 bahasa!
★ 2.208+0Perubahan bintang dalam 7 hari terakhir - #11
Daftar kurasi makalah, pustaka, dataset, dan sumber daya Speaker Diarization yang luar biasa.
★ 1.893+2Perubahan bintang dalam 7 hari terakhir - #12
💎 Daftar korpus ucapan yang dapat diakses untuk ASR, TTS, dan Teknologi Ucapan lainnya
★ 1.399+0Perubahan bintang dalam 7 hari terakhir - #13
Pemulihan Ucapan Umum
★ 1.376+3Perubahan bintang dalam 7 hari terakhir - #14
Transkripsi yang Dapat Dikontrol. Verbatim (setiap kata, pengisi, jeda, gagap, suara vokal), atau yang dimaksudkan (apa yang ingin dikatakan pembicara, dioptimalkan untuk keterbacaan) dengan stempel waktu tingkat kata.
★ 1.362+21Perubahan bintang dalam 7 hari terakhir - #15
StreamSpeech adalah model "All in One" yang mulus untuk pengenalan suara offline dan simultan, terjemahan suara, serta sintesis suara.
★ 1.288+2Perubahan bintang dalam 7 hari terakhir - #16★ 1.146+0Perubahan bintang dalam 7 hari terakhir
- #17
Kerangka kerja untuk Pemrosesan Ucapan, Bahasa, Audio, dan Musik dengan Large Language Model.
★ 1.056+0Perubahan bintang dalam 7 hari terakhir - #18
Anda dapat menemukan algoritma ucapan yang Anda butuhkan di sini.
★ 878+1Perubahan bintang dalam 7 hari terakhir - #19
[NeurIPS 2021] Benchmark Skala Multipel untuk Pembelajaran Representasi Multimodal
★ 636+0Perubahan bintang dalam 7 hari terakhir - #20
Daftar laboratorium, perusahaan, sumber daya, dan magang di bidang pengenalan suara, rekomendasi atau pendaftaran mandiri dipersilakan
★ 609+0Perubahan bintang dalam 7 hari terakhir