voice-recognition
Repositori open source terpantau bertanda voice-recognition, diurutkan berdasarkan bintang.
Topik terkait
Topik yang sering muncul berdampingan dengan voice-recognition di repositori yang sama.
Yang sedang naik
Repositori yang dibuat dalam 90 hari terakhir dan bertanda voice-recognition.
Tidak ada repositori baru bertanda topik ini dalam 90 hari terakhir.
- #1
API pengenalan suara offline untuk Android, iOS, Raspberry Pi, dan server dengan Python, Java, C#, dan Node.
★ 15.101+17Perubahan bintang dalam 7 hari terakhir - #2
Toolkit Speech yang mudah digunakan mencakup model Self-Supervised Learning, SOTA/Streaming ASR dengan tanda baca, Streaming TTS dengan frontend teks, Sistem Verifikasi Pembicara, End-to-End Speech Translation, dan Keyword Spotting. Pemenang Penghargaan Demo Terbaik NAACL2022.
★ 12.676+5Perubahan bintang dalam 7 hari terakhir - #3
Toolkit ucapan berbasis PyTorch
★ 11.802+10Perubahan bintang dalam 7 hari terakhir - #4
Speech-to-text, pengenalan maksud, dan text-to-speech dengan latensi sangat rendah untuk membangun agen dan antarmuka suara
★ 10.997+33Perubahan bintang dalam 7 hari terakhir - #5
Silero VAD: Voice Activity Detector tingkat perusahaan yang telah dilatih sebelumnya
★ 10.112+29Perubahan bintang dalam 7 hari terakhir - #6
Implementasi hampir real-time dari Whisper OpenAI.
★ 4.246+3Perubahan bintang dalam 7 hari terakhir - #7
Pustaka alat karakter Mandarin yang lengkap (pinyin, guratan, radikal, idiom, suara, visualisasi, dll.)
★ 3.087+3Perubahan bintang dalam 7 hari terakhir - #8
🐸STT - Toolkit deep learning untuk Speech-to-Text. Melatih dan menerapkan model STT tidak pernah semudah ini.
★ 2.606+1Perubahan bintang dalam 7 hari terakhir - #9★ 2.256+7Perubahan bintang dalam 7 hari terakhir
- #10
🔊 Daftar lengkap dataset sumber terbuka untuk komputasi suara dan audio (95+ dataset).
★ 2.223+1Perubahan bintang dalam 7 hari terakhir - #11
💎 Daftar korpus ucapan yang dapat diakses untuk ASR, TTS, dan Teknologi Ucapan lainnya
★ 1.399+0Perubahan bintang dalam 7 hari terakhir - #12
Proyek ini menggunakan berbagai model pengenalan sidik suara tingkat lanjut seperti EcapaTdnn, ResNetSE, ERes2Net, CAM++, dll. Kemungkinan model lain akan didukung di masa mendatang. Pada saat yang sama, proyek ini juga mendukung metode pra-pemrosesan data MelSpectrogram dan Spectrogram
★ 1.313+1Perubahan bintang dalam 7 hari terakhir - #13
Asisten AI berbasis Python
★ 1.014+0Perubahan bintang dalam 7 hari terakhir - #14
Catatan kapten dan peta bintang 3D untuk Elite Dangerous
★ 898+2Perubahan bintang dalam 7 hari terakhir - #15★ 711+2Perubahan bintang dalam 7 hari terakhir
- #16
Voicetypr - alat dikte suara-ke-teks luring berbasis AI untuk pendiri yang sibuk, vibe coder, dan pengguna AI tingkat lanjut di macOS dan Windows. Alternatif untuk wispr flow dan superwhisper.
★ 707+12Perubahan bintang dalam 7 hari terakhir - #17
framework tolok ukur speech to text
★ 697+0Perubahan bintang dalam 7 hari terakhir - #18
Pengenalan Ucapan untuk proyek React Native Expo
★ 676+5Perubahan bintang dalam 7 hari terakhir - #19★ 671+0Perubahan bintang dalam 7 hari terakhir
- #20
:speech_balloon: /so.nus/ STT (speech to text) untuk Node dengan deteksi kata kunci offline.
★ 638+0Perubahan bintang dalam 7 hari terakhir - #21
Terjemahan audio waktu nyata, menangkap audio sistem + mik, menjalankan ASR (Whisper/SenseVoice), menerjemahkan melalui LLM API dengan tampilan streaming. Sempurna untuk VTuber, streamer langsung, dan menonton konten asing.
★ 621+34Perubahan bintang dalam 7 hari terakhir - #22
Transkripsi waktu nyata menggunakan faster-whisper
★ 614+0Perubahan bintang dalam 7 hari terakhir - #23
🗣 Overlay yang mendapatkan izin suara pengguna dan masukan sebagai teks dalam UI yang dapat disesuaikan
★ 557+1Perubahan bintang dalam 7 hari terakhir