automatic-speech-recognition
Repositori open source terpantau bertanda automatic-speech-recognition, diurutkan berdasarkan bintang.
Topik terkait
Topik yang sering muncul berdampingan dengan automatic-speech-recognition di repositori yang sama.
Yang sedang naik
Repositori yang dibuat dalam 90 hari terakhir dan bertanda automatic-speech-recognition.
Tidak ada repositori baru bertanda topik ini dalam 90 hari terakhir.
- #1
Speech-to-text lokal waktu nyata dengan streaming ASR, diarization pembicara, penerjemahan, dan API yang kompatibel dengan OpenAI/Deepgram
★ 10.990+26Perubahan bintang dalam 7 hari terakhir - #2★ 5.229+2Perubahan bintang dalam 7 hari terakhir
- #3
Layanan API ASR OpenAI Whisper
★ 3.328+2Perubahan bintang dalam 7 hari terakhir - #4
[AutoArk] GPA (General Purpose Audio) dapat melakukan ASR, TTS, dan konversi suara dengan satu model kecil!
★ 3.061+283Perubahan bintang dalam 7 hari terakhir - #5
Model audio CoreML mutakhir di aplikasi Anda — teks-ke-suara, suara-ke-teks, deteksi aktivitas suara, dan diarisasi pembicara. Dalam Swift, didukung oleh open source SOTA.
★ 2.723+22Perubahan bintang dalam 7 hari terakhir - #6
🐸STT - Toolkit deep learning untuk Speech-to-Text. Melatih dan menerapkan model STT tidak pernah semudah ini.
★ 2.606+0Perubahan bintang dalam 7 hari terakhir - #7★ 2.256+8Perubahan bintang dalam 7 hari terakhir
- #8
Model ASR kelas industri sumber terbuka yang mendukung bahasa Mandarin, dialek Tiongkok, dan bahasa Inggris, mencapai SOTA baru pada tolok ukur ASR Mandarin publik, sekaligus menawarkan kemampuan pengenalan lirik lagu yang luar biasa.
★ 1.975+3Perubahan bintang dalam 7 hari terakhir - #9
TensorFlowASR: Automatic Speech Recognition yang hampir mutakhir di Tensorflow 2. Mendukung bahasa yang menggunakan karakter atau subword.
★ 1.010+0Perubahan bintang dalam 7 hari terakhir - #10
Evaluasi sistem speech-to-text Anda dengan ukuran kemiripan seperti word error rate (WER)
★ 927+1Perubahan bintang dalam 7 hari terakhir - #11
Kumpulan sumber daya tentang penerapan Large Language Models (LLMs) dalam Audio AI.
★ 738+1Perubahan bintang dalam 7 hari terakhir - #12
Pengenalan suara luring (offline) menggunakan OpenAI Whisper dan TensorFlow Lite untuk Android.
★ 688-1Perubahan bintang dalam 7 hari terakhir - #13★ 671+0Perubahan bintang dalam 7 hari terakhir
- #14
Sistem ASR All-in-One Kelas Industri SOTA dengan modul ASR, VAD, LID, dan Punc. FireRedASR2 mendukung bahasa Mandarin (Mandarin, 20+ dialek/aksen), Inggris, pencampuran kode, serta ASR ucapan dan nyanyian. FireRedVAD mendukung ucapan/nyanyian/musik dalam 100+ bahasa. FireRedLID mendukung 100+ bahasa dan 20+ dialek Mandarin. FireRedPunc mendukung Mandarin dan Inggris.
★ 669+10Perubahan bintang dalam 7 hari terakhir