asr
Repositori open source terpantau bertanda asr, diurutkan berdasarkan bintang.
- #61
Voxtral ASR & TTS berjalan secara native dan di dalam browser. Implementasi Rust dari ASR / TTS real-time mini Voxtral milik Mistral menggunakan framework Burn ML
★ 819+2Perubahan bintang dalam 7 hari terakhir - #62
🎙️ Asisten produktivitas suara cerdas yang mengubah ucapan menjadi teks bersih, tindakan yang berguna, dan pengetahuan terstruktur. Membantu pengguna menangkap ide, berkomunikasi secara alami, mengotomatiskan tugas repetitif, dan tetap produktif di berbagai aplikasi dan alur kerja.
★ 807+5Perubahan bintang dalam 7 hari terakhir - #63
AI VTuber dengan teknologi LLM, ASR, TTS, OCR, CV, dan lainnya untuk siaran langsung atau bermain Minecraft bersama Anda.
★ 803+5Perubahan bintang dalam 7 hari terakhir - #64
BiBi Keyboard: Aplikasi keyboard metode masukan suara LLM dan ASR untuk platform Android berbasis Kotlin
★ 772+17Perubahan bintang dalam 7 hari terakhir - #65
📦 Konversi cepat antara angka Tiongkok dan angka Arab (fitur terbaru: konversi pecahan, tanggal, suhu, dll.)
★ 766+0Perubahan bintang dalam 7 hari terakhir - #66
Pengenalan suara berbasis PaddlePaddle, pengenalan suara bahasa Mandarin. Proyek yang lengkap dengan hasil pengenalan yang baik. Mendukung pelatihan dan prediksi di bawah Windows dan Linux, serta mendukung prediksi papan pengembang Nvidia Jetson.
★ 763+0Perubahan bintang dalam 7 hari terakhir - #67
Menjalankan model speech-to-text (whisper.cpp) di Unity3d pada mesin lokal Anda.
★ 751+1Perubahan bintang dalam 7 hari terakhir - #68
Kerangka kerja Automatic Speech Recognition (ASR) streaming dan non-streaming yang diimplementasikan dengan PyTorch, kompatibel dengan pengenalan online dan offline, saat ini mendukung model Conformer, Squeezeformer, dan DeepSpeech2, serta berbagai metode augmentasi data.
★ 727+0Perubahan bintang dalam 7 hari terakhir - #69
Toolkit Open-Source untuk Pengenalan Ucapan End-to-End yang memanfaatkan PyTorch-Lightning dan Hydra.
★ 714+0Perubahan bintang dalam 7 hari terakhir - #70
Pengenalan suara luring (offline) menggunakan OpenAI Whisper dan TensorFlow Lite untuk Android.
★ 688+0Perubahan bintang dalam 7 hari terakhir - #71
Makalah INTERSPEECH 2023-2024: Kumpulan lengkap makalah penelitian yang berpengaruh dan menarik dari konferensi INTERSPEECH 2023-24. Jelajahi kemajuan terbaru dalam pemrosesan ucapan dan bahasa. Disertai kode. Beri bintang pada repositori untuk mendukung kemajuan teknologi ucapan!
★ 684+0Perubahan bintang dalam 7 hari terakhir - #72★ 677+0Perubahan bintang dalam 7 hari terakhir
- #73
Sistem ASR All-in-One Kelas Industri SOTA dengan modul ASR, VAD, LID, dan Punc. FireRedASR2 mendukung bahasa Mandarin (Mandarin, 20+ dialek/aksen), Inggris, pencampuran kode, serta ASR ucapan dan nyanyian. FireRedVAD mendukung ucapan/nyanyian/musik dalam 100+ bahasa. FireRedLID mendukung 100+ bahasa dan 20+ dialek Mandarin. FireRedPunc mendukung Mandarin dan Inggris.
★ 672+13Perubahan bintang dalam 7 hari terakhir - #74★ 671+0Perubahan bintang dalam 7 hari terakhir
- #75
Terjemahan audio waktu nyata, menangkap audio sistem + mik, menjalankan ASR (Whisper/SenseVoice), menerjemahkan melalui LLM API dengan tampilan streaming. Sempurna untuk VTuber, streamer langsung, dan menonton konten asing.
★ 626+38Perubahan bintang dalam 7 hari terakhir - #76
Teori, makalah, dan PPT pengenalan suara.
★ 618+0Perubahan bintang dalam 7 hari terakhir - #77
🤗 Optimum Intel: Percepat inferensi dengan alat optimasi Intel
★ 617+1Perubahan bintang dalam 7 hari terakhir - #78
Pustaka program pengenalan suara otomatis sumber terbuka kelas komersial, siap pakai, dukungan lintas platform, dan pengenalan campuran Mandarin-Inggris. Implementasi lintas platform untuk inferensi ASR berbasis ONNXRuntime dan FunASR, menyediakan sekumpulan API yang lebih mudah untuk memanggil model ASR.
★ 611+0Perubahan bintang dalam 7 hari terakhir - #79
Platform Agen Suara Open Source.
★ 592+2Perubahan bintang dalam 7 hari terakhir - #80
Perangkat lunak tampilan teks terjemahan waktu nyata lintas platform.
★ 578+4Perubahan bintang dalam 7 hari terakhir - #81
Pipeline Speech-to-Text yang dioptimalkan untuk Model Whisper yang mendukung berbagai Inference Engine
★ 578+1Perubahan bintang dalam 7 hari terakhir - #82
SpeechIO Leaderboard: platform benchmarking yang besar, kuat, komprehensif untuk Automatic Speech Recognition.
★ 553+3Perubahan bintang dalam 7 hari terakhir - #83
Pustaka pengenalan suara yang berjalan di browser berkat build WebAssembly dari Vosk
★ 529+1Perubahan bintang dalam 7 hari terakhir - #84
Makalah ICASSP 2023-2024: Kumpulan lengkap makalah penelitian yang berpengaruh dan menarik dari konferensi ICASSP 2023-24. Jelajahi kemajuan terbaru dalam akustik, ucapan, dan pemrosesan sinyal. Kode disertakan. Beri bintang pada repositori untuk mendukung kemajuan pemrosesan audio dan sinyal!
★ 526+1Perubahan bintang dalam 7 hari terakhir - #85
Chatbot AI seukuran saku yang dibangun menggunakan RPI Zero 2w / 5
★ 513+10Perubahan bintang dalam 7 hari terakhir - #86
Arabic-first generative speech recognition — Audar-ASR-V1 (Flash + Turbo). #1 on the Open Universal Arabic ASR Leaderboard. Model cards, benchmarks & inference.
★ 501+7Perubahan bintang dalam 7 hari terakhir