speech
Repositori open source terpantau bertanda speech, diurutkan berdasarkan bintang.
- #61
Koleksi makalah TTS
★ 734+1Perubahan bintang dalam 7 hari terakhir - #62
Kerangka kerja Automatic Speech Recognition (ASR) streaming dan non-streaming yang diimplementasikan dengan PyTorch, kompatibel dengan pengenalan online dan offline, saat ini mendukung model Conformer, Squeezeformer, dan DeepSpeech2, serta berbagai metode augmentasi data.
★ 727+0Perubahan bintang dalam 7 hari terakhir - #63★ 716+0Perubahan bintang dalam 7 hari terakhir
- #64
Toolkit Open-Source untuk Pengenalan Ucapan End-to-End yang memanfaatkan PyTorch-Lightning dan Hydra.
★ 714+0Perubahan bintang dalam 7 hari terakhir - #65★ 693+1Perubahan bintang dalam 7 hari terakhir
- #66
API text-to-speech (TTS) lokal yang kompatibel dengan OpenAI menggunakan Chatterbox, memungkinkan pengguna menghasilkan ucapan tiruan suara di mana pun API OpenAI digunakan (mis. Open WebUI, AnythingLLM, dll.)
★ 677+5Perubahan bintang dalam 7 hari terakhir - #67
MOSS-Audio adalah model dasar sumber terbuka untuk pemahaman audio terpadu, yang memungkinkan ucapan, suara, musik, pemberian keterangan, tanya jawab, dan penalaran dalam skenario dunia nyata.
★ 656+5Perubahan bintang dalam 7 hari terakhir - #68
:speech_balloon: /so.nus/ STT (speech to text) untuk Node dengan deteksi kata kunci offline.
★ 638+0Perubahan bintang dalam 7 hari terakhir - #69
Daftar laboratorium, perusahaan, sumber daya, dan magang di bidang pengenalan suara, rekomendasi atau pendaftaran mandiri dipersilakan
★ 610+1Perubahan bintang dalam 7 hari terakhir - #70
Daftar dataset room impulse response yang tersedia untuk umum beserta skrip untuk mengunduhnya.
★ 609+2Perubahan bintang dalam 7 hari terakhir - #71
SpeechIO Leaderboard: platform benchmarking yang besar, kuat, komprehensif untuk Automatic Speech Recognition.
★ 553+3Perubahan bintang dalam 7 hari terakhir - #72
Sampel audio yang menyertai publikasi terkait Tacotron, model sintesis ucapan end-to-end.
★ 539+0Perubahan bintang dalam 7 hari terakhir - #73★ 524+1Perubahan bintang dalam 7 hari terakhir
- #74
StarGANv2-VC: Framework yang Beragam, Tanpa Pengawasan, Non-paralel untuk Konversi Suara yang Terdengar Alami
★ 522+0Perubahan bintang dalam 7 hari terakhir