speech-recognition
Repositori open source terpantau bertanda speech-recognition, diurutkan berdasarkan bintang.
- #61
💎 Daftar korpus ucapan yang dapat diakses untuk ASR, TTS, dan Teknologi Ucapan lainnya
★ 1.399+0Perubahan bintang dalam 7 hari terakhir - #62
Fine-tune LLM di Mac Anda dengan Apple Silicon. SFT, DPO, GRPO, Vision, TTS, STT, Embedding, dan fine-tuning OCR — secara native di MLX. API yang kompatibel dengan Unsloth.
★ 1.398+8Perubahan bintang dalam 7 hari terakhir - #63
Transkripsi yang Dapat Dikontrol. Verbatim (setiap kata, pengisi, jeda, gagap, suara vokal), atau yang dimaksudkan (apa yang ingin dikatakan pembicara, dioptimalkan untuk keterbacaan) dengan stempel waktu tingkat kata.
★ 1.371+13Perubahan bintang dalam 7 hari terakhir - #64
Klien baris perintah Whisper yang kompatibel dengan klien asli OpenAI berbasis CTranslate2.
★ 1.346+2Perubahan bintang dalam 7 hari terakhir - #65
Asisten Pribadi yang dibangun menggunakan pustaka Python. Melakukan hampir semua hal termasuk mengirim email, Pengenalan Teks Optik (OCR), Pelaporan Berita Dinamis kapan saja dengan integrasi API, pembuat daftar tugas, membuka situs web apa pun hanya dengan perintah suara, Memutar Musik, pencarian Wikipedia, Kamus dengan Penginderaan Cerdas yaitu koreksi ejaan otomatis, Pelaporan Cuaca yaitu suhu, kecepatan angin, kelembapan,
★ 1.341+5Perubahan bintang dalam 7 hari terakhir - #66★ 1.338+42Perubahan bintang dalam 7 hari terakhir
- #67
StreamSpeech adalah model "All in One" yang mulus untuk pengenalan suara offline dan simultan, terjemahan suara, serta sintesis suara.
★ 1.288+0Perubahan bintang dalam 7 hari terakhir - #68
Pruna adalah kerangka kerja optimasi model yang dibuat untuk pengembang, memungkinkan Anda menghadirkan model yang lebih cepat dan efisien dengan overhead minimal.
★ 1.274+1Perubahan bintang dalam 7 hari terakhir - #69
Server pengenalan suara WebSocket, gRPC, dan WebRTC berdasarkan pustaka Vosk dan Kaldi
★ 1.262+1Perubahan bintang dalam 7 hari terakhir - #70
Lakukan fine-tune pada model pengenalan suara Whisper untuk mendukung pelatihan tanpa data penanda waktu, pelatihan dengan data penanda waktu, dan pelatihan tanpa data suara. Mempercepat inferensi dan mendukung deployment di Web, desktop Windows, serta Android
★ 1.222-1Perubahan bintang dalam 7 hari terakhir - #71★ 1.212-1Perubahan bintang dalam 7 hari terakhir
- #72
💁 Kumpulan luar biasa Model Transformers untuk Natural Language Processing yang berisi makalah, video, blog, repo resmi beserta Colab Notebooks. 🛫☑️
★ 1.179+0Perubahan bintang dalam 7 hari terakhir - #73
Lab praktis untuk membangun, menguji, dan mengevaluasi aplikasi dengan kerangka kerja Foundation Models dari Apple.
★ 1.178+1Perubahan bintang dalam 7 hari terakhir - #74
Buku catatan pribadi dengan jajaran asisten AI pribadi. Agen membaca apa yang Anda catat dan mengusulkan apa yang harus dilakukan selanjutnya — Anda menyetujui perubahannya. Sinkronisasi terenkripsi end-to-end antar perangkat Anda sendiri — server hanya pernah melihat teks terenkripsi. AI lokal bersifat opsional.
★ 1.168+3Perubahan bintang dalam 7 hari terakhir - #75
Toolkit bicara AI untuk Apple Silicon — ASR, TTS, speech-to-speech, VAD, dan diarisasi yang didukung oleh MLX dan CoreML
★ 1.161+4Perubahan bintang dalam 7 hari terakhir - #76
Irina - asisten suara berbahasa Rusia untuk bekerja secara offline. Mendukung keterampilan melalui plugin.
★ 1.153+0Perubahan bintang dalam 7 hari terakhir - #77★ 1.149-1Perubahan bintang dalam 7 hari terakhir
- #78
Implementasi PyTorch [Tidak Resmi] untuk "Conformer: Convolution-augmented Transformer for Speech Recognition" (INTERSPEECH 2020)
★ 1.132+1Perubahan bintang dalam 7 hari terakhir - #79
Sistem Pengodean Mandiri untuk Aplikasi Anda — Alan AI SDK untuk Cordova
★ 1.132+0Perubahan bintang dalam 7 hari terakhir - #80
SGLang-Omni mendukung penyajian berkinerja tinggi untuk model TTS, ASR, ucapan, dan omni.
★ 1.118+130Perubahan bintang dalam 7 hari terakhir - #81
AI Vtuber untuk streaming di Youtube/Twitch
★ 1.115+1Perubahan bintang dalam 7 hari terakhir - #82
Aplikasi iOS sumber terbuka yang membuat transkripsi suara berkualitas lebih mudah diakses di perangkat seluler.
★ 1.102+2Perubahan bintang dalam 7 hari terakhir - #83
💬📝 Aplikasi dikte kecil menggunakan model pengenalan suara Whisper dari OpenAI.
★ 1.100+2Perubahan bintang dalam 7 hari terakhir - #84
Server pengenalan suara full-duplex waktu nyata, berbasis toolkit Kaldi dan framework GStreamer.
★ 1.094+1Perubahan bintang dalam 7 hari terakhir - #85
Pengenalan suara offline untuk Android menggunakan pustaka Vosk.
★ 1.056+0Perubahan bintang dalam 7 hari terakhir - #86★ 1.040+1Perubahan bintang dalam 7 hari terakhir
- #87
TensorFlowASR: Automatic Speech Recognition yang hampir mutakhir di Tensorflow 2. Mendukung bahasa yang menggunakan karakter atau subword.
★ 1.010+0Perubahan bintang dalam 7 hari terakhir - #88
Alat penyuntingan yang menggunakan AI untuk mentranskripsi, memahami konten, dan mencari apa pun dalam rekaman Anda, terintegrasi dengan ChatGPT dan model AI lainnya.
★ 1.009+2Perubahan bintang dalam 7 hari terakhir - #89★ 984+4Perubahan bintang dalam 7 hari terakhir
- #90
Transkripsi audio nyaris real-time menggunakan Whisper mandiri dan WebSocket di Python/JS
★ 960+1Perubahan bintang dalam 7 hari terakhir