speech-to-text
Repositori open source terpantau bertanda speech-to-text, diurutkan berdasarkan bintang.
- #91
面向抖音直播电商的 Windows 本地 AI Agent Studio,贯通主播发现、直播洞察、直播复盘与短视频内容编导的统一智能工作流。
★ 1.018+424Perubahan bintang dalam 7 hari terakhir - #92
TensorFlowASR: Automatic Speech Recognition yang hampir mutakhir di Tensorflow 2. Mendukung bahasa yang menggunakan karakter atau subword.
★ 1.010+0Perubahan bintang dalam 7 hari terakhir - #93★ 1.006-1Perubahan bintang dalam 7 hari terakhir
- #94
Whisper-Flow adalah kerangka kerja yang dirancang untuk memungkinkan transkripsi konten audio secara real-time menggunakan model Whisper OpenAI. Alih-alih memproses seluruh file setelah diunggah (“mode batch”), Whisper-Flow menerima aliran potongan audio yang berkelanjutan dan menghasilkan transkrip inkremental secara langsung.
★ 964+25Perubahan bintang dalam 7 hari terakhir - #95
Transkripsi audio nyaris real-time menggunakan Whisper mandiri dan WebSocket di Python/JS
★ 960+0Perubahan bintang dalam 7 hari terakhir - #96
Pemrosesan Ucapan Botium
★ 943+0Perubahan bintang dalam 7 hari terakhir - #97
Whisper.net. Konversi ucapan ke teks menjadi mudah menggunakan Whisper Models
★ 942+1Perubahan bintang dalam 7 hari terakhir - #98
Evaluasi sistem speech-to-text Anda dengan ukuran kemiripan seperti word error rate (WER)
★ 928+2Perubahan bintang dalam 7 hari terakhir - #99
Contoh .NET MAUI
★ 915+0Perubahan bintang dalam 7 hari terakhir - #100★ 911+2Perubahan bintang dalam 7 hari terakhir
- #101
Model Whisper yang dioptimalkan untuk streaming dan penggunaan di perangkat
★ 897-1Perubahan bintang dalam 7 hari terakhir - #102
Aplikasi masukan suara gratis, sumber terbuka, dan mengutamakan privasi untuk macOS.
★ 896+4Perubahan bintang dalam 7 hari terakhir - #103
Implementasi pengenalan suara Mandarin end-to-end berbasis PaddlePaddle, dari tingkat dasar hingga praktis, contoh pemula yang super mudah dan proyek perusahaan yang sangat berguna. Mendukung model DeepSpeech2, Conformer, dan Squeezeformer yang paling populer saat ini
★ 870-1Perubahan bintang dalam 7 hari terakhir - #104
💬 Pengenalan suara untuk aplikasi React Anda
★ 842+0Perubahan bintang dalam 7 hari terakhir - #105
Membangun aplikasi web speech2text real-time menggunakan Whisper dari OpenAI https://openai.com/blog/whisper/
★ 835+0Perubahan bintang dalam 7 hari terakhir - #106★ 823-1Perubahan bintang dalam 7 hari terakhir
- #107
Perangkat lunak generator subtitle otomatis satu-atap, mencakup seluruh proses pengunduhan, transkripsi, penerjemahan, dan hardcode, tanpa intervensi manual
★ 811+3Perubahan bintang dalam 7 hari terakhir - #108
Dikte suara gratis, sumber terbuka, dan 100% luring untuk Linux. Berbicara dan mengetik di mana saja melalui mesin whisper.cpp, Whisper & VOSK, dengan akselerasi GPU, berfungsi di X11 + Wayland!
★ 809+17Perubahan bintang dalam 7 hari terakhir - #109
🎤 Lobe TTS - Pustaka TTS/STT yang berkualitas tinggi & andal untuk Server dan Browser
★ 805-1Perubahan bintang dalam 7 hari terakhir - #110
Speech to Text to Speech. Lagu sedang diputar. Mengirim teks sebagai pesan OSC ke VRChat untuk ditampilkan di avatar. (STTTS) (Speech to TTS) (VRC STT System) (VTuber TTS)
★ 804+5Perubahan bintang dalam 7 hari terakhir - #111
Chatbot suara lokal untuk percakapan interaktif, didukung oleh Ollama, Hugging Face Transformers, dan Coqui TTS Toolkit
★ 788+1Perubahan bintang dalam 7 hari terakhir - #112
Proyek yang memungkinkan penggunaan mikrofon dengan OpenAI whisper.
★ 787+0Perubahan bintang dalam 7 hari terakhir - #113
Cara termudah untuk mentranskripsi audio di Swift
★ 785+0Perubahan bintang dalam 7 hari terakhir - #114
Aplikasi transkripsi suara AI yang 100% privat, mengubah ucapan menjadi teks dalam 100+ bahasa. Dibuat dengan Compose Multiplatform untuk Android & iOS menggunakan Whisper AI - tanpa unggahan cloud, semua pemrosesan dilakukan di perangkat untuk privasi penuh.
★ 779+4Perubahan bintang dalam 7 hari terakhir - #115
SDK Swift modular untuk pemrosesan audio dengan MLX di Apple Silicon
★ 774+5Perubahan bintang dalam 7 hari terakhir - #116
BiBi Keyboard: Aplikasi keyboard metode masukan suara LLM dan ASR untuk platform Android berbasis Kotlin
★ 774+15Perubahan bintang dalam 7 hari terakhir - #117
Pengenalan suara berbasis PaddlePaddle, pengenalan suara bahasa Mandarin. Proyek yang lengkap dengan hasil pengenalan yang baik. Mendukung pelatihan dan prediksi di bawah Windows dan Linux, serta mendukung prediksi papan pengembang Nvidia Jetson.
★ 763+1Perubahan bintang dalam 7 hari terakhir - #118★ 754+1Perubahan bintang dalam 7 hari terakhir
- #119
Menjalankan model speech-to-text (whisper.cpp) di Unity3d pada mesin lokal Anda.
★ 751+1Perubahan bintang dalam 7 hari terakhir - #120
Papan ketik dan layanan pengenalan suara privat dan berbasis perangkat untuk Android.
★ 745+2Perubahan bintang dalam 7 hari terakhir