speech-recognition
Repositori open source terpantau bertanda speech-recognition, diurutkan berdasarkan bintang.
- #31
Implementasi JAX dari model Whisper OpenAI untuk peningkatan kecepatan hingga 70x pada TPU.
★ 4.679-1Perubahan bintang dalam 7 hari terakhir - #32
Pengenal ucapan kecil
★ 4.337+2Perubahan bintang dalam 7 hari terakhir - #33
Varian distilasi dari Whisper untuk pengenalan suara. 6x lebih cepat, 50% lebih kecil, dengan tingkat kesalahan kata di bawah 1%.
★ 4.114+2Perubahan bintang dalam 7 hari terakhir - #34
Layanan API ASR OpenAI Whisper
★ 3.328+2Perubahan bintang dalam 7 hari terakhir - #35
Executable mandiri Whisper & Faster-Whisper bagi mereka yang tidak ingin repot dengan Python.
★ 3.171+2Perubahan bintang dalam 7 hari terakhir - #36
Alternatif asisten suara sumber terbuka, lokal, dan self-hosted untuk menyaingi Amazon Echo/Google Home
★ 3.101+1Perubahan bintang dalam 7 hari terakhir - #37
Transkripsikan audio apa pun menjadi teks, terjemahkan, dan edit subtitle 100% secara lokal dengan antarmuka web. Didukung oleh model whisper!
★ 3.068+2Perubahan bintang dalam 7 hari terakhir - #38★ 2.864+0Perubahan bintang dalam 7 hari terakhir
- #39
Pengenalan Ucapan Otomatis Multibahasa dengan stempel waktu tingkat kata dan tingkat kepercayaan.
★ 2.842+1Perubahan bintang dalam 7 hari terakhir - #40
🐸STT - Toolkit deep learning untuk Speech-to-Text. Melatih dan menerapkan model STT tidak pernah semudah ini.
★ 2.606+1Perubahan bintang dalam 7 hari terakhir - #41
Runtime suara real-time yang menjaga Agen tetap berbicara, bekerja, dan hadir. Runtime Suara Real-time untuk Agen AI.
★ 2.362+68Perubahan bintang dalam 7 hari terakhir - #42
🎙 Pengenalan ucapan menggunakan kerangka kerja deep learning tensorflow, jaringan saraf sequence-to-sequence
★ 2.173+0Perubahan bintang dalam 7 hari terakhir - #43★ 2.048+7Perubahan bintang dalam 7 hari terakhir
- #44
Model ASR kelas industri sumber terbuka yang mendukung bahasa Mandarin, dialek Tiongkok, dan bahasa Inggris, mencapai SOTA baru pada tolok ukur ASR Mandarin publik, sekaligus menawarkan kemampuan pengenalan lirik lagu yang luar biasa.
★ 1.975+2Perubahan bintang dalam 7 hari terakhir - #45★ 1.968+0Perubahan bintang dalam 7 hari terakhir
- #46★ 1.935+1Perubahan bintang dalam 7 hari terakhir
- #47
Daftar kurasi makalah, pustaka, dataset, dan sumber daya Speaker Diarization yang luar biasa.
★ 1.894+1Perubahan bintang dalam 7 hari terakhir - #48
Sistem pengodean mandiri untuk aplikasi Anda — Alan AI SDK untuk iOS.
★ 1.878-3Perubahan bintang dalam 7 hari terakhir - #49
Sistem Pengodean Mandiri untuk Aplikasi Anda — Alan AI SDK untuk Android
★ 1.807-1Perubahan bintang dalam 7 hari terakhir - #50
Whisper Lintas Platform dengan Akselerasi GPU 🏎️
★ 1.794+0Perubahan bintang dalam 7 hari terakhir - #51
Pengenalan suara waktu nyata dan deteksi aktivitas suara (VAD) menggunakan Kaldi generasi berikutnya dengan ncnn tanpa koneksi Internet. Mendukung iOS, Android, Linux, macOS, Windows, Raspberry Pi, VisionFive2, LicheePi4A, dll.
★ 1.777-1Perubahan bintang dalam 7 hari terakhir - #52
Sistem pengkodean mandiri untuk aplikasi Anda — Alan AI SDK untuk Flutter
★ 1.756-1Perubahan bintang dalam 7 hari terakhir - #53
Sistem Pengodean Mandiri untuk Aplikasi Anda — Alan AI SDK untuk Ionic
★ 1.649-1Perubahan bintang dalam 7 hari terakhir - #54
Aplikasi Linux Speech Note. Mencatat, membaca, dan menerjemahkan dengan Speech to Text, Text to Speech, dan terjemahan mesin secara luring.
★ 1.622+8Perubahan bintang dalam 7 hari terakhir - #55
Plugin OBS untuk pengenalan ucapan lokal dan pembuatan teks keterangan menggunakan AI
★ 1.597+8Perubahan bintang dalam 7 hari terakhir - #56
Amica adalah antarmuka sumber terbuka untuk komunikasi interaktif dengan karakter 3D yang dilengkapi sintesis suara dan pengenalan ucapan.
★ 1.591-2Perubahan bintang dalam 7 hari terakhir - #57
Node kustom yang memperluas kemampuan Comfyui
★ 1.525+1Perubahan bintang dalam 7 hari terakhir - #58★ 1.521+3Perubahan bintang dalam 7 hari terakhir
- #59
Keluarga model ASR berbasis LLM open-source untuk bahasa Mandarin, dialek, aksen, dan ucapan multilingual, lengkap dengan runtime FunASR, vLLM, streaming, dan llama.cpp.
★ 1.512+10Perubahan bintang dalam 7 hari terakhir - #60★ 1.449+0Perubahan bintang dalam 7 hari terakhir