speech-recognition
Repositori open source terpantau bertanda speech-recognition, diurutkan berdasarkan bintang.
Topik terkait
Topik yang sering muncul berdampingan dengan speech-recognition di repositori yang sama.
Yang sedang naik
Repositori yang dibuat dalam 90 hari terakhir dan bertanda speech-recognition.
- #1
Runtime suara real-time yang menjaga Agen tetap berbicara, bekerja, dan hadir. Runtime Suara Real-time untuk Agen AI.
★ 2.362 - #2
Dikte suara lokal yang sangat cepat, gratis, dan mengutamakan privasi untuk macOS dengan transkripsi pada perangkat
★ 541 - #3
Arabic-first generative speech recognition — Audar-ASR-V1 (Flash + Turbo). #1 on the Open Universal Arabic ASR Leaderboard. Model cards, benchmarks & inference.
★ 501 - #4
早耳 - Real-time multilingual speech-to-text on CPU only. Live subtitles, browser dashboard, speaker labels, translation. No GPU, no cloud.
★ 327
- #1
🤗 Transformers: kerangka kerja definisi model untuk model pembelajaran mesin canggih dalam teks, penglihatan, audio, dan model multimodal, baik untuk inferensi maupun pelatihan.
★ 164.731+119Perubahan bintang dalam 7 hari terakhir - #2
Porting model Whisper dari OpenAI ke dalam C/C++.
★ 53.389+103Perubahan bintang dalam 7 hari terakhir - #3
Transkripsi Faster Whisper dengan CTranslate2
★ 25.206+71Perubahan bintang dalam 7 hari terakhir - #4
WhisperX: Pengenalan Ucapan Otomatis dengan stempel waktu tingkat kata (& Diarisasi)
★ 23.864+61Perubahan bintang dalam 7 hari terakhir - #5
Toolkit pengenalan suara open source untuk pelatihan, inferensi, streaming ASR, VAD, tanda baca, pipeline diarization pembicara, dan penyajian yang kompatibel dengan OpenAI/MCP.
★ 20.136+64Perubahan bintang dalam 7 hari terakhir - #6★ 17.476+1Perubahan bintang dalam 7 hari terakhir
- #7★ 15.474+3Perubahan bintang dalam 7 hari terakhir
- #8
API pengenalan suara offline untuk Android, iOS, Raspberry Pi, dan server dengan Python, Java, C#, dan Node.
★ 15.101+17Perubahan bintang dalam 7 hari terakhir - #9
Skrip Deep Learning mutakhir yang diatur berdasarkan model - mudah dilatih dan diterapkan dengan akurasi serta performa yang dapat direproduksi pada infrastruktur kelas perusahaan.
★ 14.846+4Perubahan bintang dalam 7 hari terakhir - #10
Pelajari Deep Learning, Reinforcement Learning, Machine Learning, Computer Vision, dan NLP melalui materi kuliah yang menarik ini!
★ 12.939+3Perubahan bintang dalam 7 hari terakhir - #11
Gradio WebUI untuk kreator dan pengembang, menampilkan TTS utama (Edge-TTS, kokoro) dan Kloning Suara zero-shot (E2 & F5-TTS, CosyVoice), dengan pemrosesan audio Whisper, unduhan YouTube, isolasi vokal Demucs, dan terjemahan multibahasa.
★ 12.730+54Perubahan bintang dalam 7 hari terakhir - #12
Toolkit Speech yang mudah digunakan mencakup model Self-Supervised Learning, SOTA/Streaming ASR dengan tanda baca, Streaming TTS dengan frontend teks, Sistem Verifikasi Pembicara, End-to-End Speech Translation, dan Keyword Spotting. Pemenang Penghargaan Demo Terbaik NAACL2022.
★ 12.676+5Perubahan bintang dalam 7 hari terakhir - #13
Toolkit ucapan berbasis PyTorch
★ 11.802+10Perubahan bintang dalam 7 hari terakhir - #14
Speech-to-text lokal waktu nyata dengan streaming ASR, diarization pembicara, penerjemahan, dan API yang kompatibel dengan OpenAI/Deepgram
★ 10.990+16Perubahan bintang dalam 7 hari terakhir - #15
OpenVINO™ adalah toolkit open source untuk mengoptimalkan dan menerapkan inferensi AI.
★ 10.793+30Perubahan bintang dalam 7 hari terakhir - #16★ 9.949+3Perubahan bintang dalam 7 hari terakhir
- #17
Model SenseVoiceSmall sumber terbuka untuk ASR bahasa Mandarin, Kanton, Inggris, Jepang, dan Korea, identifikasi bahasa, pengenalan emosi, dan deteksi peristiwa audio.
★ 9.209+37Perubahan bintang dalam 7 hari terakhir - #18
Modul pengenalan ucapan untuk Python, mendistribusikan beberapa mesin dan API, online dan offline.
★ 8.987+0Perubahan bintang dalam 7 hari terakhir - #19
Sistem pengenalan suara bahasa Mandarin berbasis Deep Learning.
★ 8.386+0Perubahan bintang dalam 7 hari terakhir - #20
Pustaka text-to-speech (TTS), speech-to-text (STT), dan speech-to-speech (STS) yang dibangun di atas framework MLX Apple, menyediakan analisis suara yang efisien di Apple Silicon.
★ 7.826+23Perubahan bintang dalam 7 hari terakhir - #21★ 6.815-1Perubahan bintang dalam 7 hari terakhir
- #22
Toolkit Automatic Speech Recognition dari Facebook AI Research
★ 6.437+1Perubahan bintang dalam 7 hari terakhir - #23
AI Suara On-device untuk Apple Silicon
★ 6.353+8Perubahan bintang dalam 7 hari terakhir - #24★ 6.254+3Perubahan bintang dalam 7 hari terakhir
- #25
Alat transkripsi video, pembuatan subtitle, dan pemotongan berbasis LLM yang didukung oleh FunASR dengan antarmuka Gradio lokal.
★ 6.210+13Perubahan bintang dalam 7 hari terakhir - #26
Pengenalan Ucapan Otomatis (ASR) dengan Speaker Diarization berbasis OpenAI Whisper
★ 5.634+1Perubahan bintang dalam 7 hari terakhir - #27★ 5.229+1Perubahan bintang dalam 7 hari terakhir
- #28
Deteksi kata bangun (wake word) pada perangkat yang didukung oleh deep learning.
★ 4.928+3Perubahan bintang dalam 7 hari terakhir - #29★ 4.927+5Perubahan bintang dalam 7 hari terakhir
- #30
Alat pengenalan suara ke teks, alat konversi audio/video ke subtitle yang berjalan secara lokal (offline), mendukung format output json, srt, dan teks biasa.
★ 4.780+9Perubahan bintang dalam 7 hari terakhir