speech-recognition
speech-recognition 태그가 달린 추적 중인 오픈소스 리포지토리를 스타 수 순으로 보여줘요.
- #91
오디오 AI 연구 허브: 오디오 LLM, 음성 인식, TTS, 음악 및 오디오 생성을 아우르는 논문, 오픈 모델, 벤치마크 및 데이터셋
★ 953+3최근 7일 스타 변화 - #92
LLM 요약 기능이 포함된 턴키 방식의 자체 호스팅 오프라인 음성 변환 및 화자 분리 서비스
★ 948+2최근 7일 스타 변화 - #93
Whisper.net. Whisper 모델을 사용하여 간편하게 구현하는 음성 인식(STT)
★ 941+1최근 7일 스타 변화 - #94★ 939+0최근 7일 스타 변화
- #95
시스템 수준 명령 실행, 음성 인식 및 텍스트 음성 변환 통합, 비동기 사용자 상호작용 처리가 가능한 Python 기반 데스크톱 음성 비서
★ 919+13최근 7일 스타 변화 - #96
스트리밍 및 온디바이스 사용을 위해 최적화된 Whisper 모델
★ 897+0최근 7일 스타 변화 - #97
인터넷 없이 내 컴퓨터에서 실행되는 말하는 LLM
★ 891+2최근 7일 스타 변화 - #98
:speech_balloon: SpeechPy - 음성 처리 및 인식을 위한 라이브러리: http://speechpy.readthedocs.io/en/latest/
★ 883+0최근 7일 스타 변화 - #99
PaddlePaddle 기반의 엔드투엔드 중국어 음성 인식 구현. 입문부터 실전까지, 초보자를 위한 간단한 사례와 실용적인 기업 프로젝트 포함. DeepSpeech2, Conformer, Squeezeformer 모델 지원
★ 870-1최근 7일 스타 변화 - #100
💬React 앱을 위한 음성 인식
★ 842+1최근 7일 스타 변화 - #101
Connectionist Temporal Classification (CTC) 디코딩 알고리즘: 최적 경로, 빔 검색, 사전 검색, 접두사 검색, 토큰 패싱. Python으로 구현됨.
★ 836-1최근 7일 스타 변화 - #102
OpenAI의 Whisper를 사용하여 실시간 speech2text 웹 앱 구축 https://openai.com/blog/whisper/
★ 835+0최근 7일 스타 변화 - #103★ 823-1최근 7일 스타 변화
- #104
Linux용 무료 오픈소스 100% 오프라인 음성 받아쓰기 도구. whisper.cpp, Whisper, VOSK 엔진을 사용하며 GPU 가속 및 X11/Wayland 지원
★ 806+21최근 7일 스타 변화 - #105★ 805+1최근 7일 스타 변화
- #106
Speech to Text to Speech. 현재 재생 중인 곡. 텍스트를 OSC 메시지로 VRChat에 전송하여 아바타에 표시합니다. (STTTS) (Speech to TTS) (VRC STT System) (VTuber TTS)
★ 803+4최근 7일 스타 변화 - #107
whisper.cpp의 React Native 바인딩
★ 800-1최근 7일 스타 변화 - #108★ 788+1최근 7일 스타 변화
- #109
OpenAI whisper와 함께 마이크를 사용할 수 있게 해주는 프로젝트
★ 787+0최근 7일 스타 변화 - #110★ 786+17최근 7일 스타 변화
- #111
🎤 Swift에서 오디오를 가장 쉽게 변환(transcribe)하는 방법
★ 785-1최근 7일 스타 변화 - #112
100개 이상의 언어로 음성을 텍스트로 변환하는 100% 프라이빗 AI 음성 전사 앱. Whisper AI를 사용하여 Android 및 iOS용 Compose Multiplatform으로 제작되었으며, 클라우드 업로드 없이 완전히 온디바이스로 처리되어 완벽한 개인정보 보호를 제공합니다.
★ 777+1최근 7일 스타 변화 - #113★ 766+0최근 7일 스타 변화
- #114★ 763+1최근 7일 스타 변화
- #115
PaddlePaddle 기반의 중국어 음성 인식 프로젝트. Windows 및 Linux 환경에서의 학습과 예측을 지원하며 Nvidia Jetson 개발 보드에서의 예측도 가능함
★ 762+0최근 7일 스타 변화 - #116★ 754+2최근 7일 스타 변화
- #117
로컬 머신의 Unity3d에서 음성 인식 모델(whisper.cpp) 실행하기.
★ 751+1최근 7일 스타 변화 - #118
Allosaurus는 2000개 이상의 언어를 지원하는 사전 학습된 범용 음소 인식기
★ 746+4최근 7일 스타 변화 - #119
Android용 프라이빗 온디바이스 음성 인식 키보드 및 서비스.
★ 745+6최근 7일 스타 변화 - #120
Pytorch로 구현된 스트리밍 및 비스트리밍 자동 음성 인식 프레임워크. 온라인 및 오프라인 인식을 모두 지원하며 Conformer, Squeezeformer, DeepSpeech2 모델과 다양한 데이터 증강 방법을 지원함
★ 727+0최근 7일 스타 변화