speech-recognition
speech-recognition 태그가 달린 추적 중인 오픈소스 리포지토리를 스타 수 순으로 보여줘요.
- #31
TPU에서 최대 70배 속도 향상을 제공하는 OpenAI Whisper 모델의 JAX 구현
★ 4,679-1최근 7일 스타 변화 - #32
소형 음성 인식기
★ 4,337+2최근 7일 스타 변화 - #33
음성 인식을 위한 Whisper의 증류(Distilled) 변형 버전. 6배 더 빠르고, 50% 더 작으며, 단어 오류율 1% 이내.
★ 4,114+2최근 7일 스타 변화 - #34
OpenAI Whisper ASR 웹서비스 API
★ 3,328+2최근 7일 스타 변화 - #35
Python을 다루기 귀찮은 분들을 위한 Whisper 및 Faster-Whisper 독립형 실행 파일.
★ 3,171+2최근 7일 스타 변화 - #36★ 3,101+1최근 7일 스타 변화
- #37★ 3,068+2최근 7일 스타 변화
- #38★ 2,864+0최근 7일 스타 변화
- #39
단어 수준 타임스탬프와 신뢰도를 제공하는 다국어 자동 음성 인식
★ 2,842+1최근 7일 스타 변화 - #40★ 2,606+1최근 7일 스타 변화
- #41
에이전트가 대화하고, 작업하고, 상주할 수 있도록 유지하는 실시간 음성 런타임. AI 에이전트를 위한 실시간 음성 런타임
★ 2,362+72최근 7일 스타 변화 - #42
tensorflow 딥러닝 프레임워크와 시퀀스 대 시퀀스 신경망을 사용한 음성 인식
★ 2,173+0최근 7일 스타 변화 - #43★ 2,048+7최근 7일 스타 변화
- #44
만다린, 중국 방언 및 영어를 지원하는 오픈 소스 산업용 ASR 모델로, 공인된 만다린 ASR 벤치마크에서 새로운 SOTA를 달성하는 동시에 뛰어난 가사 인식 기능도 제공합니다.
★ 1,975+2최근 7일 스타 변화 - #45★ 1,968+0최근 7일 스타 변화
- #46★ 1,935+1최근 7일 스타 변화
- #47
화자 분할(Speaker Diarization) 관련 우수 논문, 라이브러리, 데이터셋 및 기타 리소스 모음
★ 1,894+1최근 7일 스타 변화 - #48
앱을 위한 셀프 코딩 시스템 — iOS용 Alan AI SDK
★ 1,878-3최근 7일 스타 변화 - #49
앱을 위한 셀프 코딩 시스템 — 안드로이드용 Alan AI SDK
★ 1,807-1최근 7일 스타 변화 - #50
크로스 플랫폼, GPU 가속 Whisper 🏎️
★ 1,794+0최근 7일 스타 변화 - #51
인터넷 연결 없이 ncnn을 사용하는 차세대 Kaldi 기반 실시간 음성 인식 및 음성 활동 감지(VAD). iOS, Android, Linux, macOS, Windows, Raspberry Pi, VisionFive2, LicheePi4A 등 지원
★ 1,777-1최근 7일 스타 변화 - #52
앱을 위한 자체 코딩 시스템 — Flutter용 Alan AI SDK
★ 1,756-1최근 7일 스타 변화 - #53
앱을 위한 셀프 코딩 시스템 — Ionic용 Alan AI SDK
★ 1,649-1최근 7일 스타 변화 - #54★ 1,622+8최근 7일 스타 변화
- #55
AI를 이용한 로컬 음성 인식 및 자막 생성을 위한 OBS 플러그인
★ 1,597+8최근 7일 스타 변화 - #56★ 1,591-2최근 7일 스타 변화
- #57
ComfyUI의 기능을 확장하는 커스텀 노드
★ 1,525+1최근 7일 스타 변화 - #58★ 1,521+3최근 7일 스타 변화
- #59
FunASR, vLLM, 스트리밍, llama.cpp 런타임을 지원하는 중국어, 방언, 사투리 및 다국어 음성을 위한 오픈소스 LLM 기반 ASR 모델 패밀리
★ 1,512+10최근 7일 스타 변화 - #60★ 1,449+0최근 7일 스타 변화