automatic-speech-recognition
automatic-speech-recognition 태그가 달린 추적 중인 오픈소스 리포지토리를 스타 수 순으로 보여줘요.
관련 토픽
같은 리포지토리에 automatic-speech-recognition 태그와 자주 함께 쓰이는 토픽이에요.
최근 라이징
최근 90일 안에 만들어지고 automatic-speech-recognition 태그가 달린 리포지토리예요.
최근 90일 안에 이 토픽 태그가 달린 새 리포지토리가 없어요.
- #1
스트리밍 ASR, 화자 분리, 번역, OpenAI/Deepgram 호환 API를 지원하는 실시간 로컬 음성 인식(STT) 도구
★ 10,990+26최근 7일 스타 변화 - #2★ 5,229+2최근 7일 스타 변화
- #3
OpenAI Whisper ASR 웹서비스 API
★ 3,328+2최근 7일 스타 변화 - #4★ 3,061+283최근 7일 스타 변화
- #5
앱에서 사용하는 프론티어 CoreML 오디오 모델 — 텍스트 음성 변환, 음성 텍스트 변환, 음성 활동 감지 및 화자 분리. Swift 기반, SOTA 오픈소스 구동.
★ 2,723+22최근 7일 스타 변화 - #6★ 2,606+0최근 7일 스타 변화
- #7★ 2,256+8최근 7일 스타 변화
- #8
만다린, 중국 방언 및 영어를 지원하는 오픈 소스 산업용 ASR 모델로, 공인된 만다린 ASR 벤치마크에서 새로운 SOTA를 달성하는 동시에 뛰어난 가사 인식 기능도 제공합니다.
★ 1,975+3최근 7일 스타 변화 - #9
:zap: TensorFlowASR: Tensorflow 2 기반의 최신 수준에 준하는 자동 음성 인식(ASR) 구현. 문자 또는 서브워드를 사용할 수 있는 언어 지원
★ 1,010+0최근 7일 스타 변화 - #10★ 926+1최근 7일 스타 변화
- #11
Audio AI 분야의 LLM(거대 언어 모델) 활용 사례 리소스 모음
★ 738+1최근 7일 스타 변화 - #12
Android용 OpenAI Whisper 및 TensorFlow Lite를 사용한 오프라인 음성 인식.
★ 688-1최근 7일 스타 변화 - #13★ 671+0최근 7일 스타 변화
- #14
ASR, VAD, LID, Punc 모듈을 포함한 산업용 올인원 ASR 시스템. FireRedASR2는 중국어(표준어 및 20개 이상의 방언/억양), 영어, 코드 스위칭, 음성 및 노래 ASR을 지원하며, FireRedVAD는 100개 이상의 언어, FireRedLID는 100개 이상의 언어와 20개 이상의 중국어 방언, FireRedPunc는 중국어와 영어를 지원함
★ 665+10최근 7일 스타 변화