asr
asr 태그가 달린 추적 중인 오픈소스 리포지토리를 스타 수 순으로 보여줘요.
- #61★ 854+3최근 7일 스타 변화
- #62
네이티브 및 브라우저에서 실행되는 Voxtral ASR & TTS. Burn ML 프레임워크를 사용하여 Mistral의 Voxtral mini 실시간 ASR/TTS를 Rust로 구현
★ 819+2최근 7일 스타 변화 - #63
🎙️ 음성을 깔끔한 텍스트, 유용한 작업, 구조화된 지식으로 변환해주는 지능형 음성 생산성 어시스턴트입니다. 사용자가 아이디어를 포착하고, 자연스럽게 소통하며, 반복 작업을 자동화하고, 다양한 앱과 워크플로우에서 생산성을 유지할 수 있도록 돕습니다.
★ 807+5최근 7일 스타 변화 - #64
LLM, ASR, TTS, OCR, CV 등 다양한 기술을 활용하여 라이브 스트리밍을 하거나 함께 Minecraft를 플레이하는 AI VTuber
★ 803+5최근 7일 스타 변화 - #65
BiBi Keyboard: Kotlin 기반의 Android 플랫폼 LLM 및 ASR 음성 입력기 키보드 애플리케이션
★ 772+17최근 7일 스타 변화 - #66★ 766+0최근 7일 스타 변화
- #67
PaddlePaddle 기반의 중국어 음성 인식 프로젝트. Windows 및 Linux 환경에서의 학습과 예측을 지원하며 Nvidia Jetson 개발 보드에서의 예측도 가능함
★ 763+0최근 7일 스타 변화 - #68
로컬 머신의 Unity3d에서 음성 인식 모델(whisper.cpp) 실행하기.
★ 751+1최근 7일 스타 변화 - #69
Pytorch로 구현된 스트리밍 및 비스트리밍 자동 음성 인식 프레임워크. 온라인 및 오프라인 인식을 모두 지원하며 Conformer, Squeezeformer, DeepSpeech2 모델과 다양한 데이터 증강 방법을 지원함
★ 727+0최근 7일 스타 변화 - #70
PyTorch-Lightning과 Hydra를 활용한 엔드투엔드 음성 인식 오픈소스 툴킷
★ 714+0최근 7일 스타 변화 - #71
Android용 OpenAI Whisper 및 TensorFlow Lite를 사용한 오프라인 음성 인식.
★ 688+0최근 7일 스타 변화 - #72
INTERSPEECH 2023-2024 논문 모음: INTERSPEECH 2023-24 컨퍼런스의 영향력 있고 흥미로운 연구 논문 전체 컬렉션입니다. 음성 및 언어 처리 분야의 최신 기술 발전을 확인해 보세요. 코드 포함.
★ 684+0최근 7일 스타 변화 - #73★ 677+0최근 7일 스타 변화
- #74
ASR, VAD, LID, Punc 모듈을 포함한 산업용 올인원 ASR 시스템. FireRedASR2는 중국어(표준어 및 20개 이상의 방언/억양), 영어, 코드 스위칭, 음성 및 노래 ASR을 지원하며, FireRedVAD는 100개 이상의 언어, FireRedLID는 100개 이상의 언어와 20개 이상의 중국어 방언, FireRedPunc는 중국어와 영어를 지원함
★ 672+13최근 7일 스타 변화 - #75★ 671+0최근 7일 스타 변화
- #76
실시간 오디오 번역 도구. 시스템 오디오와 마이크를 캡처하여 ASR(Whisper/SenseVoice)로 인식하고 LLM API를 통해 스트리밍 방식으로 번역 결과를 표시합니다. VTuber, 라이브 스트리머 및 외국어 콘텐츠 시청에 최적화되어 있습니다.
★ 626+38최근 7일 스타 변화 - #77
음성 인식 이론, 논문 및 PPT
★ 618+0최근 7일 스타 변화 - #78
🤗 Optimum Intel: Intel 최적화 도구로 추론 가속화
★ 617+1최근 7일 스타 변화 - #79
상용 수준의 오픈 소스 음성 자동 인식 라이브러리. 즉시 사용 가능하며 모든 플랫폼을 지원하고 중영 혼합 인식을 지원합니다. ONNXRuntime 및 FunASR을 기반으로 하는 크로스 플랫폼 ASR 추론 구현체입니다. ASR 모델을 호출하기 위한 더 쉬운 API 세트를 제공합니다.
★ 611+0최근 7일 스타 변화 - #80
오픈 소스 음성 에이전트 플랫폼
★ 592+2최근 7일 스타 변화 - #81
다중 추론 엔진을 지원하는 Whisper 모델용 최적화된 음성 인식 파이프라인
★ 578+1최근 7일 스타 변화 - #82
크로스 플랫폼 실시간 자막 표시 소프트웨어
★ 578+4최근 7일 스타 변화 - #83
SpeechIO Leaderboard: 자동 음성 인식(ASR)을 위한 대규모의 강력하고 포괄적인 벤치마킹 플랫폼입니다.
★ 553+3최근 7일 스타 변화 - #84
Vosk의 WebAssembly 빌드를 사용하여 브라우저에서 실행되는 음성 인식 라이브러리
★ 529+1최근 7일 스타 변화 - #85
ICASSP 2023-2024 논문: ICASSP 2023-24 컨퍼런스의 영향력 있고 흥미로운 연구 논문 모음. 음향, 음성 및 신호 처리 분야의 최신 발전을 탐색하세요. 코드 포함.
★ 526+1최근 7일 스타 변화 - #86
Raspberry Pi Zero 2W로 구축한 포켓 사이즈 AI 챗봇
★ 513+10최근 7일 스타 변화 - #87
Arabic-first generative speech recognition — Audar-ASR-V1 (Flash + Turbo). #1 on the Open Universal Arabic ASR Leaderboard. Model cards, benchmarks & inference.
★ 501+7최근 7일 스타 변화