본문으로 건너뛰기
buildradar
Sign in
토픽 · speech-recognition

speech-recognition

speech-recognition 태그가 달린 추적 중인 오픈소스 리포지토리를 스타 수 순으로 보여줘요.

리포지토리 156개
  • audio-ai-hub@BinWang28

    오디오 AI 연구 허브: 오디오 LLM, 음성 인식, TTS, 음악 및 오디오 생성을 아우르는 논문, 오픈 모델, 벤치마크 및 데이터셋

    953+3최근 7일 스타 변화
  • transcriptionstream@transcriptionstream

    LLM 요약 기능이 포함된 턴키 방식의 자체 호스팅 오프라인 음성 변환 및 화자 분리 서비스

    948+2최근 7일 스타 변화
  • whisper.net@sandrohanea

    Whisper.net. Whisper 모델을 사용하여 간편하게 구현하는 음성 인식(STT)

    941+1최근 7일 스타 변화
  • espresso@freewym

    Espresso: 빠르고 통합된 엔드투엔드 신경망 음성 인식 툴킷

    939+0최근 7일 스타 변화
  • 시스템 수준 명령 실행, 음성 인식 및 텍스트 음성 변환 통합, 비동기 사용자 상호작용 처리가 가능한 Python 기반 데스크톱 음성 비서

    919+13최근 7일 스타 변화
  • TheWhisper@TheStageAI

    스트리밍 및 온디바이스 사용을 위해 최적화된 Whisper 모델

    897+0최근 7일 스타 변화
  • 인터넷 없이 내 컴퓨터에서 실행되는 말하는 LLM

    891+2최근 7일 스타 변화
  • speechpy@astorfi

    :speech_balloon: SpeechPy - 음성 처리 및 인식을 위한 라이브러리: http://speechpy.readthedocs.io/en/latest/

    883+0최근 7일 스타 변화
  • PPASR@yeyupiaoling

    PaddlePaddle 기반의 엔드투엔드 중국어 음성 인식 구현. 입문부터 실전까지, 초보자를 위한 간단한 사례와 실용적인 기업 프로젝트 포함. DeepSpeech2, Conformer, Squeezeformer 모델 지원

    870-1최근 7일 스타 변화
  • react-speech-recognition@JamesBrill

    💬React 앱을 위한 음성 인식

    842+1최근 7일 스타 변화
  • CTCDecoder@githubharald

    Connectionist Temporal Classification (CTC) 디코딩 알고리즘: 최적 경로, 빔 검색, 사전 검색, 접두사 검색, 토큰 패싱. Python으로 구현됨.

    836-1최근 7일 스타 변화
  • whisper-playground@saharmor

    OpenAI의 Whisper를 사용하여 실시간 speech2text 웹 앱 구축 https://openai.com/blog/whisper/

    835+0최근 7일 스타 변화
  • kur@deepgram

    기술적 딥러닝

    823-1최근 7일 스타 변화
  • vocalinux@VocaHQ

    Linux용 무료 오픈소스 100% 오프라인 음성 받아쓰기 도구. whisper.cpp, Whisper, VOSK 엔진을 사용하며 GPU 가속 및 X11/Wayland 지원

    806+21최근 7일 스타 변화
  • lobe-tts@lobehub

    🎤 Lobe TTS - 서버와 브라우저를 위한 고품질의 안정적인 TTS/STT 라이브러리

    805+1최근 7일 스타 변화
  • Speech to Text to Speech. 현재 재생 중인 곡. 텍스트를 OSC 메시지로 VRChat에 전송하여 아바타에 표시합니다. (STTTS) (Speech to TTS) (VRC STT System) (VTuber TTS)

    803+4최근 7일 스타 변화
  • whisper.rn@mybigday

    whisper.cpp의 React Native 바인딩

    800-1최근 7일 스타 변화
  • june@mezbaul-h

    Ollama, Hugging Face Transformers, Coqui TTS Toolkit 기반의 대화형 로컬 음성 챗봇

    788+1최근 7일 스타 변화
  • whisper_mic@mallorbc

    OpenAI whisper와 함께 마이크를 사용할 수 있게 해주는 프로젝트

    787+0최근 7일 스타 변화
  • GigaAM@salute-developers

    음성 인식 작업을 위한 기초 모델

    786+17최근 7일 스타 변화
  • SwiftWhisper@exPHAT

    🎤 Swift에서 오디오를 가장 쉽게 변환(transcribe)하는 방법

    785-1최근 7일 스타 변화
  • NotelyVoice@Notely-Voice

    100개 이상의 언어로 음성을 텍스트로 변환하는 100% 프라이빗 AI 음성 전사 앱. Whisper AI를 사용하여 Android 및 iOS용 Compose Multiplatform으로 제작되었으며, 클라우드 업로드 없이 완전히 온디바이스로 처리되어 완벽한 개인정보 보호를 제공합니다.

    777+1최근 7일 스타 변화
  • cn2an@Ailln

    📦 '중국어 숫자'와 '아라비아 숫자'를 빠르게 변환하는 도구 (최신 기능: 분수, 날짜, 온도 등 변환 지원)

    766+0최근 7일 스타 변화
  • dla@markovka17

    오디오 처리를 위한 딥러닝

    763+1최근 7일 스타 변화
  • PaddlePaddle-DeepSpeech@yeyupiaoling

    PaddlePaddle 기반의 중국어 음성 인식 프로젝트. Windows 및 Linux 환경에서의 학습과 예측을 지원하며 Nvidia Jetson 개발 보드에서의 예측도 가능함

    762+0최근 7일 스타 변화
  • chaplin@amanvirparhar

    실시간 무음 음성 인식 도구.

    754+2최근 7일 스타 변화
  • 로컬 머신의 Unity3d에서 음성 인식 모델(whisper.cpp) 실행하기.

    751+1최근 7일 스타 변화
  • allosaurus@xinjli

    Allosaurus는 2000개 이상의 언어를 지원하는 사전 학습된 범용 음소 인식기

    746+4최근 7일 스타 변화
  • Transcribro@soupslurpr

    Android용 프라이빗 온디바이스 음성 인식 키보드 및 서비스.

    745+6최근 7일 스타 변화
  • MASR@yeyupiaoling

    Pytorch로 구현된 스트리밍 및 비스트리밍 자동 음성 인식 프레임워크. 온라인 및 오프라인 인식을 모두 지원하며 Conformer, Squeezeformer, DeepSpeech2 모델과 다양한 데이터 증강 방법을 지원함

    727+0최근 7일 스타 변화
← 토픽 목록으로