본문으로 건너뛰기
buildradar
Sign in
토픽 · speech-to-text

speech-to-text

speech-to-text 태그가 달린 추적 중인 오픈소스 리포지토리를 스타 수 순으로 보여줘요.

리포지토리 152개
  • TensorFlowASR@TensorSpeech

    :zap: TensorFlowASR: Tensorflow 2 기반의 최신 수준에 준하는 자동 음성 인식(ASR) 구현. 문자 또는 서브워드를 사용할 수 있는 언어 지원

    1,010+0최근 7일 스타 변화
  • voquill@voquill

    오픈 소스 음성 받아쓰기 기술

    1,006-2최근 7일 스타 변화
  • VoiceStreamAI@alesaccoia

    Python/JS 환경에서 자체 호스팅 Whisper와 WebSocket을 사용한 실시간 오디오 전사

    960+1최근 7일 스타 변화
  • whisper-flow@dimastatz

    Whisper-Flow는 OpenAI의 Whisper 모델을 사용하여 오디오 콘텐츠를 실시간으로 변환할 수 있도록 설계된 프레임워크입니다. 파일 업로드 후 전체를 처리하는 대신(배치 모드) 연속적인 오디오 청크 스트림을 받아 즉시 점진적인 텍스트 변환을 생성합니다.

    958+25최근 7일 스타 변화
  • botium-speech-processing@codeforequity-at

    Botium 음성 처리

    943+0최근 7일 스타 변화
  • whisper.net@sandrohanea

    Whisper.net. Whisper 모델을 사용하여 간편하게 구현하는 음성 인식(STT)

    941+1최근 7일 스타 변화
  • jiwer@jitsi

    단어 오류율(WER)과 같은 유사도 지표로 speech-to-text 시스템을 평가하세요.

    928+2최근 7일 스타 변화
  • MauiSamples@VladislavAntonyuk

    .NET MAUI 예제

    915+0최근 7일 스타 변화
  • voicy@backmeupplz

    @voicybot 텔레그램 봇 메인 저장소

    911+2최근 7일 스타 변화
  • LiveStream-Agent-Studio@HanyuanWang

    面向抖音直播电商的 Windows 本地 AI Agent Studio,贯通主播发现、直播洞察、直播复盘与短视频内容编导的统一智能工作流。

    899+522최근 7일 스타 변화
  • TheWhisper@TheStageAI

    스트리밍 및 온디바이스 사용을 위해 최적화된 Whisper 모델

    897+0최근 7일 스타 변화
  • TypeNo@marswaveai

    macOS를 위한 무료, 오픈 소스, 프라이버시 우선 음성 입력 앱

    896+4최근 7일 스타 변화
  • PPASR@yeyupiaoling

    PaddlePaddle 기반의 엔드투엔드 중국어 음성 인식 구현. 입문부터 실전까지, 초보자를 위한 간단한 사례와 실용적인 기업 프로젝트 포함. DeepSpeech2, Conformer, Squeezeformer 모델 지원

    870-1최근 7일 스타 변화
  • react-speech-recognition@JamesBrill

    💬React 앱을 위한 음성 인식

    842+1최근 7일 스타 변화
  • whisper-playground@saharmor

    OpenAI의 Whisper를 사용하여 실시간 speech2text 웹 앱 구축 https://openai.com/blog/whisper/

    835+0최근 7일 스타 변화
  • kur@deepgram

    기술적 딥러닝

    823-1최근 7일 스타 변화
  • MioSub@corvo007

    다운로드, 전사, 번역, 인코딩까지 전 과정을 자동화한 원스톱 자막 생성 소프트웨어로, 사람의 개입이 필요 없습니다.

    810+3최근 7일 스타 변화
  • vocalinux@VocaHQ

    Linux용 무료 오픈소스 100% 오프라인 음성 받아쓰기 도구. whisper.cpp, Whisper, VOSK 엔진을 사용하며 GPU 가속 및 X11/Wayland 지원

    806+21최근 7일 스타 변화
  • lobe-tts@lobehub

    🎤 Lobe TTS - 서버와 브라우저를 위한 고품질의 안정적인 TTS/STT 라이브러리

    805+1최근 7일 스타 변화
  • Speech to Text to Speech. 현재 재생 중인 곡. 텍스트를 OSC 메시지로 VRChat에 전송하여 아바타에 표시합니다. (STTTS) (Speech to TTS) (VRC STT System) (VTuber TTS)

    803+4최근 7일 스타 변화
  • june@mezbaul-h

    Ollama, Hugging Face Transformers, Coqui TTS Toolkit 기반의 대화형 로컬 음성 챗봇

    788+1최근 7일 스타 변화
  • whisper_mic@mallorbc

    OpenAI whisper와 함께 마이크를 사용할 수 있게 해주는 프로젝트

    787+0최근 7일 스타 변화
  • SwiftWhisper@exPHAT

    🎤 Swift에서 오디오를 가장 쉽게 변환(transcribe)하는 방법

    785-1최근 7일 스타 변화
  • NotelyVoice@Notely-Voice

    100개 이상의 언어로 음성을 텍스트로 변환하는 100% 프라이빗 AI 음성 전사 앱. Whisper AI를 사용하여 Android 및 iOS용 Compose Multiplatform으로 제작되었으며, 클라우드 업로드 없이 완전히 온디바이스로 처리되어 완벽한 개인정보 보호를 제공합니다.

    777+1최근 7일 스타 변화
  • mlx-audio-swift@Blaizzy

    Apple Silicon의 MLX를 활용한 오디오 처리를 위한 모듈형 Swift SDK

    772+6최근 7일 스타 변화
  • BiBi-Keyboard@BryceWG

    BiBi Keyboard: Kotlin 기반의 Android 플랫폼 LLM 및 ASR 음성 입력기 키보드 애플리케이션

    768+17최근 7일 스타 변화
  • PaddlePaddle-DeepSpeech@yeyupiaoling

    PaddlePaddle 기반의 중국어 음성 인식 프로젝트. Windows 및 Linux 환경에서의 학습과 예측을 지원하며 Nvidia Jetson 개발 보드에서의 예측도 가능함

    762+0최근 7일 스타 변화
  • chaplin@amanvirparhar

    실시간 무음 음성 인식 도구.

    754+2최근 7일 스타 변화
  • 로컬 머신의 Unity3d에서 음성 인식 모델(whisper.cpp) 실행하기.

    751+1최근 7일 스타 변화
  • Transcribro@soupslurpr

    Android용 프라이빗 온디바이스 음성 인식 키보드 및 서비스.

    745+6최근 7일 스타 변화
← 토픽 목록으로