transcription
transcription 태그가 달린 추적 중인 오픈소스 리포지토리를 스타 수 순으로 보여줘요.
- #31
모바일 기기에서 고품질 음성 전사를 더욱 쉽게 사용할 수 있도록 하는 오픈소스 iOS 앱
★ 1,102+8최근 7일 스타 변화 - #32★ 1,091+43최근 7일 스타 변화
- #33
Whisper-Flow는 OpenAI의 Whisper 모델을 사용하여 오디오 콘텐츠를 실시간으로 변환할 수 있도록 설계된 프레임워크입니다. 파일 업로드 후 전체를 처리하는 대신(배치 모드) 연속적인 오디오 청크 스트림을 받아 즉시 점진적인 텍스트 변환을 생성합니다.
★ 958+25최근 7일 스타 변화 - #34
LLM 요약 기능이 포함된 턴키 방식의 자체 호스팅 오프라인 음성 변환 및 화자 분리 서비스
★ 948+2최근 7일 스타 변화 - #35
스트리밍 및 온디바이스 사용을 위해 최적화된 Whisper 모델
★ 897+0최근 7일 스타 변화 - #36★ 868+0최근 7일 스타 변화
- #37★ 865+32최근 7일 스타 변화
- #38★ 810+3최근 7일 스타 변화
- #39
🎤 Swift에서 오디오를 가장 쉽게 변환(transcribe)하는 방법
★ 785-1최근 7일 스타 변화 - #40
Whisper를 사용하여 YouTube 재생 목록 전체를 고품질 스크립트로 쉽게 변환합니다.
★ 689+2최근 7일 스타 변화 - #41
Android용 OpenAI Whisper 및 TensorFlow Lite를 사용한 오프라인 음성 인식.
★ 688+0최근 7일 스타 변화 - #42★ 671+0최근 7일 스타 변화
- #43★ 669+0최근 7일 스타 변화
- #44
중국 옴니채널 콘텐츠(Douyin, Bilibili, Xiaohongshu, 공식 계정, X, 팟캐스트)를 개인 지식 베이스로 수집하는 13가지 AI 스킬: 이미지/텍스트 저장, 비디오 텍스트 변환, GPU 없이 자막 우선 처리, 지식 베이스 MCP 서버 포함
★ 661+14최근 7일 스타 변화 - #45
Whisper 기반의 Android 입력 방식 편집기(IME)
★ 633+6최근 7일 스타 변화 - #46
Apple Silicon Mac을 위한 빠르고 개인정보 보호 중심의 로컬 우선 음성 앱. 받아쓰기, 파일/미디어 전사, 회의 녹음, 변환 및 공개 자동화 CLI 제공. 무료 오픈 소스
★ 626+15최근 7일 스타 변화 - #47
오디오 및 비디오의 자동 전사 수정 작업을 더 쉽고 빠르게 만들어주는 React 컴포넌트. BBC News Labs 제작. - 개발 중
★ 621-1최근 7일 스타 변화 - #48
다국어 ASR 및 TTS 모델을 위한 C++ ggml 런타임 허브: Cohere Transcribe, Parakeet TDT, Voxtral, Canary 1B v2 등 지원 및 범용 강제 정렬(forced alignment) 기능 제공
★ 611+20최근 7일 스타 변화 - #49★ 563-1최근 7일 스타 변화
- #50★ 546+0최근 7일 스타 변화
- #51★ 518+2최근 7일 스타 변화
- #52
오픈 소스 오디오 및 비디오 전사 소프트웨어
★ 515+2최근 7일 스타 변화 - #53
사전 학습된 DNN, 강제 정렬(Forced Alignment) 및 Transformer를 사용하여 자막을 자동으로 동기화 및 번역하거나 전사를 통해 새로운 자막을 생성합니다. https://subaligner.readthedocs.io/
★ 509+0최근 7일 스타 변화