whisper
Các kho mã nguồn mở đang theo dõi được gắn thẻ whisper, sắp xếp theo số sao.
Chủ đề liên quan
Những chủ đề thường xuất hiện cùng whisper trên cùng một kho mã.
Mới nổi gần đây
Các kho mã tạo trong 90 ngày qua và được gắn thẻ whisper.
- #1
Cho phép Claude (hoặc bất kỳ LLM nào) thực sự xem video — nhận biết cảnh, loại bỏ khung hình trùng lặp + bản ghi lời thoại, từ URL hoặc tệp cục bộ. Chạy cục bộ, giấy phép MIT.
★ 2.109
- #1
Chuyển đổi mô hình Whisper của OpenAI sang C/C++
★ 53.389+103Thay đổi số sao trong 7 ngày qua - #2★ 52.177+379Thay đổi số sao trong 7 ngày qua
- #3
Trợ lý họp AI ưu tiên quyền riêng tư với bản ghi âm trực tiếp Parakeet/Whisper nhanh hơn 4 lần, phân đoạn người nói và tóm tắt bằng Ollama được xây dựng bằng Rust. Xử lý cục bộ 100%, không cần đám mây.
★ 30.252+195Thay đổi số sao trong 7 ngày qua - #4
Chuyển đổi giọng nói thành văn bản Whisper nhanh hơn với CTranslate2
★ 25.206+71Thay đổi số sao trong 7 ngày qua - #5
WhisperX: Nhận diện giọng nói tự động với mốc thời gian cấp độ từ (và phân đoạn người nói)
★ 23.864+61Thay đổi số sao trong 7 ngày qua - #6
Buzz chép lời và dịch âm thanh ngoại tuyến trên máy tính cá nhân của bạn. Được hỗ trợ bởi Whisper của OpenAI.
★ 21.279+87Thay đổi số sao trong 7 ngày qua - #7
Gradio WebUI dành cho người sáng tạo và nhà phát triển, tích hợp các tính năng TTS chính (Edge-TTS, kokoro) và nhân bản giọng nói zero-shot (E2 & F5-TTS, CosyVoice), xử lý âm thanh Whisper, tải xuống YouTube, tách giọng hát Demucs và dịch đa ngôn ngữ.
★ 12.730+54Thay đổi số sao trong 7 ngày qua - #8
Bộ công cụ xử lý giọng nói dễ sử dụng, bao gồm mô hình tự giám sát (Self-Supervised Learning), SOTA/Streaming ASR có dấu câu, Streaming TTS tích hợp frontend văn bản, Hệ thống xác thực người nói, Dịch giọng nói đầu cuối và Nhận diện từ khóa. Đạt giải Demo xuất sắc nhất tại NAACL 2022.
★ 12.676+5Thay đổi số sao trong 7 ngày qua - #9
Chuyển đổi giọng nói thành văn bản cục bộ, thời gian thực với ASR phát trực tuyến, phân đoạn người nói, dịch thuật và các API tương thích với OpenAI/Deepgram.
★ 10.990+16Thay đổi số sao trong 7 ngày qua - #10
Ứng dụng dịch thời gian thực mã nguồn mở dành cho Android chạy cục bộ
★ 10.378+13Thay đổi số sao trong 7 ngày qua - #11
Thay thế GPT bằng bất kỳ LLM nào chỉ với một dòng mã. Xinference cho phép bạn chạy các mô hình mã nguồn mở, giọng nói và đa phương thức trên đám mây, tại chỗ hoặc trên máy tính xách tay — tất cả thông qua một API suy luận thống nhất, sẵn sàng cho môi trường sản xuất.
★ 9.537+9Thay đổi số sao trong 7 ngày qua - #12★ 7.262+34Thay đổi số sao trong 7 ngày qua
- #13
AI giọng nói trên thiết bị dành cho Apple Silicon
★ 6.353+8Thay đổi số sao trong 7 ngày qua - #14
Ứng dụng đọc chính tả giọng nói thành văn bản hỗ trợ mô hình cục bộ (Nvidia Parakeet/Whisper) và đám mây (BYOK). Ưu tiên quyền riêng tư và hỗ trợ đa nền tảng.
★ 6.133+305Thay đổi số sao trong 7 ngày qua - #15
Lượng tử hóa, kernel, runtime và công cụ suy luận cho thiết bị di động, thiết bị đeo, nhà thông minh và robot.
★ 5.975+20Thay đổi số sao trong 7 ngày qua - #16
Nhận dạng giọng nói tự động kết hợp phân đoạn người nói dựa trên OpenAI Whisper
★ 5.634+1Thay đổi số sao trong 7 ngày qua - #17
Công cụ bản địa hóa video AI mã nguồn mở: tự động tải xuống video YouTube/Bilibili, nhận diện và dịch phụ đề, lồng tiếng nhân bản giọng nói, trộn âm thanh và chèn phụ đề.
★ 5.404+25Thay đổi số sao trong 7 ngày qua - #18
Bộ công cụ nhận dạng giọng nói đầu-cuối (End-to-End) ưu tiên môi trường production và sẵn sàng cho production
★ 5.229+1Thay đổi số sao trong 7 ngày qua - #19
Công cụ máy tính để bàn mã nguồn mở, miễn phí tất cả trong một dành cho chuyển đổi video thành phụ đề, dịch phụ đề, lồng tiếng AI và nhân bản giọng nói, nhúng phụ đề. Dựa trên các mô hình cục bộ như Whisper / FunASR để chuyển giọng nói thành văn bản ngoại tuyến, xử lý hàng loạt + tăng tốc GPU toàn nền tảng, chéo Windows / macOS / Linux.
★ 4.863+48Thay đổi số sao trong 7 ngày qua - #20
Giải pháp thay thế mã nguồn mở cho Opus Clip, Vidyo.ai, Klap & SubMagic. Biến các video YouTube dài thành video ngắn 9:16 lan truyền bằng cách sử dụng tính năng phát hiện điểm nổi bật LLM, phiên âm Whisper và cắt xén dọc tự động — miễn phí, không có hình mờ, không tính phí theo clip.
★ 4.810+42Thay đổi số sao trong 7 ngày qua - #21
Bản cài đặt JAX của mô hình Whisper từ OpenAI giúp tăng tốc lên tới 70 lần trên TPU.
★ 4.679-1Thay đổi số sao trong 7 ngày qua - #22★ 4.253-3Thay đổi số sao trong 7 ngày qua
- #23
Một bản triển khai gần như thời gian thực của Whisper từ OpenAI.
★ 4.246+3Thay đổi số sao trong 7 ngày qua - #24
Biến thể chưng cất của Whisper dành cho nhận dạng giọng nói. Nhanh hơn 6 lần, nhỏ hơn 50%, tỷ lệ lỗi từ trong khoảng 1%.
★ 4.114+2Thay đổi số sao trong 7 ngày qua - #25
Trình phát đa phương tiện hỗ trợ học ngoại ngữ với phụ đề kép, phụ đề tạo bởi AI, dịch thời gian thực và nhiều tính năng khác!
★ 4.070+12Thay đổi số sao trong 7 ngày qua - #26
Framework dành cho các Ứng dụng Phi tập trung không máy chủ sử dụng Ethereum, IPFS và các nền tảng khác
★ 3.769+0Thay đổi số sao trong 7 ngày qua - #27★ 3.638+8Thay đổi số sao trong 7 ngày qua
- #28
🤖 Một bot Telegram tích hợp với API ChatGPT chính thức của OpenAI để trả lời câu hỏi, được viết bằng Python
★ 3.463+1Thay đổi số sao trong 7 ngày qua - #29
ChatGPT Java SDK hỗ trợ đầu ra dạng stream, plugin GPT và kết nối internet. Hỗ trợ tất cả các API chính thức của OpenAI.
★ 3.421+1Thay đổi số sao trong 7 ngày qua - #30
Nhận dạng giọng nói dựa trên ML trực tiếp trong trình duyệt của bạn
★ 3.339-2Thay đổi số sao trong 7 ngày qua