voice-assistant
Các kho mã nguồn mở đang theo dõi được gắn thẻ voice-assistant, sắp xếp theo số sao.
- #31
Trợ lý giọng nói thời gian thực — hỗ trợ truyền phát WebRTC, ASR faster-whisper, LLM cục bộ, TTS Vui Nano (300M). Tương thích với OpenAI Realtime API. Hỗ trợ sao chép giọng nói, ngắt lời, đạt tốc độ ~9× thời gian thực trên card 4090. Giấy phép Apache 2.0.
★ 757+10Thay đổi số sao trong 7 ngày qua - #32★ 750+6Thay đổi số sao trong 7 ngày qua
- #33
JARVIS — Một trợ lý AI ưu tiên giọng nói cho macOS, lấy cảm hứng từ MCU. Hãy nói chuyện với máy tính của bạn, nó sẽ phản hồi và hoàn thành công việc.
★ 733+16Thay đổi số sao trong 7 ngày qua - #34
Công cụ chuyển đổi giọng nói thành ý định (Speech-to-Intent) trên thiết bị được hỗ trợ bởi học sâu
★ 712+3Thay đổi số sao trong 7 ngày qua - #35
Voicetypr - Công cụ chuyển giọng nói thành văn bản ngoại tuyến hỗ trợ bởi AI dành cho các nhà sáng lập, lập trình viên và người dùng chuyên nghiệp trên macOS và Windows. Giải pháp thay thế cho wispr flow và superwhisper.
★ 710+14Thay đổi số sao trong 7 ngày qua - #36
Nền tảng Voice Agent mã nguồn mở
★ 592+2Thay đổi số sao trong 7 ngày qua - #37
Hệ thống tự lập trình cho ứng dụng của bạn — Alan AI SDK cho React Native.
★ 575+0Thay đổi số sao trong 7 ngày qua - #38
Một lớp phủ (overlay) lấy quyền truy cập giọng nói của người dùng và chuyển đổi đầu vào thành văn bản trong giao diện tùy chỉnh
★ 557+1Thay đổi số sao trong 7 ngày qua - #39
Một khung phần mềm và thiết bị AI đàm thoại dành cho các ứng dụng đồng hành, giải trí, giáo dục, chăm sóc sức khỏe, IoT và robot tự chế. Được xây dựng bằng Python, NextJS, Arduino, ESP32, LLM (GPT-4o), Deepgram STT và Azure TTS.
★ 550+1Thay đổi số sao trong 7 ngày qua - #40
Danh sách tổng hợp các tài nguyên trí tuệ nhân tạo (Khóa học, Công cụ, Ứng dụng, Dự án mã nguồn mở)
★ 548-1Thay đổi số sao trong 7 ngày qua - #41
Trợ lý giọng nói cá nhân của riêng bạn: Chuyển đổi giọng nói thành văn bản, gửi đến LLM rồi chuyển thành giọng nói, hiển thị trên giao diện web.
★ 526+1Thay đổi số sao trong 7 ngày qua