text-to-speech
Các kho mã nguồn mở đang theo dõi được gắn thẻ text-to-speech, sắp xếp theo số sao.
- #121
Gói chuyển văn bản thành giọng nói (TTS) cho Flutter
★ 753+0Thay đổi số sao trong 7 ngày qua - #122
Kokoro Web: Công cụ chuyển văn bản thành giọng nói AI miễn phí, hỗ trợ chạy trực tuyến hoặc tự lưu trữ, tương thích với OpenAI.
★ 733+2Thay đổi số sao trong 7 ngày qua - #123
Rapida là một nền tảng điều phối AI giọng nói mã nguồn mở, dùng để xây dựng các tác nhân giọng nói hội thoại thời gian thực với tính năng truyền phát âm thanh, STT, TTS, VAD, tích hợp đa kênh, quản lý trạng thái tác nhân và khả năng quan sát.
★ 723+4Thay đổi số sao trong 7 ngày qua - #124
Chuyển đổi giọng nói thành văn bản và phụ đề nhập liệu KB cho OBS, VRChat, Twitch chat và Discord
★ 718-1Thay đổi số sao trong 7 ngày qua - #125
Trình tạo video tự động hoàn toàn sử dụng đồ họa chuyển động và tổng hợp văn bản thành giọng nói để biến bản tin thành video YouTube hàng ngày.
★ 703+0Thay đổi số sao trong 7 ngày qua - #126
Triển khai Voicebox, mạng chuyển văn bản thành giọng nói SOTA mới từ MetaAI, bằng Pytorch
★ 703+0Thay đổi số sao trong 7 ngày qua - #127
Nhận dạng giọng nói ngoại tuyến với OpenAI Whisper và TensorFlow Lite cho Android
★ 689+1Thay đổi số sao trong 7 ngày qua - #128
API chuyển văn bản thành giọng nói (TTS) cục bộ, tương thích với OpenAI sử dụng Chatterbox, cho phép người dùng tạo giọng nói nhân bản ở bất kỳ đâu sử dụng OpenAI API (ví dụ: Open WebUI, AnythingLLM, v.v.)
★ 677+1Thay đổi số sao trong 7 ngày qua - #129
Tiện ích mở rộng từ điển có thể tùy chỉnh, hỗ trợ tra cứu bằng cách nhấp đúp với hơn 20 ngôn ngữ, hơn 1000 từ điển, chuyển văn bản thành giọng nói, dịch thuật và tích hợp Anki.
★ 671+1Thay đổi số sao trong 7 ngày qua - #130
LLaSA: Mở rộng quy mô tính toán trong quá trình huấn luyện và suy luận cho tổng hợp giọng nói dựa trên LLaMA
★ 658+1Thay đổi số sao trong 7 ngày qua - #131
Triển khai F5-TTS trên MLX.
★ 644+0Thay đổi số sao trong 7 ngày qua - #132★ 626+2Thay đổi số sao trong 7 ngày qua
- #133
Chuyển đổi PDF và EPUB thành sách nói; phụ đề hoặc video thành video lồng tiếng (bao gồm dịch thuật) và nhiều tính năng khác. Miễn phí. Pandrator sử dụng các mô hình cục bộ, bao gồm nhân bản giọng nói (tức thì, tăng cường RVC, tinh chỉnh XTTS) và xử lý LLM. Hướng tới mục tiêu là một ứng dụng thân thiện với người dùng, có giao diện đồ họa, trình cài đặt và các gói tất cả trong một.
★ 620+3Thay đổi số sao trong 7 ngày qua - #134
Script Python đơn giản để tương tác với API TikTok TTS
★ 611+0Thay đổi số sao trong 7 ngày qua - #135
Node tùy chỉnh ComfyUI cho VibeVoice TTS. Hỗ trợ âm thanh hội thoại biểu cảm, dài và đa người nói
★ 596-1Thay đổi số sao trong 7 ngày qua - #136
Hệ thống tự lập trình cho ứng dụng của bạn — Alan AI SDK cho React Native.
★ 575+0Thay đổi số sao trong 7 ngày qua - #137
Phiên bản sửa đổi của Chatterbox chấp nhận tệp văn bản làm đầu vào và không giới hạn ký tự, được sử dụng để tạo sách nói
★ 575-1Thay đổi số sao trong 7 ngày qua - #138
Chạy Qwen3-TTS chuyển văn bản thành giọng nói cục bộ trên Mac (M1/M2/M3/M4). Hỗ trợ nhân bản giọng nói, thiết kế giọng nói, giọng nói tùy chỉnh. Hoạt động 100% ngoại tuyến bằng MLX.
★ 561+2Thay đổi số sao trong 7 ngày qua - #139
Danh sách các bài báo được tuyển chọn về tạo nội dung đa phương thức dựa trên LLM (hình ảnh, video, 3D và âm thanh)
★ 552+0Thay đổi số sao trong 7 ngày qua - #140
Chạy Orpheus 3B cục bộ với LM Studio.
★ 549+0Thay đổi số sao trong 7 ngày qua - #141
Triển khai vits2-TTS không chính thức bằng PyTorch.
★ 549+1Thay đổi số sao trong 7 ngày qua - #142
AI Plugin là một tiện ích mở rộng mạnh mẽ cho Payload CMS, tích hợp các khả năng AI tiên tiến để nâng cao việc tạo và quản lý nội dung.
★ 548-1Thay đổi số sao trong 7 ngày qua - #143
Công cụ đọc chính tả bằng giọng nói cục bộ, miễn phí, tốc độ cao cho macOS với khả năng chuyển đổi văn bản trên thiết bị
★ 546+13Thay đổi số sao trong 7 ngày qua - #144
Các node OmniVoice TTS cho ComfyUI - Chuyển văn bản thành giọng nói đa ngôn ngữ zero-shot với khả năng sao chép giọng nói, thiết kế giọng nói và hội thoại đa người nói
★ 545+6Thay đổi số sao trong 7 ngày qua - #145★ 525+2Thay đổi số sao trong 7 ngày qua
- #146
Triển khai E2-TTS, "Embarrassingly Easy Fully Non-Autoregressive Zero-Shot TTS", bằng Pytorch
★ 517+0Thay đổi số sao trong 7 ngày qua - #147
Mô hình chuyển đổi văn bản thành giọng nói (Text-to-Speech) nhân bản giọng nói tiếng Việt ✨
★ 516-1Thay đổi số sao trong 7 ngày qua - #148
Máy chủ suy luận ngôn ngữ mã nguồn mở, chạy cục bộ, tự lưu trữ và được tối ưu hóa cao, hỗ trợ ASR/STT, TTS và LLM qua WebRTC, REST và WS.
★ 512+0Thay đổi số sao trong 7 ngày qua - #149
Node ComfyUI cho giọng nói biểu cảm cao và nhân bản giọng nói zero-shot thực tế.
★ 509+0Thay đổi số sao trong 7 ngày qua - #150
An open-source read-along document reader server with high-quality TTS options, synchronized highlighting, and audiobook export for EPUB, PDF, DOCX, TXT, and MD.
★ 505+4Thay đổi số sao trong 7 ngày qua