Chuyển tới nội dung chính
buildradar
Đăng nhập
Chủ đề · text-to-speech

text-to-speech

Các kho mã nguồn mở đang theo dõi được gắn thẻ text-to-speech, sắp xếp theo số sao.

150 kho mã
  • TTS-Audio-Suite@diodiogod

    Một tích hợp node tùy chỉnh ComfyUI cho chuyển đổi văn bản thành giọng nói và chuyển đổi giọng nói đa ngôn ngữ, đa công nghệ cục bộ. Hỗ trợ: RVC, Echo-TTS, Qwen3-TTS, Cozy Voice 3, Step Audio EditX, IndexTTS-2, Chatterbox (cổ điển và đa ngôn ngữ), F5-TTS, Higgs Audio 2, 3 và VibeVoice với độ dài văn bản không giới hạn, thời gian SRT, hỗ trợ nhân vật và nhiều công cụ âm thanh khác

    1.187+0Thay đổi số sao trong 7 ngày qua
  • Phòng thí nghiệm thực tế để xây dựng, kiểm thử và đánh giá các ứng dụng sử dụng framework Foundation Models của Apple.

    1.178+0Thay đổi số sao trong 7 ngày qua
  • dia2@nari-labs

    Mô hình TTS có khả năng truyền phát âm thanh hội thoại theo thời gian thực.

    1.173+0Thay đổi số sao trong 7 ngày qua
  • speech-swift@soniqo

    Bộ công cụ giọng nói AI dành cho Apple Silicon — ASR, TTS, chuyển đổi giọng nói thành giọng nói, VAD và phân đoạn người nói được hỗ trợ bởi MLX và CoreML

    1.161+0Thay đổi số sao trong 7 ngày qua
  • Hệ thống tự lập trình cho ứng dụng của bạn — Alan AI SDK cho Cordova

    1.132+0Thay đổi số sao trong 7 ngày qua
  • Uncensored-Local-Studio@techjarves

    Studio AI cục bộ không kiểm duyệt dành cho Windows, Linux và macOS. Giao diện đồ họa thiết lập bằng không cho Tạo ảnh, GGUF LLM, Chuyển văn bản thành giọng nói & Chuyển giọng nói thành văn bản

    1.118+13Thay đổi số sao trong 7 ngày qua
  • sglang-omni@sgl-project

    SGLang-Omni hỗ trợ phục vụ hiệu suất cao cho TTS, ASR, các mô hình giọng nói và đa năng (omni).

    1.118+56Thay đổi số sao trong 7 ngày qua
  • Patter@PatterAI

    SDK AI giọng nói mã nguồn mở. Giải pháp thay thế Vapi/Retell cho các nhà phát triển muốn làm chủ ngăn xếp công nghệ. Cung cấp số điện thoại cho AI agent của bạn chỉ với 4 dòng code — Python và TypeScript, giấy phép MIT, hỗ trợ Twilio, Telnyx và Plivo.

    1.051+7Thay đổi số sao trong 7 ngày qua
  • Cognitive-Speech-TTS@Azure-Samples

    Mã nguồn mẫu Microsoft Text-to-Speech API bằng nhiều ngôn ngữ, là một phần của Cognitive Services.

    1.014+1Thay đổi số sao trong 7 ngày qua
  • alexandria-audiobook@Finrandojin

    Trình tạo sách nói đa giọng nói hỗ trợ bởi AI — chú thích kịch bản LLM, nhân bản giọng nói, thiết kế giọng nói, huấn luyện LoRA, kiểm soát phong cách theo từng dòng, và xuất ra MP3, M4B chia chương, hoặc đa rãnh Audacity. Xây dựng trên Qwen3-TTS.

    1.000+10Thay đổi số sao trong 7 ngày qua
  • Step-Audio-EditX@stepfun-ai

    Một mô hình chỉnh sửa âm thanh Học tăng cường dựa trên LLM 3B tham số mạnh mẽ, xuất sắc trong việc chỉnh sửa cảm xúc, phong cách nói và ngôn ngữ cận lời, đồng thời tích hợp tính năng chuyển đổi văn bản thành giọng nói zero-shot mạnh mẽ

    973+1Thay đổi số sao trong 7 ngày qua
  • NISQA@gabrielmittag

    NISQA - Đánh giá chất lượng giọng nói không xâm nhập và độ tự nhiên của TTS

    972+4Thay đổi số sao trong 7 ngày qua
  • botium-speech-processing@codeforequity-at

    Xử lý giọng nói Botium

    943+0Thay đổi số sao trong 7 ngày qua
  • Làm cho giọng nói TTS tự nhiên của Azure có thể truy cập được đối với bất kỳ ứng dụng tương thích SAPI 5 nào.

    934+7Thay đổi số sao trong 7 ngày qua
  • Client Vonage REST API cho PHP. Hỗ trợ API cho SMS, Voice, Text-to-Speech, Numbers, Verify (2FA) và nhiều tính năng khác.

    931-1Thay đổi số sao trong 7 ngày qua
  • FireRedTTS@FireRedTeam

    Hệ thống TTS nền tảng mã nguồn mở được hỗ trợ bởi LLM

    919-1Thay đổi số sao trong 7 ngày qua
  • EDDiscovery@EDDiscovery

    Nhật ký thuyền trưởng và bản đồ sao 3D cho Elite Dangerous

    900+4Thay đổi số sao trong 7 ngày qua
  • diffwave@lmnt-com

    DiffWave là một bộ tổng hợp dạng sóng và bộ tạo giọng nói neural nhanh chóng, chất lượng cao.

    884-1Thay đổi số sao trong 7 ngày qua
  • bark.cpp@PABannier

    Mô hình Bark của Suno AI viết bằng C/C++ để tạo văn bản thành giọng nói tốc độ cao

    868+2Thay đổi số sao trong 7 ngày qua
  • lue@paulilaaso

    Trình đọc eBook trên terminal với tính năng chuyển đổi văn bản thành giọng nói chất lượng như sách nói — Hỗ trợ EPUB, PDF, DOCX, HTML, RTF, TXT và MD.

    805+1Thay đổi số sao trong 7 ngày qua
  • lobe-tts@lobehub

    Lobe TTS - Thư viện TTS/STT chất lượng cao và đáng tin cậy cho máy chủ và trình duyệt.

    805-1Thay đổi số sao trong 7 ngày qua
  • CloneTTS@sipeter

    Công cụ chuyển văn bản thành giọng nói (TTS) Android nhẹ, hoạt động ngoại tuyến, hỗ trợ sao chép giọng nói toàn hệ thống và đọc văn bản chất lượng cao.

    804+5Thay đổi số sao trong 7 ngày qua
  • Chuyển đổi giọng nói thành văn bản rồi thành giọng nói (Speech to Text to Speech). Gửi văn bản dưới dạng thông điệp OSC tới VRChat để hiển thị trên avatar.

    804+5Thay đổi số sao trong 7 ngày qua
  • ai-video-editor@MartinDelophy

    Trình chỉnh sửa video mã nguồn mở, ưu tiên lưu trữ cục bộ, nơi người sáng tạo và các tác nhân AI cùng chỉnh sửa trên một dòng thời gian thực.

    798+82Thay đổi số sao trong 7 ngày qua
  • Confucius4-TTS@netease-youdao

    Confucius4-TTS: Công cụ TTS Zero-Shot đa ngôn ngữ và xuyên ngôn ngữ

    794+6Thay đổi số sao trong 7 ngày qua
  • Công cụ dịch màn hình Android thời gian thực mã nguồn mở không cần ROOT, phù hợp cho trò chơi, tiểu thuyết hình ảnh và manga. Hỗ trợ OCR trên thiết bị và đám mây, LLM ngoại tuyến, nhiều dịch vụ dịch thuật, hiển thị bản dịch trên màn hình và chuyển văn bản thành giọng nói (TTS).

    794+73Thay đổi số sao trong 7 ngày qua
  • june@mezbaul-h

    Chatbot giọng nói cục bộ cho các cuộc hội thoại hấp dẫn, được hỗ trợ bởi Ollama, Hugging Face Transformers và Coqui TTS Toolkit

    788+1Thay đổi số sao trong 7 ngày qua
  • mlx-audio-swift@Blaizzy

    SDK Swift dạng mô-đun để xử lý âm thanh với MLX trên Apple Silicon

    774+5Thay đổi số sao trong 7 ngày qua
  • vui@fluxions-ai

    Trợ lý giọng nói thời gian thực — hỗ trợ truyền phát WebRTC, ASR faster-whisper, LLM cục bộ, TTS Vui Nano (300M). Tương thích với OpenAI Realtime API. Hỗ trợ sao chép giọng nói, ngắt lời, đạt tốc độ ~9× thời gian thực trên card 4090. Giấy phép Apache 2.0.

    759+7Thay đổi số sao trong 7 ngày qua
  • cboard@cboard-org

    Hệ thống giao tiếp tăng cường và thay thế (AAC) với tính năng chuyển văn bản thành giọng nói trên trình duyệt.

    756+9Thay đổi số sao trong 7 ngày qua
← Quay lại danh sách chủ đề