Chuyển tới nội dung chính
buildradar
Sign in
Chủ đề · tts

tts

Các kho mã nguồn mở đang theo dõi được gắn thẻ tts, sắp xếp theo số sao.

189 kho mã
  • ReadAny@codedogQBY

    Trình đọc sách điện tử đa nền tảng tích hợp AI với tìm kiếm ngữ nghĩa, trò chuyện RAG, kho vector cục bộ, ghi chú, TTS và đồng bộ hóa WebDAV.

    2.305+24Thay đổi số sao trong 7 ngày qua
  • easyVoice@cosin2077

    Công cụ chuyển văn bản thành giọng nói mã nguồn mở, hỗ trợ văn bản cực dài và lồng tiếng đa nhân vật

    2.296+7Thay đổi số sao trong 7 ngày qua
  • vall-e@lifeiteng

    Bản cài đặt PyTorch của VALL-E (Zero-Shot Text-To-Speech), Demo tái tạo tại https://lifeiteng.github.io/valle/index.html

    2.215+0Thay đổi số sao trong 7 ngày qua
  • audio.cpp@0xShug0

    Một công cụ suy luận C++ thuần túy, tất cả trong một dành cho các mô hình âm thanh, được hỗ trợ bởi ggml. Hỗ trợ TTS, STT, VAD, chuyển đổi giọng nói, tạo nhạc và nhiều tính năng khác với hiệu năng được tối ưu hóa cao. Không phụ thuộc Python.

    2.214+115Thay đổi số sao trong 7 ngày qua
  • IMS-Toucan@DigitalPhonetics

    Chuyển văn bản thành giọng nói có thể kiểm soát và nhanh chóng cho hơn 7000 ngôn ngữ!

    2.207-1Thay đổi số sao trong 7 ngày qua
  • openai-edge-tts@travisvn

    Endpoint API chuyển văn bản thành giọng nói miễn phí, chất lượng cao để thay thế OpenAI, Azure hoặc ElevenLabs

    2.075+5Thay đổi số sao trong 7 ngày qua
  • Trình chuyển đổi EPUB sang sách nói, được tối ưu hóa cho Audiobookshelf, tích hợp WebUI

    2.064+1Thay đổi số sao trong 7 ngày qua
  • ElatoAI@akdeb

    Đồ chơi AI giọng nói thời gian thực với hơn 100 mô hình trên Arduino ESP32 sử dụng Secure Websockets và Edge Functions dành cho các thiết bị và bạn đồng hành AI.

    1.938+5Thay đổi số sao trong 7 ngày qua
  • YandexStation@AlexxIT

    Quản lý Yandex.Station và các thiết bị nhà thông minh khác có Alisa từ Home Assistant

    1.917-1Thay đổi số sao trong 7 ngày qua
  • Dot@alexpinel

    Text-To-Speech, RAG và LLMs. Hoàn toàn chạy nội bộ!

    1.912+1Thay đổi số sao trong 7 ngày qua
  • comfyui-mixlab-nodes@MixLabPro

    Workflow-to-APP, ScreenShare&FloatingVideo, GPT & 3D, SpeechRecognition&TTS

    1.861-2Thay đổi số sao trong 7 ngày qua
  • RHVoice@RHVoice

    một phần mềm tổng hợp giọng nói mã nguồn mở và miễn phí cho tiếng Nga và các ngôn ngữ khác

    1.836+1Thay đổi số sao trong 7 ngày qua
  • kokoro-tts@nazdridoy

    Công cụ CLI chuyển văn bản thành giọng nói sử dụng mô hình Kokoro, hỗ trợ nhiều ngôn ngữ, giọng đọc (kèm tính năng pha trộn) và nhiều định dạng đầu vào khác nhau bao gồm sách EPUB và tài liệu PDF.

    1.835+14Thay đổi số sao trong 7 ngày qua
  • Genie-TTS@High-Logic

    Trình suy luận ONNX & chuyển đổi mô hình cho GPT-SoVITS

    1.760+3Thay đổi số sao trong 7 ngày qua
  • bailing@wwbin2017

    Bailing là một robot trò chuyện bằng giọng nói tương tự GPT-4o, được triển khai thông qua ASR+LLM+TTS, tích hợp các mô hình ngôn ngữ lớn xuất sắc như DeepSeek R1, kết nối với openClaw, là trợ lý giọng nói cá nhân thực thụ với độ trễ thấp tới 800ms, có thể chạy trên các cấu hình thấp như Mac và hỗ trợ ngắt lời

    1.759+2Thay đổi số sao trong 7 ngày qua
  • VideoClaw@HITsz-TMG

    🚀 Nhân viên tạo video tự động hóa hoàn toàn bằng AI | Đồng nghiệp AIGC đầu tiên của bạn. Trò chuyện về một ý tưởng. Nhận một bộ phim. 🦞

    1.749+14Thay đổi số sao trong 7 ngày qua
  • Tự động dịch văn bản của video dựa trên tệp phụ đề, sau đó sử dụng các dịch vụ giọng nói AI để tạo một bản âm thanh lồng tiếng & dịch mới với phần lời thoại được đồng bộ hóa theo thời gian của phụ đề.

    1.746-1Thay đổi số sao trong 7 ngày qua
  • vox-director@Alisa0808

    Biến một chủ đề thành video giải thích/quảng cáo cắt dán giấy kiểu Vox hoàn chỉnh — tự động hóa từ đầu đến cuối trên Atlas Cloud + ffmpeg. Một kỹ năng agent.

    1.698+67Thay đổi số sao trong 7 ngày qua
  • uzu@trymirai

    Công cụ suy luận hiệu suất cao cho các mô hình AI

    1.687+4Thay đổi số sao trong 7 ngày qua
  • Gặp gỡ Ava, Tác nhân WhatsApp

    1.675+2Thay đổi số sao trong 7 ngày qua
  • ParallelWaveGAN@kan-bayashi

    Bản triển khai không chính thức của Parallel WaveGAN (+ MelGAN & Multi-band MelGAN & HiFi-GAN & StyleMelGAN) bằng PyTorch

    1.646+1Thay đổi số sao trong 7 ngày qua
  • dsnote@mkiol

    Ứng dụng Speech Note trên Linux. Ghi chú, đọc và dịch với tính năng Chuyển giọng nói thành văn bản, Chuyển văn bản thành giọng nói và Dịch máy ngoại tuyến.

    1.622+8Thay đổi số sao trong 7 ngày qua
  • amica@semperai

    Amica là một giao diện mã nguồn mở dùng để giao tiếp tương tác với các nhân vật 3D tích hợp tổng hợp giọng nói và nhận dạng giọng nói.

    1.591-2Thay đổi số sao trong 7 ngày qua
  • VibeVoice-ComfyUI@Enemyx-net

    Tích hợp ComfyUI toàn diện cho mô hình chuyển văn bản thành giọng nói VibeVoice của Microsoft, hỗ trợ tổng hợp giọng nói một và nhiều người nói chất lượng cao trực tiếp trong quy trình làm việc ComfyUI của bạn.

    1.555+4Thay đổi số sao trong 7 ngày qua
  • soprano@ekwek1

    Soprano: Chuyển đổi văn bản thành giọng nói tức thì và siêu thực tế.

    1.548+60Thay đổi số sao trong 7 ngày qua
  • dicio-android@DicioTeam

    Ứng dụng trợ lý Dicio cho Android

    1.463+3Thay đổi số sao trong 7 ngày qua
  • BrowserAI@sauravpanda

    Chạy các LLM cục bộ như llama, deepseek-distill, kokoro và nhiều mô hình khác ngay trong trình duyệt của bạn

    1.449+1Thay đổi số sao trong 7 ngày qua
  • Voice-Cloning-App@voice-cloning-app

    Một ứng dụng Python/PyTorch để tổng hợp giọng nói con người một cách dễ dàng

    1.440+0Thay đổi số sao trong 7 ngày qua
  • OuteTTS@edwko

    Giao diện cho các mô hình OuteTTS.

    1.437+0Thay đổi số sao trong 7 ngày qua
  • Tự triển khai mô hình Chatterbox TTS mạnh mẽ. Máy chủ này cung cấp Web UI thân thiện với người dùng, các điểm cuối API linh hoạt (bao gồm tương thích với OpenAI), giọng đọc có sẵn, nhân bản giọng nói và xử lý văn bản quy mô sách nói lớn. Chạy tăng tốc trên NVIDIA (CUDA), AMD (ROCm) và CPU.

    1.427+1Thay đổi số sao trong 7 ngày qua
← Quay lại danh sách chủ đề