Chuyển tới nội dung chính
buildradar
Đăng nhập
Chủ đề · text-to-speech

text-to-speech

Các kho mã nguồn mở đang theo dõi được gắn thẻ text-to-speech, sắp xếp theo số sao.

150 kho mã
  • flutter_tts@dlutton

    Gói chuyển văn bản thành giọng nói (TTS) cho Flutter

    753+0Thay đổi số sao trong 7 ngày qua
  • kokoro-web@eduardolat

    Kokoro Web: Công cụ chuyển văn bản thành giọng nói AI miễn phí, hỗ trợ chạy trực tuyến hoặc tự lưu trữ, tương thích với OpenAI.

    733+2Thay đổi số sao trong 7 ngày qua
  • voice-ai@rapidaai

    Rapida là một nền tảng điều phối AI giọng nói mã nguồn mở, dùng để xây dựng các tác nhân giọng nói hội thoại thời gian thực với tính năng truyền phát âm thanh, STT, TTS, VAD, tích hợp đa kênh, quản lý trạng thái tác nhân và khả năng quan sát.

    723+4Thay đổi số sao trong 7 ngày qua
  • curses@mmpneo

    Chuyển đổi giọng nói thành văn bản và phụ đề nhập liệu KB cho OBS, VRChat, Twitch chat và Discord

    718-1Thay đổi số sao trong 7 ngày qua
  • podcast-maker@FelippeChemello

    Trình tạo video tự động hoàn toàn sử dụng đồ họa chuyển động và tổng hợp văn bản thành giọng nói để biến bản tin thành video YouTube hàng ngày.

    703+0Thay đổi số sao trong 7 ngày qua
  • voicebox-pytorch@lucidrains

    Triển khai Voicebox, mạng chuyển văn bản thành giọng nói SOTA mới từ MetaAI, bằng Pytorch

    703+0Thay đổi số sao trong 7 ngày qua
  • Nhận dạng giọng nói ngoại tuyến với OpenAI Whisper và TensorFlow Lite cho Android

    689+1Thay đổi số sao trong 7 ngày qua
  • chatterbox-tts-api@travisvn

    API chuyển văn bản thành giọng nói (TTS) cục bộ, tương thích với OpenAI sử dụng Chatterbox, cho phép người dùng tạo giọng nói nhân bản ở bất kỳ đâu sử dụng OpenAI API (ví dụ: Open WebUI, AnythingLLM, v.v.)

    677+1Thay đổi số sao trong 7 ngày qua
  • dictionariez@pnlpal

    Tiện ích mở rộng từ điển có thể tùy chỉnh, hỗ trợ tra cứu bằng cách nhấp đúp với hơn 20 ngôn ngữ, hơn 1000 từ điển, chuyển văn bản thành giọng nói, dịch thuật và tích hợp Anki.

    671+1Thay đổi số sao trong 7 ngày qua
  • LLaSA_training@zhenye234

    LLaSA: Mở rộng quy mô tính toán trong quá trình huấn luyện và suy luận cho tổng hợp giọng nói dựa trên LLaMA

    658+1Thay đổi số sao trong 7 ngày qua
  • f5-tts-mlx@lucasnewman

    Triển khai F5-TTS trên MLX.

    644+0Thay đổi số sao trong 7 ngày qua
  • examples@elevenlabs
    626+2Thay đổi số sao trong 7 ngày qua
  • Pandrator@lukaszliniewicz

    Chuyển đổi PDF và EPUB thành sách nói; phụ đề hoặc video thành video lồng tiếng (bao gồm dịch thuật) và nhiều tính năng khác. Miễn phí. Pandrator sử dụng các mô hình cục bộ, bao gồm nhân bản giọng nói (tức thì, tăng cường RVC, tinh chỉnh XTTS) và xử lý LLM. Hướng tới mục tiêu là một ứng dụng thân thiện với người dùng, có giao diện đồ họa, trình cài đặt và các gói tất cả trong một.

    620+3Thay đổi số sao trong 7 ngày qua
  • tiktok-voice@oscie57

    Script Python đơn giản để tương tác với API TikTok TTS

    611+0Thay đổi số sao trong 7 ngày qua
  • ComfyUI-VibeVoice@wildminder

    Node tùy chỉnh ComfyUI cho VibeVoice TTS. Hỗ trợ âm thanh hội thoại biểu cảm, dài và đa người nói

    596-1Thay đổi số sao trong 7 ngày qua
  • Hệ thống tự lập trình cho ứng dụng của bạn — Alan AI SDK cho React Native.

    575+0Thay đổi số sao trong 7 ngày qua
  • Phiên bản sửa đổi của Chatterbox chấp nhận tệp văn bản làm đầu vào và không giới hạn ký tự, được sử dụng để tạo sách nói

    575-1Thay đổi số sao trong 7 ngày qua
  • Chạy Qwen3-TTS chuyển văn bản thành giọng nói cục bộ trên Mac (M1/M2/M3/M4). Hỗ trợ nhân bản giọng nói, thiết kế giọng nói, giọng nói tùy chỉnh. Hoạt động 100% ngoại tuyến bằng MLX.

    561+2Thay đổi số sao trong 7 ngày qua
  • Danh sách các bài báo được tuyển chọn về tạo nội dung đa phương thức dựa trên LLM (hình ảnh, video, 3D và âm thanh)

    552+0Thay đổi số sao trong 7 ngày qua
  • orpheus-tts-local@isaiahbjork

    Chạy Orpheus 3B cục bộ với LM Studio.

    549+0Thay đổi số sao trong 7 ngày qua
  • vits2_pytorch@p0p4k

    Triển khai vits2-TTS không chính thức bằng PyTorch.

    549+1Thay đổi số sao trong 7 ngày qua
  • payload-ai@ashbuilds

    AI Plugin là một tiện ích mở rộng mạnh mẽ cho Payload CMS, tích hợp các khả năng AI tiên tiến để nâng cao việc tạo và quản lý nội dung.

    548-1Thay đổi số sao trong 7 ngày qua
  • Talkify@tornikegomareli

    Công cụ đọc chính tả bằng giọng nói cục bộ, miễn phí, tốc độ cao cho macOS với khả năng chuyển đổi văn bản trên thiết bị

    546+13Thay đổi số sao trong 7 ngày qua
  • ComfyUI-OmniVoice-TTS@Saganaki22

    Các node OmniVoice TTS cho ComfyUI - Chuyển văn bản thành giọng nói đa ngôn ngữ zero-shot với khả năng sao chép giọng nói, thiết kế giọng nói và hội thoại đa người nói

    545+6Thay đổi số sao trong 7 ngày qua
  • EDDI@EDCD

    Ứng dụng đồng hành cho Elite Dangerous

    525+2Thay đổi số sao trong 7 ngày qua
  • e2-tts-pytorch@lucidrains

    Triển khai E2-TTS, "Embarrassingly Easy Fully Non-Autoregressive Zero-Shot TTS", bằng Pytorch

    517+0Thay đổi số sao trong 7 ngày qua
  • vixtts-demo@thinhlpg

    Mô hình chuyển đổi văn bản thành giọng nói (Text-to-Speech) nhân bản giọng nói tiếng Việt ✨

    516-1Thay đổi số sao trong 7 ngày qua
  • Máy chủ suy luận ngôn ngữ mã nguồn mở, chạy cục bộ, tự lưu trữ và được tối ưu hóa cao, hỗ trợ ASR/STT, TTS và LLM qua WebRTC, REST và WS.

    512+0Thay đổi số sao trong 7 ngày qua
  • ComfyUI-VoxCPM@wildminder

    Node ComfyUI cho giọng nói biểu cảm cao và nhân bản giọng nói zero-shot thực tế.

    509+0Thay đổi số sao trong 7 ngày qua
  • openreader@richardr1126

    An open-source read-along document reader server with high-quality TTS options, synchronized highlighting, and audiobook export for EPUB, PDF, DOCX, TXT, and MD.

    505+4Thay đổi số sao trong 7 ngày qua
← Quay lại danh sách chủ đề