Chuyển tới nội dung chính
buildradar
Sign in
Chủ đề · tts

tts

Các kho mã nguồn mở đang theo dõi được gắn thẻ tts, sắp xếp theo số sao.

189 kho mã
  • ChatTTS-ui@jianchang512

    Giao diện web nội bộ đơn giản sử dụng ChatTTS để chuyển văn bản thành giọng nói, đồng thời hỗ trợ cung cấp giao diện API bên ngoài.

    7.648+4Thay đổi số sao trong 7 ngày qua
  • MeloTTS@myshell-ai

    Thư viện chuyển văn bản thành giọng nói đa ngôn ngữ chất lượng cao từ MyShell.ai. Hỗ trợ tiếng Anh, Tây Ban Nha, Pháp, Trung Quốc, Nhật Bản và Hàn Quốc.

    7.616+7Thay đổi số sao trong 7 ngày qua
  • wukong-robot@wzpan

    🤖 wukong-robot là một dự án chatbot/loa thông minh bằng giọng nói tiếng Trung đơn giản, linh hoạt và thanh lịch, hỗ trợ khả năng trò chuyện nhiều lượt với ChatGPT, và có thể là dự án loa thông minh mã nguồn mở đầu tiên hỗ trợ tương tác não-máy tính.

    7.126+2Thay đổi số sao trong 7 ngày qua
  • StyleTTS2@yl4579

    StyleTTS 2: Hướng tới Chuyển văn bản thành giọng nói cấp độ con người thông qua khuếch tán phong cách và huấn luyện đối kháng với các Speech Language Model lớn

    6.342+3Thay đổi số sao trong 7 ngày qua
  • Orpheus-TTS@canopyai

    Hướng tới giọng nói giống con người

    6.324+5Thay đổi số sao trong 7 ngày qua
  • tts-vue@LokerL

    🎤 Công cụ tổng hợp giọng nói của Microsoft, được xây dựng bằng Electron + Vue + ElementPlus + Vite.

    6.103+1Thay đổi số sao trong 7 ngày qua
  • silero-models@snakers4

    Silero Models: các mô hình chuyển văn bản thành giọng nói được huấn luyện trước trở nên vô cùng đơn giản

    6.084-1Thay đổi số sao trong 7 ngày qua
  • abogen@denizsafak

    Tạo sách nói từ EPUB, PDF và văn bản với phụ đề đồng bộ.

    5.831+45Thay đổi số sao trong 7 ngày qua
  • Kokoro-FastAPI@remsky

    Bộ bao bọc (wrapper) tương thích với OpenAI đã được Docker hóa cho Kokoro-82M text-to-speech với PyTorch trên đa nền tảng CPU, AMD, NVIDIA GPU; hỗ trợ đa giọng nói, phối giọng (voice-mixing), tự động ghép nối, mốc thời gian phụ đề, SSML và giao diện web đọc theo

    5.399+19Thay đổi số sao trong 7 ngày qua
  • dramaclaw@dramaclaw

    Công cụ video AIGC đa năng: từ kịch bản đến phim hoàn chỉnh trong một quy trình — phim ngắn, quảng cáo, video sản phẩm, game otome và nhiều hơn nữa.

    4.900+384Thay đổi số sao trong 7 ngày qua
  • DiffSinger@MoonInTheRiver

    DiffSinger: Tổng hợp giọng hát qua cơ chế khuếch tán nông (SVS & TTS); AAAI 2022; Mã nguồn chính thức

    4.855+3Thay đổi số sao trong 7 ngày qua
  • WhisperSpeech@WhisperSpeech

    Một hệ thống chuyển đổi văn bản thành giọng nói mã nguồn mở được xây dựng bằng cách đảo ngược Whisper.

    4.645+3Thay đổi số sao trong 7 ngày qua
  • tts-server-android@jing332

    Ứng dụng TTS hệ thống Android này tích hợp giao diện demo của Microsoft, có thể tùy chỉnh yêu cầu HTTP, nhập các công cụ TTS cục bộ khác, nhận diện và đọc diễn cảm/đối thoại đơn giản dựa trên dấu ngoặc kép tiếng Trung, đồng thời có thêm các tính năng như tự động thử lại, cấu hình dự phòng, thay thế văn bản và nhiều tính năng khác.

    4.488+5Thay đổi số sao trong 7 ngày qua
  • MOSS-TTS-Nano@OpenMOSS

    MOSS-TTS-Nano là mô hình tạo giọng nói đa ngôn ngữ siêu nhỏ mã nguồn mở từ MOSI.AI và đội ngũ OpenMOSS. Chỉ với 0.1B tham số, nó được thiết kế để tạo giọng nói thời gian thực, có thể chạy trực tiếp trên CPU mà không cần GPU, đồng thời giữ cho ngăn xếp triển khai đủ đơn giản để chạy demo cục bộ, phục vụ web và tích hợp sản phẩm nhẹ nhàng.

    4.282+11Thay đổi số sao trong 7 ngày qua
  • metavoice-src@metavoiceio

    Mô hình nền tảng cho TTS tự nhiên, biểu cảm giống con người

    4.203-1Thay đổi số sao trong 7 ngày qua
  • TensorFlowTTS@TensorSpeech

    :stuck_out_tongue_closed_eyes: TensorFlowTTS: Tổng hợp giọng nói thời gian thực tiên tiến cho Tensorflow 2 (hỗ trợ tiếng Anh, Pháp, Hàn, Trung, Đức và dễ thích ứng cho các ngôn ngữ khác)

    3.996+0Thay đổi số sao trong 7 ngày qua
  • Streamer-Sales@PeterH0323

    Streamer-Sales: Mô hình ngôn ngữ lớn (LLM) dành cho streamer bán hàng 🛒🎁, có khả năng giải thích sản phẩm dựa trên các đặc điểm đã cho nhằm kích thích ý định mua hàng của người dùng. 🚀⭐ Bao gồm quy trình tạo dữ liệu chi tiết ❗ 📦 Tích hợp tăng tốc suy luận LMDeploy 🚀, RAG (Tạo tăng cường truy xuất) 📚, TTS (Chuyển văn bản thành giọng nói) 🔊, tạo người ảo 🦸, Agent sử dụng web để tra cứu thông tin thời gian thực 🌐, ASR (Nhận diện giọng nói thành văn bản) 🎙️, frontend xây dựng bằng hệ sinh thái Vue 🍍, backend xây dựng bằng FastAPI 🗝️, đóng gói và triển khai bằng Docker-compose 🐋

    3.764+1Thay đổi số sao trong 7 ngày qua
  • Applio@IAHispano

    Công cụ chuyển đổi giọng nói đơn giản, chất lượng cao, tập trung vào tính dễ sử dụng và hiệu năng.

    3.674+14Thay đổi số sao trong 7 ngày qua
  • TTS-WebUI@rsxdalv

    Giao diện WebUI đơn lẻ tích hợp Gradio + React với các tiện ích mở rộng cho ACE-Step, OmniVoice, Kimi Audio, Piper TTS, GPT-SoVITS, CosyVoice, XTTSv2, DIA, Kokoro, OpenVoice, ParlerTTS, Stable Audio, MMS, StyleTTS2, MAGNet, AudioGen, MusicGen, Tortoise, RVC, Vocos, Demucs, SeamlessM4T và Bark!

    3.250+5Thay đổi số sao trong 7 ngày qua
  • GPA@AutoArk

    [AutoArk] GPA (General Purpose Audio) có thể thực hiện ASR, TTS và chuyển đổi giọng nói chỉ với một mô hình nhỏ gọn!

    3.061+164Thay đổi số sao trong 7 ngày qua
  • openctp@openctp

    openctp cung cấp các giao diện tương thích CTP API cho nhiều kênh giao dịch như CTP, XTP, TORA, OST, EMT, TWS, TAP, QDP. Các chương trình CTP có thể kết nối liền mạch với các quầy giao dịch chứng khoán. openctp cũng cung cấp môi trường mô phỏng dựa trên hệ thống giao dịch TTS, hỗ trợ đầy đủ các loại hợp đồng tương lai, quyền chọn, cổ phiếu A-share, quỹ, trái phiếu, thay thế cho Simnow, cung cấp môi trường mô phỏng 7x24 cho nhà phát triển giao dịch định lượng.

    2.920+7Thay đổi số sao trong 7 ngày qua
  • lingvo@tensorflow

    Lingvo

    2.864+0Thay đổi số sao trong 7 ngày qua
  • aeneas@readbeyond

    aeneas là một thư viện Python/C và bộ công cụ tự động đồng bộ hóa âm thanh và văn bản (còn gọi là căn chỉnh cưỡng bức)

    2.862+0Thay đổi số sao trong 7 ngày qua
  • Stable-Diffusion@FurkanGozukara

    FLUX, Stable Diffusion, SDXL, SD3, LoRA, Fine Tuning, DreamBooth, Training, Automatic1111, Forge WebUI, SwarmUI, DeepFake, TTS, Animation, Text To Video, Tutorials, Guides, Lectures, Courses, ComfyUI, Google Colab, RunPod, Kaggle, NoteBooks, ControlNet, TTS, Voice Cloning, AI, AI News, ML, ML News, News, Tech, Tech News, Kohya, Midjourney, RunPod

    2.762-1Thay đổi số sao trong 7 ngày qua
  • kokoro-onnx@thewh1teagle

    TTS với kokoro và onnx runtime

    2.694+8Thay đổi số sao trong 7 ngày qua
  • gTTS@pndurette

    Thư viện Python và công cụ CLI để giao tiếp với API chuyển đổi văn bản thành giọng nói của Google Translate

    2.628+0Thay đổi số sao trong 7 ngày qua
  • polyglot@liou666

    🤖️ Ứng dụng luyện tập ngôn ngữ AI đa nền tảng

    2.586+1Thay đổi số sao trong 7 ngày qua
  • marytts@marytts

    MARY TTS -- một hệ thống tổng hợp văn bản thành giọng nói đa ngôn ngữ, mã nguồn mở được viết hoàn toàn bằng java

    2.583+0Thay đổi số sao trong 7 ngày qua
  • VieNeu-TTS@pnnbao97

    TTS tiếng Việt với khả năng nhân bản giọng nói tức thì • Chạy trên thiết bị • Suy luận CPU thời gian thực • Chất lượng âm thanh 24kHz • Chuyển văn bản thành giọng nói tiếng Việt • Text to speech tiếng Việt • TTS tiếng Việt

    2.468+21Thay đổi số sao trong 7 ngày qua
  • hifi-gan@jik876

    HiFi-GAN: Generative Adversarial Networks cho tổng hợp giọng nói hiệu quả và độ trung thực cao

    2.367+0Thay đổi số sao trong 7 ngày qua
← Quay lại danh sách chủ đề