Chuyển tới nội dung chính
buildradar
Sign in
Chủ đề · asr

asr

Các kho mã nguồn mở đang theo dõi được gắn thẻ asr, sắp xếp theo số sao.

86 kho mã
  • Voxtral ASR & TTS chạy nguyên bản và trên trình duyệt. Một triển khai Rust của Voxtral mini realtime ASR/TTS từ Mistral sử dụng framework Burn ML.

    819+2Thay đổi số sao trong 7 ngày qua
  • voxt@hehehai

    Trợ lý giọng nói thông minh chuyển đổi lời nói thành văn bản rõ ràng, các hành động hữu ích và kiến thức có cấu trúc. Giúp người dùng ghi lại ý tưởng, giao tiếp tự nhiên, tự động hóa các tác vụ lặp lại và duy trì năng suất trên các ứng dụng và quy trình làm việc khác nhau.

    807+5Thay đổi số sao trong 7 ngày qua
  • ZerolanLiveRobot@AkagawaTsurunaki

    AI VTuber tích hợp LLM, ASR, TTS, OCR, CV và nhiều công nghệ khác để livestream hoặc chơi Minecraft cùng bạn.

    803+5Thay đổi số sao trong 7 ngày qua
  • BiBi-Keyboard@BryceWG

    BiBi Keyboard: Một ứng dụng bàn phím nhập liệu bằng giọng nói LLM và ASR trên nền tảng Android dựa trên Kotlin

    772+17Thay đổi số sao trong 7 ngày qua
  • cn2an@Ailln

    Chuyển đổi nhanh giữa số tiếng Trung và số Ả Rập (tính năng mới nhất: chuyển đổi phân số, ngày tháng, nhiệt độ, v.v.).

    766+0Thay đổi số sao trong 7 ngày qua
  • PaddlePaddle-DeepSpeech@yeyupiaoling

    Nhận dạng giọng nói tiếng Trung dựa trên PaddlePaddle. Dự án hoàn thiện với hiệu suất nhận dạng tốt. Hỗ trợ huấn luyện và dự đoán trên Windows, Linux, cũng như hỗ trợ dự đoán trên bo mạch phát triển Nvidia Jetson.

    763+0Thay đổi số sao trong 7 ngày qua
  • Chạy mô hình chuyển đổi giọng nói thành văn bản (whisper.cpp) trong Unity3d trên máy cục bộ của bạn.

    751+1Thay đổi số sao trong 7 ngày qua
  • MASR@yeyupiaoling

    Khung nhận dạng giọng nói tự động (ASR) dựa trên PyTorch, hỗ trợ cả chế độ trực tuyến và ngoại tuyến, các mô hình Conformer, Squeezeformer, DeepSpeech2 và nhiều phương pháp tăng cường dữ liệu

    727+0Thay đổi số sao trong 7 ngày qua
  • openspeech@openspeech-team

    Bộ công cụ mã nguồn mở cho nhận dạng giọng nói đầu-cuối, tận dụng PyTorch-Lightning và Hydra.

    714+0Thay đổi số sao trong 7 ngày qua
  • Nhận dạng giọng nói ngoại tuyến với OpenAI Whisper và TensorFlow Lite cho Android

    688+0Thay đổi số sao trong 7 ngày qua
  • Các bài báo INTERSPEECH 2023-2024: Bộ sưu tập đầy đủ các bài nghiên cứu có ảnh hưởng và thú vị từ hội nghị INTERSPEECH 2023-24. Khám phá những tiến bộ mới nhất trong xử lý ngôn ngữ và giọng nói. Bao gồm mã nguồn. Hãy gắn sao cho kho lưu trữ để ủng hộ sự phát triển của công nghệ giọng nói!

    684+0Thay đổi số sao trong 7 ngày qua
  • pyannote-whisper@yinruiqing
    677+0Thay đổi số sao trong 7 ngày qua
  • FireRedASR2S@FireRedTeam

    Hệ thống ASR tất cả trong một cấp công nghiệp SOTA với các mô-đun ASR, VAD, LID và Punc. FireRedASR2 hỗ trợ tiếng Trung (Quan thoại, 20+ phương ngữ/giọng), tiếng Anh, chuyển đổi mã, và ASR cho cả giọng nói lẫn hát. FireRedVAD hỗ trợ giọng nói/hát/nhạc bằng 100+ ngôn ngữ. FireRedLID hỗ trợ 100+ ngôn ngữ và 20+ phương ngữ tiếng Trung. FireRedPunc hỗ trợ tiếng Trung và tiếng Anh.

    672+13Thay đổi số sao trong 7 ngày qua
  • cheetah@Picovoice

    Công cụ chuyển đổi giọng nói thành văn bản trực tuyến trên thiết bị dựa trên học sâu

    671+0Thay đổi số sao trong 7 ngày qua
  • LiveTranslate@TheDeathDragon

    Dịch âm thanh thời gian thực, thu âm thanh hệ thống và micro, chạy ASR (Whisper/SenseVoice), dịch qua API LLM với hiển thị luồng. Phù hợp cho VTuber, người livestream và xem nội dung nước ngoài.

    626+38Thay đổi số sao trong 7 ngày qua
  • ASR_Theory@zw76859420

    Lý thuyết, bài báo nghiên cứu và bài thuyết trình về nhận dạng giọng nói.

    618+0Thay đổi số sao trong 7 ngày qua
  • optimum-intel@huggingface

    🤗 Optimum Intel: Tăng tốc suy luận với các công cụ tối ưu hóa của Intel.

    617+1Thay đổi số sao trong 7 ngày qua
  • RapidASR@RapidAI

    📣 Thư viện nhận dạng giọng nói tự động mã nguồn mở cấp thương mại, sẵn sàng sử dụng, hỗ trợ đa nền tảng, nhận dạng kết hợp tiếng Trung và tiếng Anh. Bản cài đặt suy luận ASR đa nền tảng dựa trên ONNXRuntime và FunASR. Chúng tôi cung cấp bộ API dễ dàng hơn để gọi các mô hình ASR.

    611+0Thay đổi số sao trong 7 ngày qua
  • echokit_server@second-state

    Nền tảng Voice Agent mã nguồn mở

    592+2Thay đổi số sao trong 7 ngày qua
  • auto-caption@HiMeditator

    Phần mềm hiển thị phụ đề thời gian thực đa nền tảng.

    578+4Thay đổi số sao trong 7 ngày qua
  • WhisperS2T@shashikg

    Pipeline chuyển đổi giọng nói thành văn bản được tối ưu hóa cho mô hình Whisper, hỗ trợ nhiều công cụ suy luận.

    578+1Thay đổi số sao trong 7 ngày qua
  • Leaderboard@SpeechColab

    SpeechIO Leaderboard: nền tảng đánh giá hiệu năng toàn diện, mạnh mẽ và quy mô lớn cho Nhận dạng giọng nói tự động (ASR).

    553+3Thay đổi số sao trong 7 ngày qua
  • vosk-browser@ccoreilly

    Thư viện nhận dạng giọng nói chạy trên trình duyệt nhờ bản dựng WebAssembly của Vosk

    529+1Thay đổi số sao trong 7 ngày qua
  • ICASSP-2023-24-Papers@DmitryRyumin

    Tuyển tập các bài báo nghiên cứu từ hội nghị ICASSP 2023-2024. Khám phá những tiến bộ mới nhất trong lĩnh vực âm thanh, giọng nói và xử lý tín hiệu, bao gồm cả mã nguồn

    526+1Thay đổi số sao trong 7 ngày qua
  • whisplay-ai-chatbot@PiSugar

    Chatbot AI bỏ túi được xây dựng bằng RPI Zero 2w / 5.

    513+10Thay đổi số sao trong 7 ngày qua
  • Audar-ASR-V1@AudarAI

    Arabic-first generative speech recognition — Audar-ASR-V1 (Flash + Turbo). #1 on the Open Universal Arabic ASR Leaderboard. Model cards, benchmarks & inference.

    501+7Thay đổi số sao trong 7 ngày qua
← Quay lại danh sách chủ đề