speech-processing
Erfasste Open-Source-Repos mit dem Tag speech-processing, sortiert nach Sternen.
Verwandte Themen
Themen, die häufig gemeinsam mit speech-processing am selben Repo auftauchen.
Neue Aufsteiger
Repos, die in den letzten 90 Tagen erstellt und mit speech-processing getaggt wurden.
In den letzten 90 Tagen kam kein neues Repo mit diesem Thema dazu.
- #1
Ein PyTorch-basiertes Speech-Toolkit
★ 11.792+22Sterne-Änderung der letzten 7 Tage - #2
Neuronale Bausteine für Speaker Diarization: Spracherkennungsaktivität, Sprecherwechselerkennung, Erkennung überlappender Sprache, Sprecher-Embedding
★ 10.484+38Sterne-Änderung der letzten 7 Tage - #3
Silero VAD: vortrainierter Spracherkennungsdetektor (Voice Activity Detector) auf Unternehmensebene
★ 10.083+52Sterne-Änderung der letzten 7 Tage - #4
Werde zu einem herausragenden KI/ML-Forscher bzw. -Ingenieur mit diesem unkonventionellen Lehrbuch, das Mathematik, Computing und ML mit Intuition vermittelt.
★ 7.379+33Sterne-Änderung der letzten 7 Tage - #5
Leseliste für Forschungsthemen im Bereich multimodales maschinelles Lernen.
★ 6.925+0Sterne-Änderung der letzten 7 Tage - #6
Grundlagen-Architektur für (M)LLMs
★ 3.138+1Sterne-Änderung der letzten 7 Tage - #7
Mehrsprachige automatische Spracherkennung mit wortgenauen Zeitstempeln und Konfidenzwerten
★ 2.841+2Sterne-Änderung der letzten 7 Tage - #8
KI-gestützte Rauschunterdrückung und Verbesserung von Sprache
★ 2.401+6Sterne-Änderung der letzten 7 Tage - #9
Sprachaktivitätserkennung (VAD): Latenzarm, leistungsstark und leichtgewichtig
★ 2.250+4Sterne-Änderung der letzten 7 Tage - #10
Steuerbare und schnelle Text-to-Speech-Technologie für über 7000 Sprachen!
★ 2.208+0Sterne-Änderung der letzten 7 Tage - #11
Eine kuratierte Liste von großartigen Arbeiten, Bibliotheken, Datensätzen und anderen Ressourcen zur Sprecherdiarisierung.
★ 1.893+2Sterne-Änderung der letzten 7 Tage - #12
💎 Eine Liste barrierefreier Sprachkorpora für ASR, TTS und andere Sprachtechnologien
★ 1.399+0Sterne-Änderung der letzten 7 Tage - #13
Allgemeine Sprachwiederherstellung
★ 1.376+3Sterne-Änderung der letzten 7 Tage - #14
Steuerbare Transkription. Wortgetreu (jede Füllwörter, Pausen, Stottern, Vokallaute) oder beabsichtigt (was der Sprecher sagen wollte, optimiert für Lesbarkeit) mit Zeitstempeln auf Wortebene.
★ 1.362+21Sterne-Änderung der letzten 7 Tage - #15
StreamSpeech ist ein All-in-One-Modell für nahtlose Offline- und Simultanspracherkennung, -sprachübersetzung und -sprachsynthese.
★ 1.288+2Sterne-Änderung der letzten 7 Tage - #16★ 1.146+0Sterne-Änderung der letzten 7 Tage
- #17
Ein Framework für Sprach-, Audio-, Musik- und Textverarbeitung mit Large Language Models
★ 1.056+0Sterne-Änderung der letzten 7 Tage - #18
Hier finden Sie die gewünschten Sprachalgorithmen.
★ 878+1Sterne-Änderung der letzten 7 Tage - #19
[NeurIPS 2021] Multiskalen-Benchmarks für multimodales Repräsentationslernen
★ 636+0Sterne-Änderung der letzten 7 Tage - #20
Ressourcen, Labore, Unternehmen und Praktika im Bereich Sprachtechnologie; Empfehlungen und Eigenbewerbungen sind willkommen.
★ 609+0Sterne-Änderung der letzten 7 Tage