FireRedTeam
Erfasste Open-Source-Repos von FireRedTeam, sortiert nach Sternen.
- #1
FireRed-OpenStoryline ist ein KI-Videobearbeitungsagent, der manuelle Bearbeitung durch natürlichsprachliche Interaktion, LLM-gestützte Planung und präzise Tool-Orchestrierung in eine intentionsgesteuerte Regie verwandelt. Er ermöglicht transparente, interaktive Erstellung mit wiederverwendbaren Style Skills für konsistentes, professionelles Storytelling.
★ 3.352+96Sterne-Änderung der letzten 7 Tage - #2
Open-Source-ASR-Modelle in Industriequalität, die Mandarin, chinesische Dialekte und Englisch unterstützen. Sie erreichen einen neuen SOTA-Standard auf öffentlichen Mandarin-ASR-Benchmarks und bieten zudem eine hervorragende Erkennung von Liedtexten.
★ 1.975+9Sterne-Änderung der letzten 7 Tage - #3
Long-Form-Streaming-TTS-System zur Generierung von Dialogen mit mehreren Sprechern
★ 1.430+4Sterne-Änderung der letzten 7 Tage - #4
FireRed-Image-Edit ist ein leistungsstarkes Bildbearbeitungs-Grundlagenmodell, das Open-Source-Spitzenleistung mit präziser Befehlsausführung, treuer Generierung, überlegener Identitätskonsistenz und nahtloser Multielement-Fusion erreicht.
★ 1.348+8Sterne-Änderung der letzten 7 Tage - #5
Ein Open-Source-LLM-basiertes TTS-Fundamentalsystem
★ 920+1Sterne-Änderung der letzten 7 Tage - #6
StoryMaker: Für konsistente Charaktere in der Text-zu-Bild-Generierung
★ 723+1Sterne-Änderung der letzten 7 Tage - #7
Ein industrietaugliches All-in-One-ASR-System auf dem neuesten Stand der Technik mit ASR-, VAD-, LID- und Punc-Modulen. FireRedASR2 unterstützt Chinesisch (Mandarin, über 20 Dialekte/Akzente), Englisch, Code-Switching sowie Sprache- und Gesangs-ASR. FireRedVAD unterstützt Sprache/Gesang/Musik in über 100 Sprachen. FireRedLID unterstützt über 100 Sprachen und über 20 chinesische Dialekte. FireRedPunc unterstützt Chinesisch und Englisch.
★ 665+7Sterne-Änderung der letzten 7 Tage - #8
Eine vollständig selbst gehostete Lösung für Vollduplex-Sprachinteraktion
★ 584+2Sterne-Änderung der letzten 7 Tage - #9
Eine industrielle SOTA-Lösung zur Spracherkennungs- und Audioereigniserkennung, die über 100 Sprachen unterstützt und Silero-VAD, TEN-VAD, FunASR-VAD sowie WebRTC-VAD übertrifft.
★ 517+8Sterne-Änderung der letzten 7 Tage