FireRedTeam
FireRedTeam의 추적 중인 오픈소스 리포지토리를 스타 수 순으로 보여줘요.
- #1
FireRed-OpenStoryline은 자연어 상호작용, LLM 기반 플래닝, 정밀한 툴 오케스트레이션을 통해 수동 편집을 의도 기반 디렉팅으로 전환하는 AI 비디오 편집 에이전트입니다. 일관되고 전문적인 스토리텔링을 위해 재사용 가능한 Style Skills을 갖춘 투명한 인간 참여형(human-in-the-loop) 창작을 지원합니다.
★ 3,352+96최근 7일 스타 변화 - #2
만다린, 중국 방언 및 영어를 지원하는 오픈 소스 산업용 ASR 모델로, 공인된 만다린 ASR 벤치마크에서 새로운 SOTA를 달성하는 동시에 뛰어난 가사 인식 기능도 제공합니다.
★ 1,975+9최근 7일 스타 변화 - #3
다화자 대화 생성을 위한 롱폼 스트리밍 TTS 시스템
★ 1,430+4최근 7일 스타 변화 - #4
FireRed-Image-Edit는 정밀한 지시 따르기, 고화질 생성, 우수한 정체성 일관성 및 매끄러운 다중 요소 융합을 통해 오픈 소스 최고 수준(SOTA)의 성능을 달성하는 강력한 이미지 편집 기반 모델입니다.
★ 1,348+8최근 7일 스타 변화 - #5
오픈 소스 LLM 기반 Foundation TTS 시스템
★ 920+1최근 7일 스타 변화 - #6
StoryMaker: 텍스트-이미지 생성에서 일관된 캐릭터 구현을 위한 연구
★ 723+1최근 7일 스타 변화 - #7
ASR, VAD, LID, Punc 모듈을 포함한 산업용 올인원 ASR 시스템. FireRedASR2는 중국어(표준어 및 20개 이상의 방언/억양), 영어, 코드 스위칭, 음성 및 노래 ASR을 지원하며, FireRedVAD는 100개 이상의 언어, FireRedLID는 100개 이상의 언어와 20개 이상의 중국어 방언, FireRedPunc는 중국어와 영어를 지원함
★ 665+7최근 7일 스타 변화 - #8
전이중 음성 상호작용을 위한 완전 자체 호스팅 솔루션입니다.
★ 584+2최근 7일 스타 변화 - #9
100개 이상의 언어를 지원하며 Silero-VAD, TEN-VAD, FunASR-VAD 및 WebRTC-VAD보다 뛰어난 성능을 제공하는 산업용 음성 및 오디오 이벤트 감지 도구
★ 517+8최근 7일 스타 변화