attention-mechanism
attention-mechanism 태그가 달린 추적 중인 오픈소스 리포지토리를 스타 수 순으로 보여줘요.
관련 토픽
같은 리포지토리에 attention-mechanism 태그와 자주 함께 쓰이는 토픽이에요.
최근 라이징
최근 90일 안에 만들어지고 attention-mechanism 태그가 달린 리포지토리예요.
- #1
Video Delta Net hybrid attention for MiniMax-H3 as a native ComfyUI node.
★ 197
- #1
PyTorch를 사용하여 처음부터 단계별로 ChatGPT와 유사한 LLM 구현하기
★ 104,229+219최근 7일 스타 변화 - #2
단일 transformer 인코더만으로 비전 분류에서 SOTA를 달성하는 간단한 방법인 Vision Transformer의 PyTorch 구현
★ 25,498+6최근 7일 스타 변화 - #3★ 19,149+18최근 7일 스타 변화
- #4
RWKV(RwaKuv로 발음)는 GPT 트랜스포머처럼 직접 학습(병렬화 가능)할 수 있으면서도 뛰어난 LLM 성능을 발휘하는 RNN입니다. 현재 RWKV-7 'Goose' 단계에 있습니다. 뛰어난 성능, 선형 시간, 상수 공간(kv-cache 없음), 빠른 학습, 무한한 ctx_len, 무료 문장 임베딩 등 RNN과 트랜스포머의 장점을 결합했습니다.
★ 14,695+8최근 7일 스타 변화 - #5
다양한 논문의 유망한 실험적 기능 모음이 포함된 간결하지만 완벽한 전면 어텐션 트랜스포머
★ 5,943-1최근 7일 스타 변화 - #6
PyTorch로 구현/재현한 OpenAI의 텍스트-이미지 변환기 DALL-E
★ 5,626-2최근 7일 스타 변화 - #7
논문, 코드 및 관련 웹사이트를 포함하는 Vision Transformer/Attention에 대한 궁극적으로 포괄적인 논문 목록
★ 5,046-3최근 7일 스타 변화 - #8★ 4,473+6최근 7일 스타 변화
- #9
처음부터 현대적인 LLM 구축하기. 모든 줄에 주석 포함. 아주 쉽게 설명됨.
★ 3,271+60최근 7일 스타 변화 - #10
단어 수준 타임스탬프와 신뢰도를 제공하는 다국어 자동 음성 인식
★ 2,842+1최근 7일 스타 변화 - #11
Keras 어텐션 레이어 (Luong 및 Bahdanau 스코어).
★ 2,809+0최근 7일 스타 변화 - #12
PyTorch로 구현한 Google Deepmind의 SoundStorm(효율적인 병렬 오디오 생성) 구현체
★ 1,547+0최근 7일 스타 변화 - #13
단계별로 배우는 LLM 내부 구조 - 토큰화부터 어텐션, 추론 최적화까지.
★ 1,540+3최근 7일 스타 변화 - #14
반복적 어텐션을 통한 일반 인식 모델인 Perceiver의 Pytorch 구현체입니다.
★ 1,218+1최근 7일 스타 변화 - #15★ 1,216+1최근 7일 스타 변화
- #16★ 1,168+1최근 7일 스타 변화
- #17
Transformer 네트워크, 어텐션 메커니즘, GPT, BERT, ChatGPT, LLM, 전이 학습에 중점을 둔 NLP 리소스 모음
★ 1,152+2최근 7일 스타 변화 - #18★ 1,143+5최근 7일 스타 변화
- #19
Pytorch로 구현한 정형 데이터용 어텐션 네트워크 TabTransformer
★ 1,093+2최근 7일 스타 변화 - #20
시퀀스 길이에 대해 선형 복잡도를 갖는 어텐션 변형 기반 Transformer
★ 843+0최근 7일 스타 변화 - #21★ 725+1최근 7일 스타 변화
- #22
yolo-high-level 프로젝트(detect, pose, classify, segment) 기반. yolov5, yolov7, yolov8 코어, 개선 연구, SwinTransformerV2 및 Attention 시리즈, 학습 기술, 비즈니스 커스터마이징, 엔지니어링 배포 C++ 포함
★ 665+0최근 7일 스타 변화 - #23★ 649+0최근 7일 스타 변화
- #24
llama3 추론 과정을 단계별로 학습하고 핵심 개념 파악, 프로세스 유도 및 코드 구현
★ 629+0최근 7일 스타 변화 - #25
[IGARSS'22]: 변화 탐지를 위한 Transformer 기반 샴 네트워크
★ 622+1최근 7일 스타 변화 - #26
FlashAttention (Metal 포트)
★ 612-1최근 7일 스타 변화 - #27
[CVPR 2021, Oral] PREDATOR: 겹침이 적은 3D 포인트 클라우드 정렬.
★ 603-1최근 7일 스타 변화 - #28★ 601+1최근 7일 스타 변화
- #29
[ICLR2025 Spotlight🔥] TokenFormer 공식 구현: 토큰화된 모델 파라미터로 Transformer 스케일링 재고
★ 594+0최근 7일 스타 변화 - #30★ 583-1최근 7일 스타 변화