nlp
nlp 태그가 달린 추적 중인 오픈소스 리포지토리를 스타 수 순으로 보여줘요.
- #331
최신 Stanza(StanfordNLP) 연구 모델을 spaCy에서 직접 사용
★ 746+0최근 7일 스타 변화 - #332★ 745+0최근 7일 스타 변화
- #333★ 742+3최근 7일 스타 변화
- #334★ 738-1최근 7일 스타 변화
- #335
PubMed Open-Access XML 서브셋 및 MEDLINE XML 데이터셋을 위한 Python 파서
★ 738+0최근 7일 스타 변화 - #336
법률 텍스트 분석(Legal Text Analytics)을 위한 선별된 리소스, 방법 및 도구 목록.
★ 735+1최근 7일 스타 변화 - #337
재학습 없이 일정한 메모리 사용량으로 기존 LLM의 학습 길이를 대폭 확장
★ 734-1최근 7일 스타 변화 - #338★ 734+1최근 7일 스타 변화
- #339★ 729+0최근 7일 스타 변화
- #340★ 726+0최근 7일 스타 변화
- #341
PyTorch로 구현한 간단한 OpenAI CLIP 모델.
★ 726+0최근 7일 스타 변화 - #342★ 721+1최근 7일 스타 변화
- #343★ 720+4최근 7일 스타 변화
- #344★ 711+0최근 7일 스타 변화
- #345
VectorFlow는 원시 데이터를 수집하여 벡터로 변환하고 선택한 벡터 DB에 저장하는 고성능 벡터 임베딩 파이프라인입니다.
★ 703+0최근 7일 스타 변화 - #346★ 702+0최근 7일 스타 변화
- #347
풀스택 머신러닝(ML) 로드맵은 데이터 수집 및 전처리, 모델 개발, 배포, 유지보수를 포함한 머신러닝의 모든 측면에서 능숙해지는 데 필요한 기술과 기술 스택을 학습하는 과정을 다룹니다.
★ 701+0최근 7일 스타 변화 - #348
비구조화된 법률 텍스트의 NLP를 위한 spaCy 파이프라인 및 모델입니다.
★ 696+0최근 7일 스타 변화 - #349★ 691+0최근 7일 스타 변화
- #350
LLM 기반 Dart/Flutter 애플리케이션 빌드.
★ 686+0최근 7일 스타 변화 - #351
검색, 재순위 지정 및 RAG(Retrieval-Augmented Generation)를 위한 포괄적인 Python 툴킷입니다. 40개의 사전 검색 벤치마크 데이터셋, 7개 이상의 검색 기술, 24개 이상의 최신 재순위 지정 모델 및 다양한 RAG 방식을 통합합니다.
★ 682+1최근 7일 스타 변화 - #352
Stanford Open Information Extraction을 간편하게 구현
★ 682+0최근 7일 스타 변화 - #353★ 675+1최근 7일 스타 변화
- #354
Ekphrasis는 Twitter나 Facebook과 같은 소셜 네트워크 텍스트에 최적화된 텍스트 처리 도구입니다. 두 개의 대규모 말뭉치(영어 Wikipedia, Twitter 트윗 3억 3천만 개)의 통계를 사용하여 토큰화, 단어 정규화, 단어 분할(해시태그 분리용) 및 맞춤법 교정을 수행합니다.
★ 673+0최근 7일 스타 변화 - #355
SpaCy를 위한 중국어 지원 모델
★ 673+0최근 7일 스타 변화 - #356★ 665+1최근 7일 스타 변화
- #357
Python을 사용하여 텍스트 내 날짜를 찾고 datetime 객체로 반환
★ 665+0최근 7일 스타 변화 - #358★ 664+1최근 7일 스타 변화
- #359
감성 분석 및 소셜 NLP 작업을 위한 Python 다국어 툴킷
★ 660+0최근 7일 스타 변화 - #360
Obsidian에서 ChatGPT를 사용하여 노트를 빠르게 서식 지정
★ 658-2최근 7일 스타 변화