본문으로 건너뛰기
buildradar
로그인
토픽 · nlp

nlp

nlp 태그가 달린 추적 중인 오픈소스 리포지토리를 스타 수 순으로 보여줘요.

리포지토리 440개
  • spacy-stanza@explosion

    최신 Stanza(StanfordNLP) 연구 모델을 spaCy에서 직접 사용

    746+0최근 7일 스타 변화
  • Octopii@redhuntlabs

    AI 기반 개인정보(PII) 스캐너

    745+0최근 7일 스타 변화
  • poetry@sheepzh

    지구상에서 가장 방대한 현대 중문 시 데이터셋, 3천 명 이상의 시인, 8만 편 이상의 시, 1,500만 자 이상 수록

    742+3최근 7일 스타 변화
  • primeqa@primeqa

    최첨단 다국어 질의응답(QA) 연구 및 개발을 위한 주요 저장소입니다.

    738-1최근 7일 스타 변화
  • pubmed_parser@titipata

    PubMed Open-Access XML 서브셋 및 MEDLINE XML 데이터셋을 위한 Python 파서

    738+0최근 7일 스타 변화
  • Legal-Text-Analytics@Liquid-Legal-Institute

    법률 텍스트 분석(Legal Text Analytics)을 위한 선별된 리소스, 방법 및 도구 목록.

    735+1최근 7일 스타 변화
  • attention_sinks@tomaarsen

    재학습 없이 일정한 메모리 사용량으로 기존 LLM의 학습 길이를 대폭 확장

    734-1최근 7일 스타 변화
  • PromptKG@zjunlp

    PromptKG Family: 프롬프트 학습 및 KG 관련 연구, 툴킷, 논문 목록 모음

    734+1최근 7일 스타 변화
  • 729+0최근 7일 스타 변화
  • xgen@salesforce

    8k 시퀀스 길이를 지원하는 Salesforce 오픈소스 LLM

    726+0최근 7일 스타 변화
  • OpenAI-CLIP@moein-shariatnia

    PyTorch로 구현한 간단한 OpenAI CLIP 모델.

    726+0최근 7일 스타 변화
  • 중국어 자연어 처리를 위한 사전 학습 모델 재검토 (MacBERT)

    721+1최근 7일 스타 변화
  • karukan@togatoga

    Linux 및 macOS용 일본어 입력 시스템, 뉴럴 가나-한자 변환 엔진

    720+4최근 7일 스타 변화
  • searchGPT@michaelthwan

    LLM/ChatGPT/OpenAI API 기반의 근거 기반 검색 엔진(출처 참조 포함). 웹 검색 및 파일 콘텐츠 검색 등을 지원합니다.

    711+0최근 7일 스타 변화
  • vectorflow@dgarnitz

    VectorFlow는 원시 데이터를 수집하여 벡터로 변환하고 선택한 벡터 DB에 저장하는 고성능 벡터 임베딩 파이프라인입니다.

    703+0최근 7일 스타 변화
  • chat@Decalogue

    자연어 이해 및 머신러닝 기반의 챗봇으로, 다중 사용자 동시 접속 및 사용자 정의 다중 대화(multi-turn)를 지원합니다.

    702+0최근 7일 스타 변화
  • 풀스택 머신러닝(ML) 로드맵은 데이터 수집 및 전처리, 모델 개발, 배포, 유지보수를 포함한 머신러닝의 모든 측면에서 능숙해지는 데 필요한 기술과 기술 스택을 학습하는 과정을 다룹니다.

    701+0최근 7일 스타 변화
  • Blackstone@ICLRandD

    비구조화된 법률 텍스트의 NLP를 위한 spaCy 파이프라인 및 모델입니다.

    696+0최근 7일 스타 변화
  • WeCron@polyrabbit

    위챗(WeChat) 정기 알림 서비스 - Cron on WeChat

    691+0최근 7일 스타 변화
  • langchain_dart@davidmigloz

    LLM 기반 Dart/Flutter 애플리케이션 빌드.

    686+0최근 7일 스타 변화
  • Rankify@DataScienceUIBK

    검색, 재순위 지정 및 RAG(Retrieval-Augmented Generation)를 위한 포괄적인 Python 툴킷입니다. 40개의 사전 검색 벤치마크 데이터셋, 7개 이상의 검색 기술, 24개 이상의 최신 재순위 지정 모델 및 다양한 RAG 방식을 통합합니다.

    682+1최근 7일 스타 변화
  • stanford-openie-python@philipperemy

    Stanford Open Information Extraction을 간편하게 구현

    682+0최근 7일 스타 변화
  • medspacy@medspacy

    spaCy 기반 임상 NLP 라이브러리.

    675+1최근 7일 스타 변화
  • ekphrasis@cbaziotis

    Ekphrasis는 Twitter나 Facebook과 같은 소셜 네트워크 텍스트에 최적화된 텍스트 처리 도구입니다. 두 개의 대규모 말뭉치(영어 Wikipedia, Twitter 트윗 3억 3천만 개)의 통계를 사용하여 토큰화, 단어 정규화, 단어 분할(해시태그 분리용) 및 맞춤법 교정을 수행합니다.

    673+0최근 7일 스타 변화
  • Chinese_models_for_SpaCy@howl-anderson

    SpaCy를 위한 중국어 지원 모델

    673+0최근 7일 스타 변화
  • semchunk@isaacus-dev

    의미론적으로 의미 있는 청크로 텍스트를 분할하기 위한 빠르고 가볍고 사용하기 쉬운 Python 라이브러리

    665+1최근 7일 스타 변화
  • datefinder@akoumjian

    Python을 사용하여 텍스트 내 날짜를 찾고 datetime 객체로 반환

    665+0최근 7일 스타 변화
  • JamSpell@bakwc

    정확하고 빠르며 다국어를 지원하는 현대적인 맞춤법 검사 라이브러리

    664+1최근 7일 스타 변화
  • pysentimiento@pysentimiento

    감성 분석 및 소셜 NLP 작업을 위한 Python 다국어 툴킷

    660+0최근 7일 스타 변화
  • obsidian-ava@different-ai

    Obsidian에서 ChatGPT를 사용하여 노트를 빠르게 서식 지정

    658-2최근 7일 스타 변화
← 토픽 목록으로