Lompat ke konten utama
buildradar
Masuk
Topik · nlp

nlp

Repositori open source terpantau bertanda nlp, diurutkan berdasarkan bintang.

440 repositori
  • Introduction-NLP@NLP-LOVE

    Catatan detail untuk buku baru karya penulis HanLP, "Natural Language Processing Introduction"! Karya luar biasa yang menjelaskan model algoritma dengan bahasa yang mudah dipahami, bukan rumus yang membosankan. Dimulai dari konsep dasar, buku ini bertahap memperkenalkan prinsip algoritma dan implementasi teknik untuk topik populer seperti segmentasi kata bahasa Mandarin, penandaan POS, NER, ekstraksi informasi, klastering teks, klasifikasi teks, dan analisis sintaksis.

    2.270+0Perubahan bintang dalam 7 hari terakhir
  • Pengenalan Entitas Bernama (NER) Bahasa Mandarin dengan IDCNN/biLSTM+CRF, dan Ekstraksi Relasi dengan biGRU+2ATT

    2.264+0Perubahan bintang dalam 7 hari terakhir
  • TigerBot@TigerResearch

    TigerBot: LLM multi-bahasa dan multi-tugas.

    2.259+0Perubahan bintang dalam 7 hari terakhir
  • mt-dnn@namisan

    Neural Network Mendalam Multi-Tugas untuk Pemahaman Bahasa Alami

    2.257+0Perubahan bintang dalam 7 hari terakhir
  • [Daftar Makalah] Makalah yang mengintegrasikan knowledge graph (KG) dan large language model (LLM).

    2.228+0Perubahan bintang dalam 7 hari terakhir
  • pytextrank@DerwenAI

    Implementasi Python untuk algoritma TextRank ("textgraphs") guna ekstraksi frasa

    2.219+0Perubahan bintang dalam 7 hari terakhir
  • xlstm@NX-AI

    Repositori resmi xLSTM.

    2.196+0Perubahan bintang dalam 7 hari terakhir
  • model2vec@MinishLab

    Static Embeddings mutakhir yang cepat.

    2.189+0Perubahan bintang dalam 7 hari terakhir
  • EasyNLP@alibaba

    EasyNLP: Toolkit NLP yang komprehensif dan mudah digunakan.

    2.186+0Perubahan bintang dalam 7 hari terakhir
  • ecco@jalammar

    Menjelaskan, menganalisis, dan memvisualisasikan model bahasa NLP. Ecco membuat visualisasi interaktif langsung di notebook Jupyter yang menjelaskan perilaku model bahasa berbasis Transformer (seperti GPT2, BERT, RoBERTA, T5, dan T0).

    2.103+0Perubahan bintang dalam 7 hari terakhir
  • docext@NanoNets

    Toolkit on-premises untuk ekstraksi data tidak terstruktur tanpa OCR, konversi markdown, dan benchmarking. (https://idp-leaderboard.org/)

    2.086+0Perubahan bintang dalam 7 hari terakhir
  • Awesome-LM-SSP@CryptoAILab

    Daftar bacaan untuk keamanan, keselamatan, dan privasi model besar (termasuk Awesome LLM Security, Safety, dll.).

    2.070+0Perubahan bintang dalam 7 hari terakhir
  • AliceMind@alibaba

    Koleksi Encoder-decoder ALIbaba dari Lab MinD (Machine IntelligeNce dari Damo)

    2.041+0Perubahan bintang dalam 7 hari terakhir
  • The-NLP-Pandect@ivan-bilan

    Referensi komprehensif untuk semua topik yang berkaitan dengan Natural Language Processing

    2.038+0Perubahan bintang dalam 7 hari terakhir
  • alpaca_eval@tatsu-lab

    Evaluator otomatis untuk model bahasa yang mengikuti instruksi. Tervalidasi oleh manusia, berkualitas tinggi, murah, dan cepat.

    2.012+0Perubahan bintang dalam 7 hari terakhir
  • contextgem@shcherbak-ai

    ContextGem: Ekstraksi LLM yang mudah dari dokumen

    1.996+0Perubahan bintang dalam 7 hari terakhir
  • RAGHub@Andrew-Jang

    Kumpulan kerangka kerja, proyek, and sumber daya RAG (Retrieval-Augmented Generation) yang digerakkan oleh komunitas. Berkontribusi dan jelajahi ekosistem RAG yang terus berkembang.

    1.991+0Perubahan bintang dalam 7 hari terakhir
  • scispacy@allenai

    Pipeline spaCy lengkap dan model untuk dokumen ilmiah/biomedis.

    1.987+0Perubahan bintang dalam 7 hari terakhir
  • Proyek Model Llama Tiongkok Fase Ketiga (Chinese Llama-3 LLMs) yang dikembangkan dari Meta Llama 3

    1.980+0Perubahan bintang dalam 7 hari terakhir
  • typed-japanese@typedgrammar

    🌸 Belajar tata bahasa Jepang dengan TypeScript

    1.945+0Perubahan bintang dalam 7 hari terakhir
  • spacy-models@explosion

    💫 Model untuk pustaka Pemrosesan Bahasa Alami (NLP) spaCy

    1.901+0Perubahan bintang dalam 7 hari terakhir
  • Tutorial pengenalan cepat untuk pustaka Transformers

    1.892+0Perubahan bintang dalam 7 hari terakhir
  • Daftar kurasi materi pembelajaran, basis data, alat, dan sumber daya lain yang terkait dengan Knowledge Graph

    1.885+0Perubahan bintang dalam 7 hari terakhir
  • LLMCompiler@SqueezeAILab

    [ICML 2024] LLMCompiler: Kompiler LLM untuk pemanggilan fungsi paralel.

    1.879+0Perubahan bintang dalam 7 hari terakhir
  • nlpcda@425776024

    Paket augmentasi data bahasa Mandarin sekali klik; augmentasi data NLP, augmentasi data bert, EDA: pip install nlpcda

    1.879+0Perubahan bintang dalam 7 hari terakhir
  • spago@nlpodyssey

    Pustaka Machine Learning dan Natural Language Processing mandiri dalam Go

    1.850+0Perubahan bintang dalam 7 hari terakhir
  • nltk_data@nltk

    Data NLTK

    1.828+0Perubahan bintang dalam 7 hari terakhir
  • Klasifikasi Teks Bahasa Mandarin (Panjang dan Pendek), Klasifikasi Multi-label, Kemiripan Dua Kalimat, lapisan embedding kata/karakter/kalimat dan kelas dasar pembangun layer graph, FastText, TextCNN, CharCNN, TextRNN, RCNN, DCNN, DPCNN, VDCNN, CRNN, Bert, Xlnet, Albert, Attention, DeepMoji, HAN, CapsuleNet, Transformer-encode, Seq2seq, SWEM, LEAM, TextGCN

    1.808+0Perubahan bintang dalam 7 hari terakhir
  • underthesea@undertheseanlp

    Underthesea - Asisten AI

    1.803+0Perubahan bintang dalam 7 hari terakhir
  • Microsoft.Recognizers.Text menyediakan pengenalan dan resolusi angka, unit, tanggal/waktu, dll. dalam berbagai bahasa (ZH, EN, FR, ES, PT, DE, IT, TR, HI, NL. Dukungan parsial untuk JA, KO, AR, SV). Paket tersedia di: https://www.nuget.org/profiles/Recognizers.Text, https://www.npmjs.com/~recognizers.text

    1.794+0Perubahan bintang dalam 7 hari terakhir
← Kembali ke topik