nlp
Repositori open source terpantau bertanda nlp, diurutkan berdasarkan bintang.
- #331
💥 Gunakan model penelitian Stanza (StanfordNLP) terbaru secara langsung di spaCy
★ 746+0Perubahan bintang dalam 7 hari terakhir - #332★ 744+0Perubahan bintang dalam 7 hari terakhir
- #333
Korpus puisi modern berbahasa Mandarin terlengkap di bumi, 3k+ penyair, 80K+ puisi, 15M+ kata
★ 740+2Perubahan bintang dalam 7 hari terakhir - #334
Repositori utama untuk riset dan pengembangan Multilingual Question Answering yang canggih.
★ 739-1Perubahan bintang dalam 7 hari terakhir - #335
:clipboard: Parser Python untuk Subset XML Open-Access PubMed dan Dataset XML MEDLINE
★ 738+2Perubahan bintang dalam 7 hari terakhir - #336
Daftar sumber daya, metode, dan alat pilihan yang didedikasikan untuk Analisis Teks Hukum.
★ 735+0Perubahan bintang dalam 7 hari terakhir - #337
Memperluas LLM yang ada jauh melampaui panjang pelatihan asli dengan penggunaan memori konstan, tanpa pelatihan ulang
★ 734-1Perubahan bintang dalam 7 hari terakhir - #338
Keluarga PromptKG: Galeri pembelajaran prompt & karya riset terkait KG, toolkit, dan daftar makalah.
★ 734+0Perubahan bintang dalam 7 hari terakhir - #339★ 729+0Perubahan bintang dalam 7 hari terakhir
- #340★ 726+0Perubahan bintang dalam 7 hari terakhir
- #341
Implementasi sederhana dari model OpenAI CLIP di PyTorch.
★ 726+0Perubahan bintang dalam 7 hari terakhir - #342
Meninjau Kembali Model Pra-latih untuk Pemrosesan Bahasa Alami Bahasa Mandarin (MacBERT)
★ 721+2Perubahan bintang dalam 7 hari terakhir - #343
Sistem Metode Input Bahasa Jepang untuk Linux, macOS, Mesin Konversi Kana-Kanji Neural
★ 719+6Perubahan bintang dalam 7 hari terakhir - #344
Mesin pencari berbasis LLM/ChatGPT/OpenAI API dengan referensi sumber. Mendukung pencarian web, pencarian konten file, dan lainnya.
★ 711+0Perubahan bintang dalam 7 hari terakhir - #345
VectorFlow adalah pipeline embedding vektor bervolume tinggi yang menyerap data mentah, mengubahnya menjadi vektor, dan menulisnya ke database vektor pilihan Anda.
★ 703+0Perubahan bintang dalam 7 hari terakhir - #346
Chatbot berbasis pemahaman bahasa alami dan pembelajaran mesin, mendukung konkurensi multi-pengguna dan dialog multi-putaran yang dapat disesuaikan.
★ 702-1Perubahan bintang dalam 7 hari terakhir - #347
Peta Jalan ML (Machine Learning) Full Stack mencakup pembelajaran keterampilan dan teknologi yang diperlukan untuk menguasai semua aspek machine learning, termasuk pengumpulan dan prapemrosesan data, pengembangan model, penerapan, dan pemeliharaan.
★ 701+0Perubahan bintang dalam 7 hari terakhir - #348
:black_circle: Pipeline dan model spaCy untuk NLP pada teks hukum yang tidak terstruktur.
★ 696+0Perubahan bintang dalam 7 hari terakhir - #349★ 691+0Perubahan bintang dalam 7 hari terakhir
- #350
Membangun aplikasi Dart/Flutter bertenaga LLM.
★ 686+0Perubahan bintang dalam 7 hari terakhir - #351
Stanford Open Information Extraction dibuat menjadi sederhana!
★ 682+0Perubahan bintang dalam 7 hari terakhir - #352
🔥 Rankify: Toolkit Python Komprehensif untuk Retrieval, Re-Ranking, dan Retrieval-Augmented Generation (RAG) 🔥. Toolkit kami mengintegrasikan 40 dataset benchmark pra-retrieval dan mendoroang 7+ teknik retrieval, 24+ model Reranking mutakhir, serta berbagai metode RAG.
★ 682-1Perubahan bintang dalam 7 hari terakhir - #353★ 674+0Perubahan bintang dalam 7 hari terakhir
- #354
Model SpaCy untuk bahasa Mandarin | Models for SpaCy that support Chinese
★ 673+0Perubahan bintang dalam 7 hari terakhir - #355
Ekphrasis adalah alat pemrosesan teks yang ditujukan untuk teks dari jejaring sosial seperti Twitter atau Facebook. Ekphrasis melakukan tokenisasi, normalisasi kata, segmentasi kata (untuk memisahkan hashtag), dan koreksi ejaan menggunakan statistik kata dari 2 korpus besar (Wikipedia bahasa Inggris dan 330 juta tweet bahasa Inggris).
★ 673+0Perubahan bintang dalam 7 hari terakhir - #356
Mencari tanggal di dalam teks menggunakan Python dan mengembalikan objek datetime
★ 665+2Perubahan bintang dalam 7 hari terakhir - #357
Pustaka Python yang cepat, ringan, dan mudah digunakan untuk membagi teks menjadi bagian-bagian yang bermakna secara semantik.
★ 664+0Perubahan bintang dalam 7 hari terakhir - #358★ 663+0Perubahan bintang dalam 7 hari terakhir
- #359
Toolkit multibahasa Python untuk Analisis Sentimen dan tugas NLP Sosial
★ 660+0Perubahan bintang dalam 7 hari terakhir - #360
Format catatan Anda dengan cepat menggunakan ChatGPT di Obsidian
★ 658-2Perubahan bintang dalam 7 hari terakhir