nlp
Repositori open source terpantau bertanda nlp, diurutkan berdasarkan bintang.
- #121
Pustaka Golang untuk pemrosesan teks, termasuk tokenisasi, penandaan kelas kata (part-of-speech tagging), dan ekstraksi entitas bernama.
★ 3.086+0Perubahan bintang dalam 7 hari terakhir - #122
Pipeline NLP berbasis Rust yang siap pakai dan model berbasis transformer (BERT, DistilBERT, GPT2,...)
★ 3.077+0Perubahan bintang dalam 7 hari terakhir - #123
Model dasar Chinese-LLaMA 1&2 dan Chinese-Falcon; model percakapan ChatFlow; model OpenLLaMA bahasa Mandarin; dataset pra-pelatihan/fine-tuning instruksi NLP
★ 3.043+0Perubahan bintang dalam 7 hari terakhir - #124
Server inferensi sumber terbuka dan kluster produksi untuk semua model yang dibutuhkan agen Anda.
★ 3.030+0Perubahan bintang dalam 7 hari terakhir - #125
Makalah penelitian Deep Learning dan deep reinforcement learning beserta beberapa kodenya
★ 3.026+0Perubahan bintang dalam 7 hari terakhir - #126
Implementasi C++ untuk ChatGLM-6B & ChatGLM2-6B & ChatGLM3 & GLM4(V)
★ 2.962+0Perubahan bintang dalam 7 hari terakhir - #127
🔮 Pendekatan fungsional yang menyegarkan untuk deep learning, kompatibel dengan pustaka favorit Anda
★ 2.890+0Perubahan bintang dalam 7 hari terakhir - #128★ 2.864+0Perubahan bintang dalam 7 hari terakhir
- #129
aeneas adalah pustaka Python/C dan sekumpulan alat untuk menyinkronkan audio dan teks secara otomatis (dikenal sebagai forced alignment)
★ 2.862+0Perubahan bintang dalam 7 hari terakhir - #130
NLP multibahasa dan segmentasi teks Go yang efisien; mendukung bahasa Inggris, Mandarin, Jepang, dan lainnya.
★ 2.842+0Perubahan bintang dalam 7 hari terakhir - #131★ 2.826+0Perubahan bintang dalam 7 hari terakhir
- #132
Pustaka untuk men-debug/menginspeksi pengklasifikasi machine learning dan menjelaskan prediksinya.
★ 2.817+0Perubahan bintang dalam 7 hari terakhir - #133★ 2.788+0Perubahan bintang dalam 7 hari terakhir
- #134★ 2.679+0Perubahan bintang dalam 7 hari terakhir
- #135
Alat penambangan dan pra-pemrosesan teks (pembersihan teks, penemuan kata baru, analisis sentimen, pengenalan dan penautan entitas, ekstraksi kata kunci, ekstraksi pengetahuan, penguraian sintaksis, dll.), menggunakan metode tanpa pengawasan atau pengawasan lemah
★ 2.629+0Perubahan bintang dalam 7 hari terakhir - #136
Kumpulan sumber daya terbuka NLP medis bahasa Mandarin: set istilah/korpus/vektor kata/model pra-latih/grafik pengetahuan/pengenalan entitas bernama/QA/ekstraksi informasi/model/makalah/dll.
★ 2.627+0Perubahan bintang dalam 7 hari terakhir - #137
Tutorial Jupyter Notebook tentang penyelesaian masalah dunia nyata dengan Machine Learning & Deep Learning menggunakan PyTorch. Topik: Deteksi wajah dengan Detectron 2, deteksi anomali deret waktu dengan LSTM Autoencoders, deteksi objek dengan YOLO v5, membangun Neural Network pertama Anda, prakiraan deret waktu untuk kasus harian Coronavirus, analisis sentimen dengan BERT
★ 2.503+0Perubahan bintang dalam 7 hari terakhir - #138★ 2.492+0Perubahan bintang dalam 7 hari terakhir
- #139
news-please - perayap web dan ekstraktor informasi terintegrasi untuk berita yang langsung berfungsi.
★ 2.485+0Perubahan bintang dalam 7 hari terakhir - #140
API gaya OpenAI untuk model bahasa besar terbuka, gunakan LLM layaknya ChatGPT! Mendukung LLaMA, LLaMA-2, BLOOM, Falcon, Baichuan, Qwen, Xverse, SqlCoder, CodeLLaMA, ChatGLM, ChatGLM2, ChatGLM3, dll. Antarmuka backend terpadu untuk model bahasa besar open source.
★ 2.461+0Perubahan bintang dalam 7 hari terakhir - #141
Menangani semua data tidak terstruktur, seperti pencarian gambar terbalik, pencarian audio, pencarian molekuler, analisis video, sistem tanya jawab, NLP, dll.
★ 2.445+0Perubahan bintang dalam 7 hari terakhir - #142
👩🏫 NLP Tingkat Lanjut dengan spaCy: Kursus online gratis
★ 2.428+0Perubahan bintang dalam 7 hari terakhir - #143
Sistem Pengodean Mandiri untuk Aplikasi Anda — Alan AI SDK untuk Web
★ 2.427+0Perubahan bintang dalam 7 hari terakhir - #144
Daftar kurasi sumber daya ChatGPT yang luar biasa, termasuk pustaka, SDK, API, dan lainnya. Pertimbangkan untuk mendukung proyek ini dengan memberikan bintang.
★ 2.397+0Perubahan bintang dalam 7 hari terakhir - #145★ 2.395+0Perubahan bintang dalam 7 hari terakhir
- #146
Kashgari adalah framework transfer learning NLP tingkat produksi yang dibangun di atas tf.keras untuk pelabelan dan klasifikasi teks, mencakup Word2Vec, BERT, dan GPT2 Language Embedding.
★ 2.380+0Perubahan bintang dalam 7 hari terakhir - #147
Large Concept Models: Pemodelan bahasa dalam ruang representasi kalimat.
★ 2.377+0Perubahan bintang dalam 7 hari terakhir - #148
Visualisasi indah tentang bagaimana bahasa berbeda di antara jenis dokumen.
★ 2.341+0Perubahan bintang dalam 7 hari terakhir - #149
Bantu mengorganisasi tumpukan dokumen Anda dari pemindai, surel, dan sumber lainnya dengan sedikit usaha.
★ 2.317+0Perubahan bintang dalam 7 hari terakhir - #150
Sebuah Benchmark Heterogen untuk Information Retrieval. Mudah digunakan, evaluasi model Anda di 15+ dataset IR yang beragam.
★ 2.283+0Perubahan bintang dalam 7 hari terakhir