text-classification
Các kho mã nguồn mở đang theo dõi được gắn thẻ text-classification, sắp xếp theo số sao.
Chủ đề liên quan
Những chủ đề thường xuất hiện cùng text-classification trên cùng một kho mã.
Mới nổi gần đây
Các kho mã tạo trong 90 ngày qua và được gắn thẻ text-classification.
Không có kho mã mới nào gắn thẻ chủ đề này trong 90 ngày qua.
- #1
Phân tách từ tiếng Trung, gán nhãn từ loại, nhận diện thực thể có tên, phân tích cú pháp phụ thuộc, phân tích cú pháp thành phần, phân tích cú pháp ngữ nghĩa phụ thuộc, gán nhãn vai trò ngữ nghĩa, giải quyết tham chiếu, chuyển đổi phong cách, độ tương đồng ngữ nghĩa, phát hiện từ mới, trích xuất cụm từ khóa, tóm tắt tự động, phân loại và gom cụm văn bản, chuyển đổi bính âm giản thể/phồn thể, xử lý ngôn ngữ tự nhiên
★ 36.481+2Thay đổi số sao trong 7 ngày qua - #2★ 33.861+23Thay đổi số sao trong 7 ngày qua
- #3
Corpus tiếng Trung quy mô lớn dành cho NLP (Large Scale Chinese Corpus for NLP)
★ 9.910+1Thay đổi số sao trong 7 ngày qua - #4
Phân loại văn bản tiếng Trung CNN-RNN, dựa trên TensorFlow
★ 4.301+0Thay đổi số sao trong 7 ngày qua - #5
Transformers dành cho Truy xuất thông tin, Phân loại văn bản, NER, QA, Mô hình hóa ngôn ngữ, Tạo ngôn ngữ, T5, Đa phương thức và AI hội thoại
★ 4.254+0Thay đổi số sao trong 7 ngày qua - #6★ 4.159+2Thay đổi số sao trong 7 ngày qua
- #7★ 3.409+9Thay đổi số sao trong 7 ngày qua
- #8★ 3.382+1Thay đổi số sao trong 7 ngày qua
- #9
Các hướng dẫn lập trình Python
★ 3.001+2Thay đổi số sao trong 7 ngày qua - #10
Kashgari là một framework học chuyển giao NLP cấp độ sản xuất được xây dựng trên nền tảng tf.keras dùng để gán nhãn văn bản và phân loại văn bản, bao gồm Word2Vec, BERT và GPT2 Language Embedding.
★ 2.381+0Thay đổi số sao trong 7 ngày qua - #11★ 2.184+0Thay đổi số sao trong 7 ngày qua
- #12
[ACL 2023] Một bộ tạo nhúng cho mọi tác vụ: Nhúng văn bản được tinh chỉnh theo hướng dẫn
★ 2.023+0Thay đổi số sao trong 7 ngày qua - #13
Các thuật toán phân loại văn bản: Một khảo sát
★ 1.819-2Thay đổi số sao trong 7 ngày qua - #14
Phân loại văn bản tiếng Trung dài, phân loại câu ngắn, phân loại đa nhãn, độ tương tự giữa hai câu (Phân loại văn bản tiếng Trung của Keras NLP, phân loại đa nhãn hoặc phân loại câu, dài hoặc ngắn), các lớp cơ sở xây dựng lớp nhúng từ và câu (embeddings) và lớp mạng (graph), FastText, TextCNN, CharCNN, TextRNN, RCNN, DCNN, DPCNN, VDCNN, CRNN, Bert, Xlnet, Albert, Attention, DeepMoji, HAN, Mạng capsule-CapsuleNet, Transformer-encode, Seq2seq, SWEM, LEAM, TextGCN
★ 1.808-1Thay đổi số sao trong 7 ngày qua - #15
Một framework không cần lập trình được xây dựng trên PyTorch dành cho các nghiên cứu học sâu có thể tái tạo. Hệ sinh thái PyTorch. 🏆 Cho đến nay đã triển khai 26 phương pháp chưng cất kiến thức được trình bày tại TPAMI, CVPR, ICLR, ECCV, NeurIPS, ICCV, AAAI, v.v. 🎁 Các mô hình đã huấn luyện, nhật ký huấn luyện và cấu hình có sẵn để đảm bảo tính tái tạo và chuẩn mực.
★ 1.630+1Thay đổi số sao trong 7 ngày qua - #16★ 1.554+0Thay đổi số sao trong 7 ngày qua
- #17
Lựa chọn mã nguồn mở của nhà khoa học dữ liệu để mở rộng, đánh giá và duy trì dữ liệu ngôn ngữ tự nhiên. Coi dữ liệu huấn luyện như một thành phần phần mềm.
★ 1.469+0Thay đổi số sao trong 7 ngày qua - #18
Obsei là một công cụ tự động hóa sử dụng AI mã nguồn thấp. Nó có thể được sử dụng trong nhiều quy trình kinh doanh như lắng nghe mạng xã hội, cảnh báo dựa trên AI, phân tích hình ảnh thương hiệu, nghiên cứu so sánh và nhiều hơn nữa.
★ 1.427+2Thay đổi số sao trong 7 ngày qua - #19★ 1.394+2Thay đổi số sao trong 7 ngày qua
- #20
Một bản cài đặt pytorch thanh lịch của transformers
★ 1.327+0Thay đổi số sao trong 7 ngày qua - #21
Thư viện phát hiện ngôn ngữ tự nhiên cho Rust. Thử bản demo trực tuyến tại: https://whatlang.org/
★ 1.087+0Thay đổi số sao trong 7 ngày qua - #22
Công cụ học biểu diễn véc-tơ của từ và thực thể từ Wikipedia
★ 971+0Thay đổi số sao trong 7 ngày qua - #23
1 dòng mã cho hàng nghìn mô hình NLP tiên tiến nhất bằng hàng trăm ngôn ngữ. Cách nhanh nhất và chính xác nhất để giải quyết các vấn đề về văn bản.
★ 967+0Thay đổi số sao trong 7 ngày qua - #24
Kho lưu trữ này giới thiệu PIXIU, một tài nguyên mã nguồn mở bao gồm các large language models (LLMs) tài chính đầu tiên, dữ liệu tinh chỉnh hướng dẫn và các benchmark đánh giá để đánh giá toàn diện các LLMs tài chính. Mục tiêu của chúng tôi là liên tục thúc đẩy sự phát triển mã nguồn mở của trí tuệ nhân tạo (AI) tài chính.
★ 884+1Thay đổi số sao trong 7 ngày qua - #25
Các khối xây dựng và công cụ trực quan hóa spaCy cho ứng dụng Streamlit
★ 860+0Thay đổi số sao trong 7 ngày qua - #26
Phân loại văn bản đa nhãn, phân loại đa nhãn, phân loại văn bản, multi-label, classifier, text classification, BERT, seq2seq, attention, multi-label-classification
★ 805+0Thay đổi số sao trong 7 ngày qua - #27★ 721+0Thay đổi số sao trong 7 ngày qua
- #28
Học máy chủ động (Active Learning) cho phân loại văn bản bằng Python.
★ 646-1Thay đổi số sao trong 7 ngày qua - #29
BERTweet: Mô hình ngôn ngữ được huấn luyện trước cho các Tweet tiếng Anh (EMNLP-2020)
★ 609+0Thay đổi số sao trong 7 ngày qua - #30
Một Benchmark phân loại văn bản trong PyTorch
★ 608+0Thay đổi số sao trong 7 ngày qua