bert
Các kho mã nguồn mở đang theo dõi được gắn thẻ bert, sắp xếp theo số sao.
- #61
Kho ngữ liệu huấn luyện trước quy mô lớn cho tiếng Trung 100G
★ 1.020+2Thay đổi số sao trong 7 ngày qua - #62
Hướng dẫn toàn diện về thuật toán từ NLP đến LLM, địa chỉ đọc trực tuyến: https://datawhalechina.github.io/base-llm/
★ 1.017+15Thay đổi số sao trong 7 ngày qua - #63★ 1.010+2Thay đổi số sao trong 7 ngày qua
- #64
Xây dựng hệ thống hội thoại tiếng Trung dựa trên phiên bản mới nhất của Rasa
★ 982+0Thay đổi số sao trong 7 ngày qua - #65
TextGen: Triển khai các mô hình tạo văn bản, bao gồm LLaMA, BLOOM, GPT2, BART, T5, SongNet và nhiều mô hình khác.
★ 981-1Thay đổi số sao trong 7 ngày qua - #66
Bản cài đặt chính thức của các bài báo "GECToR – Grammatical Error Correction: Tag, Not Rewrite" (BEA-20) và "Text Simplification by Tagging" (BEA-21)
★ 972+0Thay đổi số sao trong 7 ngày qua - #67
Các mô hình Transformer từ BERT đến GPT-4, môi trường từ Hugging Face đến OpenAI. Các ví dụ về fine-tuning, huấn luyện và prompt engineering. Phần bổ sung với ChatGPT, GPT-3.5-turbo, GPT-4 và DALL-E bao gồm khởi động nhanh GPT-4, chuyển đổi giọng nói thành văn bản, văn bản thành giọng nói, tạo văn bản thành hình ảnh với DALL-E, Google Cloud AI, HuggingGPT và nhiều hơn nữa
★ 966+0Thay đổi số sao trong 7 ngày qua - #68
Thư viện PyTorch chứa các mô hình Transformer được tuyển chọn và các thành phần có thể kết hợp
★ 890+0Thay đổi số sao trong 7 ngày qua - #69
Các mô hình BERT đã được huấn luyện trước bằng tiếng Bồ Đào Nha
★ 880+0Thay đổi số sao trong 7 ngày qua - #70
Kho lưu trữ GitHub chứa các hướng dẫn tinh chỉnh (fine-tune) mô hình transformers cho nhiều tác vụ NLP khác nhau
★ 862+0Thay đổi số sao trong 7 ngày qua - #71
PhoBERT: Các mô hình ngôn ngữ được huấn luyện trước cho tiếng Việt (EMNLP-2020 Findings)
★ 806-1Thay đổi số sao trong 7 ngày qua - #72
Phân loại văn bản đa nhãn, phân loại đa nhãn, phân loại văn bản, multi-label, classifier, text classification, BERT, seq2seq, attention, multi-label-classification
★ 805+0Thay đổi số sao trong 7 ngày qua - #73★ 801+0Thay đổi số sao trong 7 ngày qua
- #74★ 795-1Thay đổi số sao trong 7 ngày qua
- #75
PatrickStar cho phép tạo các mô hình tiền huấn luyện NLP lớn hơn, nhanh hơn, thân thiện hơn với môi trường và phổ cập AI cho mọi người.
★ 772+0Thay đổi số sao trong 7 ngày qua - #76
Triển khai Pytorch của JointBERT: "BERT for Joint Intent Classification and Slot Filling"
★ 747-1Thay đổi số sao trong 7 ngày qua - #77
Kho lưu trữ chính cho nghiên cứu và phát triển Trả lời câu hỏi đa ngôn ngữ tiên tiến nhất.
★ 739-1Thay đổi số sao trong 7 ngày qua - #78LLM-PowerHouse-A-Curated-Guide-for-Large-Language-Models-with-Custom-Training-and-Inferencing↗@ghimiresunil
LLM-PowerHouse: Khai phá tiềm năng của LLM thông qua các hướng dẫn được tuyển chọn, phương pháp thực hành tốt nhất và mã nguồn sẵn sàng sử dụng cho việc huấn luyện và suy luận tùy chỉnh.
★ 731+0Thay đổi số sao trong 7 ngày qua - #79
Triển khai đơn giản mô hình OpenAI CLIP trong PyTorch.
★ 726+0Thay đổi số sao trong 7 ngày qua - #80
Đánh giá lại các mô hình tiền huấn luyện cho xử lý ngôn ngữ tự nhiên tiếng Trung (MacBERT).
★ 721+2Thay đổi số sao trong 7 ngày qua - #81
Awesome-LLM-Eval: danh sách tuyển chọn các công cụ, tập dữ liệu/benchmark, bản demo, bảng xếp hạng, tài liệu và mô hình, chủ yếu dành cho việc đánh giá LLM.
★ 656-2Thay đổi số sao trong 7 ngày qua - #82
Điểm chuẩn xử lý ngôn ngữ tự nhiên quy mô lớn đầu tiên cho tiếng Indonesia. Chúng tôi cung cấp nhiều tác vụ hạ nguồn, các mô hình IndoBERT đã được huấn luyện trước và mã nguồn khởi đầu! (AACL-IJCNLP 2020)
★ 655+1Thay đổi số sao trong 7 ngày qua - #83
BERTweet: Mô hình ngôn ngữ được huấn luyện trước cho các Tweet tiếng Anh (EMNLP-2020)
★ 609+0Thay đổi số sao trong 7 ngày qua - #84
Triển khai mô hình BERT và các tác vụ hạ nguồn liên quan dựa trên framework PyTorch.
★ 604+0Thay đổi số sao trong 7 ngày qua - #85★ 604+0Thay đổi số sao trong 7 ngày qua
- #86
Xác thực grounding cấp độ span cho các đầu ra AI dựa trên RAG, mã nguồn và công cụ.
★ 603+2Thay đổi số sao trong 7 ngày qua - #87★ 592-1Thay đổi số sao trong 7 ngày qua
- #88
Kho lưu trữ Deep Learning NLP sử dụng tensorflow, tổng hợp từ tiền xử lý văn bản đến các tác vụ hạ nguồn của các mô hình hiện đại như Topic Models, BERT, GPT và LLM.
★ 581+0Thay đổi số sao trong 7 ngày qua - #89
Bản dịch tiếng Trung của cuốn Natural Language Processing with Transformers, tài liệu hướng dẫn về Transformers uy tín nhất
★ 580+0Thay đổi số sao trong 7 ngày qua - #90
Các mô hình BERT/DistilBERT, ELECTRA, ConvBERT và T5 cho tiếng Thổ Nhĩ Kỳ
★ 579+0Thay đổi số sao trong 7 ngày qua