natural-language-processing
Các kho mã nguồn mở đang theo dõi được gắn thẻ natural-language-processing, sắp xếp theo số sao.
- #151
Obsei là một công cụ tự động hóa sử dụng AI mã nguồn thấp. Nó có thể được sử dụng trong nhiều quy trình kinh doanh như lắng nghe mạng xã hội, cảnh báo dựa trên AI, phân tích hình ảnh thương hiệu, nghiên cứu so sánh và nhiều hơn nữa.
★ 1.425+0Thay đổi số sao trong 7 ngày qua - #152★ 1.421+0Thay đổi số sao trong 7 ngày qua
- #153
🛸 Sử dụng các mô hình transformers được huấn luyện trước như BERT, XLNet và GPT-2 trong spaCy
★ 1.410+0Thay đổi số sao trong 7 ngày qua - #154★ 1.394+0Thay đổi số sao trong 7 ngày qua
- #155★ 1.391+0Thay đổi số sao trong 7 ngày qua
- #156
Mã nguồn đánh giá cho các số liệu tự động không giám sát khác nhau trong Natural Language Generation.
★ 1.391+0Thay đổi số sao trong 7 ngày qua - #157
Thành phần phân tách từ tiếng Trung "Jieba": được xây dựng để trở thành module phân tách từ tiếng Trung tốt nhất cho PHP.
★ 1.378+0Thay đổi số sao trong 7 ngày qua - #158
Thư viện phát hiện ngôn ngữ tự nhiên chính xác nhất cho Go, phù hợp cho văn bản ngắn và văn bản đa ngôn ngữ
★ 1.362+0Thay đổi số sao trong 7 ngày qua - #159
Bộ công cụ phân đoạn văn bản thành các câu hoặc đơn vịữ nghĩa khác một cách mạnh mẽ, hiệu quả và dễ thích ứng.
★ 1.335+0Thay đổi số sao trong 7 ngày qua - #160
Danh mục trực quan được tuyển chọn của hơn 155 kiến trúc mô hình ngôn ngữ thị giác (VLM/MLLM): tài liệu nghiên cứu, sơ đồ, công thức huấn luyện, tập dữ liệu và mốc thời gian phát hành cho các tác nhân AI đa phương thức.
★ 1.310+0Thay đổi số sao trong 7 ngày qua - #161
Danh sách các tác nhân ngôn ngữ dựa trên bài báo "Cognitive Architectures for Language Agents"
★ 1.256+0Thay đổi số sao trong 7 ngày qua - #162★ 1.252+0Thay đổi số sao trong 7 ngày qua
- #163
Các bài báo phải đọc về Chỉnh sửa Tri thức cho Mô hình Ngôn ngữ Lớn
★ 1.246+0Thay đổi số sao trong 7 ngày qua - #164
Embedding subword được huấn luyện trước bằng 275 ngôn ngữ, dựa trên Byte-Pair Encoding (BPE)
★ 1.224+0Thay đổi số sao trong 7 ngày qua - #165★ 1.201+0Thay đổi số sao trong 7 ngày qua
- #166
Một framework Python để đánh giá gán nhãn chuỗi (nhận diện thực thể có tên, gán nhãn từ loại, v.v.)
★ 1.184+0Thay đổi số sao trong 7 ngày qua - #167
Chuỗi bài viết này sẽ đưa bạn từ các kiến thức cơ bản về NLP và Computer Vision đến các mô hình Vision-Language Models tiên tiến nhất.
★ 1.179+0Thay đổi số sao trong 7 ngày qua - #168
💁 Kho tàng tuyệt vời các mô hình Transformers cho Xử lý ngôn ngữ tự nhiên, bao gồm các bài báo, video, blog, kho lưu trữ chính thức cùng với các Colab Notebook. 🛫☑️
★ 1.179+0Thay đổi số sao trong 7 ngày qua - #169
Danh sách các tài nguyên NLP được tuyển chọn tập trung vào mạng Transformer, cơ chế chú ý, GPT, BERT, ChatGPT, LLM và học chuyển giao.
★ 1.152+0Thay đổi số sao trong 7 ngày qua - #170
Triển khai mô hình ngôn ngữ Plug and Play. Cho phép điều khiển chủ đề và các thuộc tính của mô hình GPT-2.
★ 1.152+0Thay đổi số sao trong 7 ngày qua - #171★ 1.151+0Thay đổi số sao trong 7 ngày qua
- #172
Tạo câu hỏi nơ-ron sử dụng transformers
★ 1.141+0Thay đổi số sao trong 7 ngày qua - #173★ 1.130+0Thay đổi số sao trong 7 ngày qua
- #174
Thư viện phát hiện ngôn ngữ tự nhiên chính xác nhất cho Rust, phù hợp cho văn bản ngắn và văn bản đa ngôn ngữ.
★ 1.129+0Thay đổi số sao trong 7 ngày qua - #175
awesome grounding: Danh sách tuyển chọn các bài báo nghiên cứu về visual grounding.
★ 1.127+0Thay đổi số sao trong 7 ngày qua - #176
DataDreamer: Nhắc lệnh. Tạo dữ liệu tổng hợp. Huấn luyện và căn chỉnh mô hình. 🤖💤
★ 1.118+1Thay đổi số sao trong 7 ngày qua - #177★ 1.116+14Thay đổi số sao trong 7 ngày qua
- #178
Framework tiền huấn luyện của Tencent trong PyTorch và Model Zoo đã được huấn luyện sẵn.
★ 1.093+0Thay đổi số sao trong 7 ngày qua - #179
Triển khai dự đoán kết hợp nhẹ, hữu ích trên dữ liệu thực.
★ 1.083+1Thay đổi số sao trong 7 ngày qua - #180
Awesome-llm-role-playing-with-persona: danh sách tài nguyên được tuyển chọn dành cho các mô hình ngôn ngữ lớn đóng vai theo nhân vật được gán
★ 1.068+0Thay đổi số sao trong 7 ngày qua