language-model
標記 language-model 主題、收錄中的開源專案,依星數排序。
- #61★ 1,850+0近 7 天星數變化
- #62
簡繁擴充詞庫/聲調編碼/最全聲調標註工具鏈/萬象更新工具鏈/Rime 語法模型:LMDG - Language, Model, Dictionary, Grammar。沒錯這裡就是萬象拼音的「羅馬帝國」!
★ 1,849+8近 7 天星數變化 - #63★ 1,752+1近 7 天星數變化
- #64
中文對話 0.2B 小模型(ChatLM-Chinese-0.2B),開源所有資料集來源、資料清洗、tokenizer 訓練、模型預訓練、SFT 指令微調、RLHF 優化等流程的全部程式碼。支援下游任務 sft 微調,給出三元組資訊抽取微調範例。
★ 1,731+2近 7 天星數變化 - #65★ 1,695-1近 7 天星數變化
- #66★ 1,591+0近 7 天星數變化
- #67★ 1,579+0近 7 天星數變化
- #68
小模型,大邏輯:多元驅動最佳化在 VibeThinker-1.5B 中引發大模型推理能力
★ 1,567+5近 7 天星數變化 - #69★ 1,567+1近 7 天星數變化
- #70
基礎模型學習課程,從零開始到前沿技術
★ 1,464+1近 7 天星數變化 - #71
預訓練中文 ELECTRA 模型
★ 1,434+0近 7 天星數變化 - #72
日本語LLM總結 - 日本語LLM概覽
★ 1,428+1近 7 天星數變化 - #73★ 1,420+3近 7 天星數變化
- #74
🛸 在 spaCy 中使用預先訓練的 transformer,如 BERT、XLNet 和 GPT-2
★ 1,410+0近 7 天星數變化 - #75★ 1,406+0近 7 天星數變化
- #76★ 1,385-1近 7 天星數變化
- #77★ 1,366+0近 7 天星數變化
- #78★ 1,309+0近 7 天星數變化
- #79
Transformers4Rec 是一個靈活且高效的序列與基於會話的推薦函式庫,可與 PyTorch 搭配使用。
★ 1,281+0近 7 天星數變化 - #80
根據論文〈Cognitive Architectures for Language Agents〉列出的語言代理清單
★ 1,256+3近 7 天星數變化 - #81★ 1,212-1近 7 天星數變化
- #82
💁 自然語言處理 Transformers 模型精選寶庫,包含論文、影片、部落格、官方儲存庫以及 Colab 筆記本。 🛫☑️
★ 1,179+0近 7 天星數變化 - #83
用於訓練遵循指令 LLM (ChatGPT、LLaMA、Alpaca) 的開源資料集集合
★ 1,153-1近 7 天星數變化 - #84
精選的 NLP 資源清單,聚焦於 Transformer 網路、注意力機制、GPT、BERT、ChatGPT、LLMs 與遷移學習。
★ 1,152+2近 7 天星數變化 - #85
[NeurIPS 2023] LLM-Pruner:大型語言模型的結構化剪枝。支援 Llama-3/3.1、Llama-2、LLaMA、BLOOM、Vicuna、Baichuan、TinyLlama 等。
★ 1,139+2近 7 天星數變化 - #86★ 1,124+0近 7 天星數變化
- #87
Z80-μLM 是一個 2 位元量化語言模型,小到足以在 8 位元 Z80 處理器上執行。使用 Python 訓練對話模型,將其匯出為 CP/M .COM 二進位檔,並與您的復古電腦對話。
★ 1,119+2近 7 天星數變化 - #88
LangSmith 客戶端 SDK 實作
★ 1,050+9近 7 天星數變化 - #89★ 1,040+1近 7 天星數變化
- #90
【兼容 ollama 和其他模型】將任何具有 OpenAI API 呼叫方法的模型整合到 PotPlayer 中。它能讓你在觀看影片時即時翻譯字幕,從而打破語言障礙,提升你的觀看體驗。
★ 1,033+2近 7 天星數變化