language-model
标记 language-model 主题、收录中的开源项目,按星标数排序。
- #61★ 1,850+0近 7 天星标变化
- #62
简繁扩展词库/声调编码/最全声调标注工具链/万象更新工具链/Rime语法模型:LMDG - Language, Model, Dictionary, Grammar。没错这里是万象拼音的“罗马帝国”!
★ 1,849+0近 7 天星标变化 - #63★ 1,752+0近 7 天星标变化
- #64
中文对话 0.2B 小模型(ChatLM-Chinese-0.2B),开源所有数据集来源、数据清洗、tokenizer 训练、模型预训练、SFT 指令微调、RLHF 优化等流程的全部代码。支持下游任务 sft 微调,给出三元组信息抽取微调示例。
★ 1,731+0近 7 天星标变化 - #65★ 1,695+0近 7 天星标变化
- #66★ 1,591+0近 7 天星标变化
- #67★ 1,579+0近 7 天星标变化
- #68
小模型,大逻辑:多元驱动优化在 VibeThinker-1.5B 中引发大模型推理能力
★ 1,567+0近 7 天星标变化 - #69★ 1,567+0近 7 天星标变化
- #70
基础模型学习课程,从零开始到前沿技术
★ 1,464+0近 7 天星标变化 - #71
预训练中文 ELECTRA 模型
★ 1,434+0近 7 天星标变化 - #72
日本語LLM总结 - 日本语LLM概览
★ 1,428+0近 7 天星标变化 - #73★ 1,420+0近 7 天星标变化
- #74
🛸 在 spaCy 中使用预训练的 transformer,如 BERT、XLNet 和 GPT-2
★ 1,410+0近 7 天星标变化 - #75★ 1,406+0近 7 天星标变化
- #76★ 1,385+0近 7 天星标变化
- #77★ 1,366+0近 7 天星标变化
- #78★ 1,309+0近 7 天星标变化
- #79
Transformers4Rec 是一个灵活且高效的序列与基于会话的推荐库,可与 PyTorch 搭配使用。
★ 1,281+0近 7 天星标变化 - #80
根据论文《Cognitive Architectures for Language Agents》列出的语言代理列表
★ 1,256+0近 7 天星标变化 - #81★ 1,212+0近 7 天星标变化
- #82
💁 自然语言处理 Transformers 模型精选宝库,包含论文、视频、博客、官方代码库以及 Colab 笔记本。 🛫☑️
★ 1,179+0近 7 天星标变化 - #83
用于训练遵循指令 LLM (ChatGPT、LLaMA、Alpaca) 的开源数据集集合
★ 1,153+0近 7 天星标变化 - #84
精选的 NLP 资源列表,聚焦于 Transformer 网络、注意力机制、GPT、BERT、ChatGPT、LLMs 与迁移学习。
★ 1,152+0近 7 天星标变化 - #85
[NeurIPS 2023] LLM-Pruner:大型语言模型的结构化剪枝。支持 Llama-3/3.1、Llama-2、LLaMA、BLOOM、Vicuna、Baichuan、TinyLlama 等。
★ 1,139+0近 7 天星标变化 - #86★ 1,124+0近 7 天星标变化
- #87
Z80-μLM 是一个 2 比特量化语言模型,小到足以在 8 比特 Z80 处理器上运行。使用 Python 训练对话模型,将其导出为 CP/M .COM 二进制文件,并与您的复古电脑对话。
★ 1,119+1近 7 天星标变化 - #88
LangSmith 客户端 SDK 实现
★ 1,048+5近 7 天星标变化 - #89★ 1,040+1近 7 天星标变化
- #90
【兼容 ollama 和其他模型】将任何具有 OpenAI API 调用方法的模型集成到 PotPlayer 中。它能让你在观看视频时实时翻译字幕,从而打破语言障碍,提升你的观看体验。
★ 1,035+6近 7 天星标变化