train-llm-from-scratch
用PyTorch从零训练自己的Transformer语言模型的分步教程,涵盖从原始文本到生成和对齐。适合想了解大模型原理的学习者。
分享到 X许可证: MIT
概述
这是一套基于《Attention Is All You Need》论文、用PyTorch训练自己的Transformer语言模型的分步教程和脚本。内容从原始文本和分词开始,得到基础模型,再依次进行监督微调、奖励模型、PPO、DPO和GRPO,最后是评估与对话。算法全部用原生PyTorch手写,不依赖trl、peft或transformers。作者称用单张GPU即可训练百万或十亿参数规模的模型。
主要特点
- 用原生PyTorch从零实现Transformer
- 从原始文本到预训练基础模型的完整流程
- 涵盖SFT、奖励模型、PPO、DPO和GRPO
- 不依赖trl、peft和transformers
- 最后包含评估与对话
适用场景
想通过亲手阅读和运行每一步来理解语言模型如何构建与对齐的学习者。这是教学项目,示例输出来自一个约1300万参数的小模型。
- 上游仓库
- FareedKhan-dev/train-llm-from-scratch
- GitHub 上的 fork
- Guo-astro/train-llm-from-scratch
- 上游 Star 数
- 12k
- 分类
- AI 智能体与大模型工具
- 许可证
- MIT
- Fork 时间
- 2026-09-25
- 同步状态
- 已同步上次同步 2026-09-29
同分类更多: AI 智能体与大模型工具
面向非英语国家儿童的免费桌面应用,通过和AI伙伴对话来练习英语口语和听力,可在本地离线使用。
Fork 时间 2026-09-28上次同步 2026-09-29许可证: MITAI 智能体与大模型工具GitHub
面向中国专利的智能体技能,帮助挖掘专利点、撰写交底书、通俗解读专利、跟踪政策并辅助审查答复。
Fork 时间 2026-09-28上次同步 2026-09-29许可证: MITAI 智能体与大模型工具GitHub
Hugging Face推出的精简Python库,用于构建通过编写代码来完成任务的AI代理,几行代码即可搭建。
Fork 时间 2026-09-28上次同步 2026-09-29许可证: Apache-2.0AI 智能体与大模型工具GitHub
评估AI代理处理真实法律工作能力的开源基准,提供任务和评测,用于改进法律类代理。
Fork 时间 2026-09-28上次同步 2026-09-29许可证: MITAI 智能体与大模型工具GitHub