{"id":29325649,"url":"https://github.com/datawhalechina/happy-llm","last_synced_at":"2026-01-22T00:41:06.928Z","repository":{"id":295764515,"uuid":"806854629","full_name":"datawhalechina/happy-llm","owner":"datawhalechina","description":"📚 从零开始的大语言模型原理与实践教程","archived":false,"fork":false,"pushed_at":"2025-12-25T08:13:25.000Z","size":51490,"stargazers_count":23254,"open_issues_count":36,"forks_count":2120,"subscribers_count":81,"default_branch":"main","last_synced_at":"2025-12-26T21:27:01.655Z","etag":null,"topics":["agent","llm","rag"],"latest_commit_sha":null,"homepage":"https://datawhalechina.github.io/happy-llm/","language":"Jupyter Notebook","has_issues":true,"has_wiki":null,"has_pages":null,"mirror_url":null,"source_name":null,"license":"other","status":null,"scm":"git","pull_requests_enabled":true,"icon_url":"https://github.com/datawhalechina.png","metadata":{"files":{"readme":"README.md","changelog":null,"contributing":null,"funding":null,"license":"LICENSE.txt","code_of_conduct":null,"threat_model":null,"audit":null,"citation":null,"codeowners":null,"security":null,"support":null,"governance":null,"roadmap":null,"authors":null,"dei":null,"publiccode":null,"codemeta":null,"zenodo":null,"notice":null,"maintainers":null,"copyright":null,"agents":null,"dco":null,"cla":null}},"created_at":"2024-05-28T03:22:50.000Z","updated_at":"2025-12-26T20:02:56.000Z","dependencies_parsed_at":"2025-06-12T02:20:57.265Z","dependency_job_id":"52792244-da7e-4404-8276-4b617761e79a","html_url":"https://github.com/datawhalechina/happy-llm","commit_stats":null,"previous_names":["datawhalechina/happy-llm"],"tags_count":2,"template":false,"template_full_name":null,"purl":"pkg:github/datawhalechina/happy-llm","repository_url":"https://repos.ecosyste.ms/api/v1/hosts/GitHub/repositories/datawhalechina%2Fhappy-llm","tags_url":"https://repos.ecosyste.ms/api/v1/hosts/GitHub/repositories/datawhalechina%2Fhappy-llm/tags","releases_url":"https://repos.ecosyste.ms/api/v1/hosts/GitHub/repositories/datawhalechina%2Fhappy-llm/releases","manifests_url":"https://repos.ecosyste.ms/api/v1/hosts/GitHub/repositories/datawhalechina%2Fhappy-llm/manifests","owner_url":"https://repos.ecosyste.ms/api/v1/hosts/GitHub/owners/datawhalechina","download_url":"https://codeload.github.com/datawhalechina/happy-llm/tar.gz/refs/heads/main","sbom_url":"https://repos.ecosyste.ms/api/v1/hosts/GitHub/repositories/datawhalechina%2Fhappy-llm/sbom","scorecard":null,"host":{"name":"GitHub","url":"https://github.com","kind":"github","repositories_count":286080680,"owners_count":28648460,"icon_url":"https://github.com/github.png","version":null,"created_at":"2022-05-30T11:31:42.601Z","updated_at":"2026-01-21T21:29:11.980Z","status":"ssl_error","status_checked_at":"2026-01-21T21:24:31.872Z","response_time":86,"last_error":"SSL_connect returned=1 errno=0 peeraddr=140.82.121.5:443 state=error: unexpected eof while reading","robots_txt_status":"success","robots_txt_updated_at":"2025-07-24T06:49:26.215Z","robots_txt_url":"https://github.com/robots.txt","online":false,"can_crawl_api":true,"host_url":"https://repos.ecosyste.ms/api/v1/hosts/GitHub","repositories_url":"https://repos.ecosyste.ms/api/v1/hosts/GitHub/repositories","repository_names_url":"https://repos.ecosyste.ms/api/v1/hosts/GitHub/repository_names","owners_url":"https://repos.ecosyste.ms/api/v1/hosts/GitHub/owners"}},"keywords":["agent","llm","rag"],"created_at":"2025-07-07T18:01:42.370Z","updated_at":"2026-01-22T00:41:06.922Z","avatar_url":"https://github.com/datawhalechina.png","language":"Jupyter Notebook","funding_links":[],"categories":["Jupyter Notebook","Repos","A01_文本生成_文本对话","LLM 预训练方法 (Pre-training Methods)","Open-Source LLM \u0026 Agent Projects","🏆 القائمة الكاملة Top 200"],"sub_categories":["大语言对话模型及数据","视频 (Video)"],"readme":"\u003cdiv align='center'\u003e\n    \u003cimg src=\"./images/head.jpg\" alt=\"alt text\" width=\"100%\"\u003e\n    \u003ch1\u003eHappy-LLM\u003c/h1\u003e\n\u003c/div\u003e\n\n\u003cdiv align=\"center\"\u003e\n  \u003cimg src=\"https://img.shields.io/github/stars/datawhalechina/happy-llm?style=flat\u0026logo=github\" alt=\"GitHub stars\"/\u003e\n  \u003cimg src=\"https://img.shields.io/github/forks/datawhalechina/happy-llm?style=flat\u0026logo=github\" alt=\"GitHub forks\"/\u003e\n  \u003cimg src=\"https://img.shields.io/badge/language-Chinese-brightgreen?style=flat\" alt=\"Language\"/\u003e\n  \u003ca href=\"https://github.com/datawhalechina/happy-llm\"\u003e\u003cimg src=\"https://img.shields.io/badge/GitHub-Project-blue?style=flat\u0026logo=github\" alt=\"GitHub Project\"\u003e\u003c/a\u003e\n  \u003ca href=\"https://swanlab.cn/@kmno4/Happy-LLM/overview\"\u003e\u003cimg src=\"https://raw.githubusercontent.com/SwanHubX/assets/main/badge1.svg\" alt=\"SwanLab\"\u003e\u003c/a\u003e\n\u003c/div\u003e\n\n\u003cdiv align=\"center\"\u003e\n  \u003ca href=\"https://trendshift.io/repositories/14175\" target=\"_blank\"\u003e\u003cimg src=\"https://trendshift.io/api/badge/repositories/14175\" alt=\"datawhalechina%2Fhappy-llm | Trendshift\" style=\"width: 250px; height: 55px;\" width=\"250\" height=\"55\"/\u003e\u003c/a\u003e\n\u003c/div\u003e\n\n\u003cdiv align=\"center\"\u003e\n\n[中文](./README.md) | [English](./README_en.md)\n\n\u003c/div\u003e\n\n\u003cdiv align=\"center\"\u003e\n  \u003cp\u003e\u003ca href=\"https://datawhalechina.github.io/happy-llm/\"\u003e📚 在线阅读地址\u003c/a\u003e\u003c/p\u003e\n  \u003ch3\u003e📚 从零开始的大语言模型原理与实践教程\u003c/h3\u003e\n  \u003cp\u003e\u003cem\u003e深入理解 LLM 核心原理，动手实现你的第一个大模型\u003c/em\u003e\u003c/p\u003e\n\u003c/div\u003e\n\n---\n\n## 🎯 项目介绍\n\n\u003e \u0026emsp;\u0026emsp;*很多小伙伴在看完 Datawhale开源项目： [self-llm 开源大模型食用指南](https://github.com/datawhalechina/self-llm) 后，感觉意犹未尽，想要深入了解大语言模型的原理和训练过程。于是我们（Datawhale）决定推出《Happy-LLM》项目，旨在帮助大家深入理解大语言模型的原理和训练过程。*\n\n\u0026emsp;\u0026emsp;本项目是一个**系统性的 LLM 学习教程**，将从 NLP 的基本研究方法出发，根据 LLM 的思路及原理逐层深入，依次为读者剖析 LLM 的架构基础和训练过程。同时，我们会结合目前 LLM 领域最主流的代码框架，演练如何亲手搭建、训练一个 LLM，期以实现授之以鱼，更授之以渔。希望大家能从这本书开始走入 LLM 的浩瀚世界，探索 LLM 的无尽可能。\n\n### ✨ 你将收获什么？\n\n- 📚 **Datawhale 开源免费** 完全免费的学习本项目所有内容\n- 🔍 **深入理解** Transformer 架构和注意力机制\n- 📚 **掌握** 预训练语言模型的基本原理\n- 🧠 **了解** 现有大模型的基本结构\n- 🏗️ **动手实现** 一个完整的 LLaMA2 模型\n- ⚙️ **掌握训练** 从预训练到微调的全流程\n- 🚀 **实战应用** RAG、Agent 等前沿技术\n\n## 📖 内容导航\n\n| 章节 | 关键内容 | 状态 |\n| --- | --- | --- |\n| [前言](./docs/前言.md) | 本项目的缘起、背景及读者建议 | ✅ |\n| [第一章 NLP 基础概念](./docs/chapter1/第一章%20NLP基础概念.md) | 什么是 NLP、发展历程、任务分类、文本表示演进 | ✅ |\n| [第二章 Transformer 架构](./docs/chapter2/第二章%20Transformer架构.md) | 注意力机制、Encoder-Decoder、手把手搭建 Transformer | ✅ |\n| [第三章 预训练语言模型](./docs/chapter3/第三章%20预训练语言模型.md) | Encoder-only、Encoder-Decoder、Decoder-Only 模型对比 | ✅ |\n| [第四章 大语言模型](./docs/chapter4/第四章%20大语言模型.md) | LLM 定义、训练策略、涌现能力分析 | ✅ |\n| [第五章 动手搭建大模型](./docs/chapter5/第五章%20动手搭建大模型.md) | 实现 LLaMA2、训练 Tokenizer、预训练小型 LLM | ✅ |\n| [第六章 大模型训练实践](./docs/chapter6/第六章%20大模型训练流程实践.md) | 预训练、有监督微调、LoRA/QLoRA 高效微调 | 🚧 |\n| [第七章 大模型应用](./docs/chapter7/第七章%20大模型应用.md) | 模型评测、RAG 检索增强、Agent 智能体 | ✅ |\n| [Extra Chapter LLM Blog](./Extra-Chapter/) | 优秀的大模型 学习笔记/Blog ，欢迎大家来 PR ！| 🚧 |\n\n### Extra Chapter LLM Blog\n\n- [大模型都这么厉害了，微调0.6B的小模型有什么意义？](./Extra-Chapter/why-fine-tune-small-large-language-models/readme.md) @[不要葱姜蒜](https://github.com/KMnO4-zx) 2025-7-11\n\n- [Transformer 整体模块设计解读](./Extra-Chapter/transformer-architecture/) @[ditingdapeng](https://github.com/ditingdapeng) 2025-7-14\n\n- [文本数据处理详解](./Extra-Chapter/text-data-processing/readme.md) @[蔡鋆捷](https://github.com/xinala-781) 2025-7-14\n\n- [Qwen3-\"VL\"——超小中文多模态模型的“拼接微调”之路](./Extra-Chapter/vlm-concatenation-finetune/README.md) @[ShaohonChen](https://github.com/ShaohonChen) 2025-7-30\n\n- [S1: Thinking Budget with vLLM](./Extra-Chapter/s1-vllm-thinking-budget/readme.md) @[不要葱姜蒜](https://github.com/kmno4-zx) 2025-8-03\n\n\n- [CDDRS: 使用细粒度语义信息指导增强的RAG检索方法](./Extra-Chapter/CDDRS/readme.md) @[Hongru0306](https://github.com/Hongru0306) 2025-8-21\n\n- [大模型生成 Token 的方式有哪些？](./Extra-Chapter/generation-method/readme.md) @[不要葱姜蒜](https://github.com/kmno4-zx) 2025-10-17\n\n\n\u003e \u0026emsp;\u0026emsp;*如果大家在学习 Happy-LLM 项目或 LLM 相关知识中有自己独到的见解、认知、实践，欢迎大家 PR 在 [Extra Chapter LLM Blog](./Extra-Chapter/) 中。请遵守 Extra Chapter LLM Blog 的 [PR 规范](./Extra-Chapter/Readme.md)，我们会视 PR 内容的质量和价值来决定是否合并或补充到 Happy-LLM 正文中来。*\n\n### 模型下载\n\n| 模型名称 | 下载地址 |\n| --- | --- |\n| Happy-LLM-Chapter5-Base-215M | [🤖 ModelScope](https://www.modelscope.cn/models/kmno4zx/happy-llm-215M-base) |\n| Happy-LLM-Chapter5-SFT-215M | [🤖 ModelScope](https://www.modelscope.cn/models/kmno4zx/happy-llm-215M-sft) |\n\n\u003e *ModelScope 创空间体验地址：[🤖 创空间](https://www.modelscope.cn/studios/kmno4zx/happy_llm_215M_sft)*\n\n\n### PDF 版本下载\n\n\u0026emsp;\u0026emsp;***本 Happy-LLM PDF 教程完全开源免费。为防止各类营销号加水印后贩卖给大模型初学者，我们特地在 PDF 文件中预先添加了不影响阅读的 Datawhale 开源标志水印，敬请谅解～***\n\n\u003e *Happy-LLM PDF : https://github.com/datawhalechina/happy-llm/releases/tag/v1.0.1*  \n\n## 💡 如何学习\n\n\u0026emsp;\u0026emsp;本项目适合大学生、研究人员、LLM 爱好者。在学习本项目之前，建议具备一定的编程经验，尤其是要对 Python 编程语言有一定的了解。最好具备深度学习的相关知识，并了解 NLP 领域的相关概念和术语，以便更轻松地学习本项目。\n\n\u0026emsp;\u0026emsp;本项目分为两部分——基础知识与实战应用。第1章～第4章是基础知识部分，从浅入深介绍 LLM 的基本原理。其中，第1章简单介绍 NLP 的基本任务和发展，为非 NLP 领域研究者提供参考；第2章介绍 LLM 的基本架构——Transformer，包括原理介绍及代码实现，作为 LLM 最重要的理论基础；第3章整体介绍经典的 PLM，包括 Encoder-Only、Encoder-Decoder 和 Decoder-Only 三种架构，也同时介绍了当前一些主流 LLM 的架构和思想；第4章则正式进入 LLM 部分，详细介绍 LLM 的特点、能力和整体训练过程。第5章～第7章是实战应用部分，将逐步带领大家深入 LLM 的底层细节。其中，第5章将带领大家者基于 PyTorch 层亲手搭建一个 LLM，并实现预训练、有监督微调的全流程；第6章将引入目前业界主流的 LLM 训练框架 Transformers，带领学习者基于该框架快速、高效地实现 LLM 训练过程；第7章则将介绍 基于 LLM 的各种应用，补全学习者对 LLM 体系的认知，包括 LLM 的评测、检索增强生成（Retrieval-Augmented Generation，RAG）、智能体（Agent）的思想和简单实现。你可以根据个人兴趣和需求，选择性地阅读相关章节。\n\n\u0026emsp;\u0026emsp;在阅读本书的过程中，建议你将理论和实际相结合。LLM 是一个快速发展、注重实践的领域，我们建议你多投入实战，复现本书提供的各种代码，同时积极参加 LLM 相关的项目与比赛，真正投入到 LLM 开发的浪潮中。我们鼓励你关注 Datawhale 及其他 LLM 相关开源社区，当遇到问题时，你可以随时在本项目的 issue 区提问。\n\n\u0026emsp;\u0026emsp;最后，欢迎每一位读者在学习完本项目后加入到 LLM 开发者的行列。作为国内 AI 开源社区，我们希望充分聚集共创者，一起丰富这个开源 LLM 的世界，打造更多、更全面特色 LLM 的教程。星火点点，汇聚成海。我们希望成为 LLM 与普罗大众的阶梯，以自由、平等的开源精神，拥抱更恢弘而辽阔的 LLM 世界。\n\n\u003e - 中国计算机学会(CCF) × Datawhale × GitLink开源平台联合推出AI普惠课程，免费算力报名参加 [【报名地址】](https://mp.weixin.qq.com/s/P03f3e2vUUh7OxDP40Ra6w)[【GitLink 地址】](https://gitlink.org.cn/datawhalechina/happy-llm)\n\n## 🤝 如何贡献\n\n我们欢迎任何形式的贡献！\n\n- 🐛 **报告 Bug** - 发现问题请提交 Issue\n- 💡 **功能建议** - 有好想法就告诉我们\n- 📝 **内容完善** - 帮助改进教程内容\n- 🔧 **代码优化** - 提交 Pull Request\n\n## 🙏 致谢\n\n### 核心贡献者\n- [宋志学-项目负责人](https://github.com/KMnO4-zx) (Datawhale成员)\n- [邹雨衡-项目负责人](https://github.com/logan-zou) (Datawhale成员-对外经济贸易大学)\n- [朱信忠-指导专家](https://xinzhongzhu.github.io/)（Datawhale首席科学家-浙江师范大学杭州人工智能研究院教授）\n\n### Extra-Chapter 贡献者\n\n- [ditingdapeng](https://github.com/ditingdapeng)（内容贡献者-云原生基础架构工程师）\n- [蔡鋆捷](https://github.com/xinala-781)（内容贡献者-福州大学）\n- [ShaohonChen](https://github.com/ShaohonChen) （情感机器实验室研究员-西安电子科技大学在读硕士）\n- [肖鸿儒, 庄健琨](https://github.com/Hongru0306) (内容贡献者-同济大学)\n\n### 特别感谢\n- 感谢 [@Sm1les](https://github.com/Sm1les) 对本项目的帮助与支持\n- 感谢所有为本项目做出贡献的开发者们 ❤️\n\n\u003cdiv align=center style=\"margin-top: 30px;\"\u003e\n  \u003ca href=\"https://github.com/datawhalechina/happy-llm/graphs/contributors\"\u003e\n    \u003cimg src=\"https://contrib.rocks/image?repo=datawhalechina/happy-llm\" /\u003e\n  \u003c/a\u003e\n\u003c/div\u003e\n\n## Star History\n\n\u003cdiv align='center'\u003e\n    \u003cimg src=\"./images/star-history-20251017.png\" alt=\"Datawhale\" width=\"90%\"\u003e\n\u003c/div\u003e\n\n\u003cdiv align=\"center\"\u003e\n  \u003cp\u003e⭐ 如果这个项目对你有帮助，请给我们一个 Star！\u003c/p\u003e\n\u003c/div\u003e\n\n## 关于 Datawhale\n\n\u003cdiv align='center'\u003e\n    \u003cimg src=\"./images/datawhale.png\" alt=\"Datawhale\" width=\"30%\"\u003e\n    \u003cp\u003e扫描二维码关注 Datawhale 公众号，获取更多优质开源内容\u003c/p\u003e\n\u003c/div\u003e\n\n---\n\n## 📜 开源协议\n\n本作品采用[知识共享署名-非商业性使用-相同方式共享 4.0 国际许可协议](http://creativecommons.org/licenses/by-nc-sa/4.0/)进行许可。\n","project_url":"https://awesome.ecosyste.ms/api/v1/projects/github.com%2Fdatawhalechina%2Fhappy-llm","html_url":"https://awesome.ecosyste.ms/projects/github.com%2Fdatawhalechina%2Fhappy-llm","lists_url":"https://awesome.ecosyste.ms/api/v1/projects/github.com%2Fdatawhalechina%2Fhappy-llm/lists"}