大模型的系列书籍有哪些?
想系统学大模型,优先选这套书:零基础看《GPT 图解》快速入门,想啃底层选《大语言模型:基础与前沿》,做 RAG 落地必看《RAG 实战课》,搞 Agent 架构选《Agent 设计模式》。从入门到生产,全链路覆盖不踩坑。
大模型系列图书清单
按学习路径 + 技术深度分类,覆盖入门、底层、工程、应用全链路推荐。
一、入门必选(零基础友好,快速建立认知)
《GPT 图解:大模型是怎样构建的》

🌟 豆瓣 8.1 分,以图解 + 故事拆解技术,从 N-Gram、Word2Vec 到 Transformer、GPT 全链路。
本书将带领读者踏上一段扣人心弦的探索之旅,让其亲身感受,并动手搭建语言模型。本书主要内容包括N-Gram,词袋模型(BoW),Word2Vec(W2V),神经概率语言模型(NPLM),循环神经网络(RNN),Seq2Seq(S2S),注意力机制,Transformer,从初代GPT到ChatGPT再到GPT-4等一系列突破性技术的诞生与演进。
本书将以生动活泼的笔触,将枯燥的技术细节化作轻松幽默的故事和缤纷多彩的图画,引领读者穿梭于不同技术的时空,见证自然语言处理技术的传承、演进与蜕变。在这场不断攀登技术新峰的奇妙之旅中,读者不仅能深入理解自然语言处理技术的核心原理,还能自己动手,从零开始搭建起一个又一个语言模型。
无论你是在校学生还是人工智能从业者,这本书都将成为一盏明灯,照亮你探索人工智能无限奥秘的道路。
《大模型导论》

覆盖数据预处理、Transformer、预训练 / 微调、推理、部署全流程,含 PyTorch、LangChain 实战与开源模型案例,适合高校师生与开发者。
本书主要介绍了大模型的发展与演变、相关技术、应用场景、未来发展趋势和前景。本书首先回顾了大模型技术的起源和发展历程,然后介绍了数据预处理、Transformer、预训练与微调、模型推理和PyTorch框架等技术。此外,本书还通过具体的案例和实践展示了如何应用大模型技术来解决实际问题。本书旨在帮助读者全面了解大模型技术的发展与应用,并推动其在各个领域的应用和发展。 本书图文并茂,理论翔实,案例丰富,适合从事大模型开发的科研人员以及广大的开发者作为技术参考和培训资料,亦可作为高校本科生和研究生的教材。
二、底层原理 & 动手实现(硬核技术,匹配 “底层开发” 类问题)
《大语言模型:基础与前沿》

系统讲解 Transformer、预训练目标、微调策略(LoRA)、稀疏专家模型、多模态融合,附前沿研究与行业案例,适合进阶研发与科研。
本书深入阐述了大语言模型的基本概念和算法、研究前沿以及应用,涵盖大语言模型的广泛主题,从基础到前沿,从方法到应用,涉及从方法论到应用场景方方面面的内容。首先,本书介绍了人工智能领域的进展和趋势;其次,探讨了语言模型的基本概念和架构、Transformer、预训练目标和解码策略、上下文学习和轻量级微调、稀疏专家模型、检索增强型语言模型、对齐语言模型与人类偏好、减少偏见和有害性以及视觉语言模型等内容;最后,讨论了语言模型对环境的影响。 本书内容全面、系统性强,适合高年级本科生和研究生、博士后研究人员、讲师以及行业从业者阅读与参考。
《动手构建大模型》

聚焦 “从零实现”,覆盖 Tokenizer、Attention、前向 / 反向传播、分布式训练,代码级拆解大模型核心逻辑,精准匹配 “如何从零实现大模型” 等问题。
本书采用创新且实用的教学策略,巧妙融合理论基础与实践应用,深入剖析自然语言处理(Natural Language Processing,NLP)领域的新进展,以及大语言模型(Large Language Model,LLM)的原理。书中不仅系统阐述了?LLM?的理论基础,还通过实际项目案例展示了如何将这些模型应用于构建RAG系统。本书遵循由浅入深的路径,从LLM的基础知识入手,详细阐释了模型的训练流程,并深入探讨了如何利用提示技术与模型进行高效交互。书中还重点介绍了两个在业界得到广泛认可的框架—LlamaIndex和LangChain,它们是开发RAG应用的强大工具。书中的项目案例不仅为读者提供了宝贵的实践经验,也能够加深读者对相关概念的理解和应用。此外,书中进一步探讨了包括智能体和微调在内的高级技术,这些技术能够显著提升问答系统的性能。
三、工程化 & 实战(生产级落地,匹配 “工程落地” 类问题)
《大模型应用开发:RAG 实战课》

拆解 RAG 全生命周期:数据导入、分块、嵌入、检索、重排、生成、评估,覆盖 GraphRAG、Agentic RAG 等前沿范式,含 DeepSeek、LangChain、Milvus 实战。
本书围绕完整的RAG系统生命周期,系统地拆解其架构设计与实现路径,助力开发者和企业构建实用、可控且可优化的智能问答系统。 首先,本书以“数据导入—文本分块—信息嵌入—向量存储”为主线,详细阐述了从多源文档加载到结构化预处理的全流程,并深入解析了嵌入模型的选型、微调策略及多模态支持;其次,从检索前的查询构建、查询翻译、查询路由、索引优化,到检索后的重排与压缩,全面讲解了提高召回质量和内容相关性的方法;接下来,介绍了多种生成方式及RAG 系统的评估框架;最后,展示了复杂RAG范式的新进展,包括GraphRAG、Modular RAG、 Agentic RAG和Multi-Modal RAG的构建路径。 本书适合AI研发工程师、企业技术负责人、知识管理从业者以及对RAG系统构建感兴趣的高校师生阅读。无论你是希望快速搭建RAG系统,还是致力于深入优化检索性能,亦或是探索下一代AI系统架构,本书都提供了实用的操作方法与理论支持。
《大模型工程化:AI 驱动下的数据体系》

聚焦湖仓一体、数据资产、领域大模型构建,结合游戏经营分析案例,解决大模型落地中的数据治理与工程化难题,适合数据工程师与技术负责人。
本书详细阐述如何在游戏经营分析场景中利用大模型实现数据体系的建设。 本书分为6个部分,共16章。第1部分主要介绍大模型技术的发展与应用,从大模型的发展现状展开,重点介绍大模型与数据体系的相关知识。第2部分主要介绍大模型下的关键基础设施,涵盖湖仓一体引擎、湖仓的关键技术、实时数据写入和高效数据分析等内容。第3部分主要介绍大模型下的数据资产,围绕数据资产重塑、数据资产标准、数据资产建设、数据资产运营展开。第4部分主要介绍自研领域大模型的技术原理,涵盖领域大模型的基础、需求理解算法、需求匹配算法、需求转译算法等内容。第5部分主要介绍大模型的工程化原理,涉及工程化的基础、技术筹备、建设要点、安全策略等内容。第6部分介绍大模型在游戏领域的应用,通过游戏领域的经营分析案例,系统地阐述如何实现业务需求。 本书适合致力于大模型技术应用的数据工程师阅读,也适合寻求AI自动化编程解决方案的软件开发者阅读,还适合希望利用AI提升业务效率的企业决策者阅读。
四、进阶 & 专项(聚焦细分领域,匹配 “专项技术” 类问题)
《Agent 设计模式:图解可复用智能体架构》

体系化讲解 Agent 感知、记忆、规划、工具调用等 21 种核心模式,适合从 Demo 到生产的智能体架构设计,匹配 “如何成为 AI Agent 工程师” 等问题。
本书是Agent时代的架构设计与工程实践指南,旨在连接传统软件工程与大模型应用。全书分为上下两篇:上篇以历史演进为线索,剖析了软件范式从“确定性结构”向“概率性智能”的演进,揭示Agent诞生的必然性;下篇作为实战手册,系统构建了涵盖感知、记忆、推理、行动、反思与协作的通用架构,并拆解了21个核心设计模式。本书超越代码层面,从架构、机制与实践等多维度出发,通过丰富案例,为解决“如何在不确定的大模型上构建可靠系统”提供了可复用的方法论。 本书适合对Agent设计、软件工程、人工智能等领域感兴趣的读者,包括相关专业的师生、研究人员、工程师、架构师、产品经理及运营人员等阅读。
更多推荐


所有评论(0)