首页分类大语言模型全链路解析:从架构设计、训练优化到应用开发
大语言模型全链路解析:从架构设计、训练优化到应用开发

大语言模型全链路解析:从架构设计、训练优化到应用开发

袁从德

22.7万字
总字数
6
累计阅读

支持 PDF · EPUB · Word · TXT 多种格式下载 (PDF 含 A4 / 手机版)

作品简介

内容简介
这是一本系统讲解大语言模型全链路技术的实战指南,以“基础理论—技术实践—产业应用—未来发展”为逻辑主线,覆盖从技术原理、架构设计、训练优化到应用开发和产业落地的完整知识体系。
本书是资深人工智能与算法工程专家在腾讯的大模型实战经验总结,内容分为四篇。
第一篇 初识大语言模型。梳理大语言模型发展历程与核心概念,解析预训练与微调机制,对比传统循环神经网络与Transformer架构差异,结合数学知识为零基础读者构建认知框架。
第二篇 大语言模型全解析。遵循“基础架构—训练方法—技术案例—后训练优化—评测体系—性能提升”的逻辑链条展开,聚焦DeepSeek的技术突破,系统讲解预训练目标设计、后训练优化(SFT/RLHF)、模型评测体系,并深入分析推理性能瓶颈及在硬件加速与算法层面的优化方案。
第三篇 大语言模型应用开发及实践。紧扣真实场景落地需求,详解提示工程、思维链、检索增强生成及智能体开发的全流程方法论与工具链整合策略。
第四篇 大语言模型的未来发展。前瞻性地探讨多模态融合(如视觉-语言指令微调)、具身智能与通用人工智能(AGI)的演进路径,为技术决策者提供战略级行业洞察。
大语言模型正以颠覆性力量重塑人工智能的边界。本书致力于成为连接理论探索与工程实践的坚实桥梁——无论你是希望夯实技术根基的工程师,还是谋划未来布局的战略决策者,都能从中获得启发,在通往通用智能的浪潮中,走出属于自己的创新路径。

出版社机械工业出版社
出版时间2026-03-01
ISBN9787111800378
共 5 章
Preface
第一篇初识大语言模型
第二篇大语言模型全解析
第三篇大语言模型应用开发及实践
第四篇大语言模型的未来发展

读者评论

暂无评论,来发表第一条吧

登录后参与评论

去登录 →