目录
●序言1
序言2
前言
基础篇 初识大语言模型
1 大语言模型是什么(了解AI时代大语言模型的前世今生) 2
1.1 大语言模型什么时候突然走进我们的视野 2
1.2 追溯大语言模型的前世 3
1.3 预训练模型的兴起:AI进化的方向 6
1.4 生成式AI时代的到来:大语言模型“TOP-1” 9
2 大语言模型是如何工作的(解密大语言模型的工作原理) 22
2.1 大语言模型:放大版的生成式AI 22
2.2 大语言模型的左膀右臂:微调与提示 25
2.3 大语言模型+:AI平台时代的到来 31
2.4 大语言模型生态的繁荣:第三方框架与软件库的持续发展与完善 34
2.5 开源大语言模型:驱动未来AI腾飞的灵魂 37
3 深度剖析大语言模型的现状与研发竞赛(企业与科研院所的竞相角逐与创新探索) 40
3.1 AI技术的持续创新与突破 40
3.2 加速发展+突破想象力的AI产品不断涌现 41
3.3 企业:资金与数据的双重驱动 42
3.4 科研院所:学术与技术的深度融合 43
3.5 国产大语言模型的开发及竞争的意义 44
3.6 未来竞争的焦点 45
……
内容介绍
大语言模型作为AI领域的明星,凭借其强大的语言理解和生成能力,正深刻地改变着人们的生活与工作。其兴起得益于预训练和生成式AI技术的发展,未来将在多领域发挥重要作用,但同时也面临隐私、伦理等挑战。
本书全面介绍大语言模型(Large Language Model,LLM)的前世今生、工作原理、应用实践及未来趋势。全书共4篇:基础篇追溯了大语言模型的起源与兴起,深度揭秘了其工作原理,并对当前现状与研发竞赛进行深入分析,同时展望了其未来发展前景。进阶篇聚焦于模型规模化、提示工程、思维链推理等关键技术,详细介绍了以ChatGPT为代表的大语言模型背后的技术原理,并探讨问答系统在实际应用中的落地实践。高阶篇深入剖析了Transformer架构与预训练模型的核心机制,探讨微调技巧在提升模型性能中的作用,以及大语言模型在多领域的应用实践,同时构建和完善了大语言模型的API生态体系。展望篇探讨......