解构大语言模型

Name: 解构大语言模型
Availability: InStock
Rating: 9.7 (26 reviews)
ISBN: 9787121477409

唐亘

出版社

电子工业出版社

出版时间

2024-04-30

ISBN

9787121477409

评分

★★★★★

标签

人工智能 AI 计算机大模型

书籍介绍

《解构大语言模型：从线性回归到通用人工智能》从模型的结构和数据基础两个方面解构大语言模型，以便帮助读者理解和搭建类似ChatGPT的系统。在模型的结构方面，大语言模型属于深度神经网络，其设计核心是注意力机制，因此，本书涵盖了多层感知器、卷积神经网络和循环神经网络等经典模型。在模型的数据基础方面，本书既涉及模型训练的工程基础，如反向传播，又涉及数据的使用方式，如迁移学习、强化学习，以及传统的监督学习和无监督学习。此外，本书还阐述了如何从计量经济学和经典机器学习模型中汲取灵感，以提高模型的稳定性和可解释性。《解构大语言模型：从线性回归到通用人工智能》既适用于希望深入了解大语言模型、通过人工智能技术解决实际问题的读者，也适合作为高等院校计算机及相关专业的师生参考用书。

作者简介

唐亘，数据科学家，专注于人工智能和大数据，积极参与Apache Spark、scikit-learn等开源项目，曾为华为、复旦大学等多家机构提供过百余场技术培训。曾撰写《精通数据科学：从线性回归到深度学习》一书，并担任英国最大在线出版社Packt的技术审稿人。毕业于复旦大学，获数学和计算机双学士学位，后求学于巴黎综合理工学院，获经济学和数据科学双硕士学位。

你可能会关注的书籍

精通数据科学：从线性回归到深度学习
唐亘

电子工业出版社的其他书籍查看全部