详细内容或原文请订阅后点击阅览
5 本书将加深您对大型语言模型的理解
查看这五本有关构建、微调和部署大型语言模型的书籍。
来源:KDnuggets简介
生成式人工智能生态系统发展迅速,但支持它的数学和架构都有详细记录。从经典自然语言处理 (NLP) 到生成式人工智能的转变改变了数据专业人员实际需要了解的内容。几年前,了解循环神经网络或标准分类模型对于大多数角色来说就足够了。如今,变压器架构的规模和复杂性需要更严格的系统级机器学习方法。
如果您想要超越提示 API 并真正了解如何训练、微调和部署基础模型,您需要结构化、全面的资源。对于认真的从业者来说,碎片化的教程并不能解决问题。以下五本书将加深您对大型语言模型 (LLM) 的理解,从简洁的概念概述到深入的、代码较多的工程手册。
1. 构建大型语言模型(从头开始)作者:Sebastian Raschka
我们将从技术基础开始。理解任何复杂系统的最持久的方法就是自己构建它。前两本书认真对待这一原则:一本引导您从头开始构建法学硕士,另一本为您提供现代语言模型实际工作原理的最清晰的概念图。
Sebastian Raschka 的《构建大型语言模型(从头开始)》一书将引导您完成设计、培训和微调法学硕士的详细过程。它没有将机制隐藏在高级抽象背后,而是让您直接接触底层的数学和逻辑。
这是本书的内容:
为什么这本书脱颖而出:
主要亮点:
