从零构建大模型算法、训练与微调
本书旨在引领读者从基础知识起步,逐步深入探索大模型的算法原理、训练方法及微调技术。全书共12章,涵盖了Transformer模型的基础理论,如Seq2Seq模型、分词、嵌入层和自注意力机制等关键概念;并深入剖析了GPT模型的核心实现与文本生成过程,以及BERT模型的预训练和微调技术。
每天更新,保持好奇
从历史的回声,到生活的答案。
在这里发现好书,也发现世界的另一种可能。
4877 本好书已收录 · 无需登录,自由探索
本书旨在引领读者从基础知识起步,逐步深入探索大模型的算法原理、训练方法及微调技术。全书共12章,涵盖了Transformer模型的基础理论,如Seq2Seq模型、分词、嵌入层和自注意力机制等关键概念;并深入剖析了GPT模型的核心实现与文本生成过程,以及BERT模型的预训练和微调技术。
最近同步 2026-10-04 09:06 UTC · 封面为本站排版,并非原书封面
用 RSS 订阅最新书单,让下一本好书主动找到你。