📖 书目详情
从零构建大模型:算法、训练与微调
| 著者 | 梁楠著 |
| ISBN | 9787302685616 |
| 中图分类 | TP18 自动化技术、计算机技术 |
| 学科分类 | 工学 |
| 版次 | 第1版 |
| 出版社 | 清华大学出版社 |
| 丛书名 | — |
| 出版年 | 2025 |
| 页码 | 284页 |
| 价格 | ¥99.00 |
| 可推荐册数 | 请登录后查看 |
| 核心评分 |
8.2/10
|
📝 内容简介
本书共12章, 涵盖了Transformer模型的基础理论, 如Seq2Seq模型、分词、嵌入层和自注意力机制等关键概念; 并深入剖析了GPT模型的核心实现与文本生成过程, 以及BERT模型的预训练和微调技术。同时, 也对ViT (视觉Transformer) 模型的架构、训练方法, 以及高阶微调策略如Adapter Tuning和P-Tuning进行了详尽讲解。此外, 还系统地介绍了数据处理、数据增强、模型性能优化 (包括混合精度训练和分布式训练)、对比学习、对抗训练、自适应优化器、动态学习率调度, 以及模型蒸馏与剪枝技术等多个方面。
🏛️ 本馆馆藏信息
本馆暂无该书的馆藏记录,可在线借购