异步图书www.epubit.comDeepSeek原理与项目实战大模型部署、微调与应用开发未来智能实验室代晶编着DeepSeek in ActionLLM Deployment, Fine-Tuning, and Real-World Projects中国工信出版集团人民邮电出版社POSTS&TELECOMPRESS
异步图书Deepseek原理与项目实战大模型部署、微调与应用开发未来智能实验室代晶编着DeepSeek in ActionLLM Deployment, Fine-Tuning, and Real-World Projects中国工信出版集团人民邮电出版社POSTS&TELECOMPRESS
版权信息COPYRIGHT书名:DeepSeek原理与项目实战作者:未来智能实验室编着;代晶编着出版社:人民邮电出版社出版时间:2025年3月ISBN:9787115665584字数:277千字版权所有·侵权必究
内容提要DeepSeek是一种基于Transformer的生成式A)(Artificial Intelligence)大模型,融合了MoE架构、混合精度训练、分布式优化等先进技术,具备强大的文本生成、多模态处理和仟务定制化能力。本书系统性地介绍了开源大模型DeepSeek-V3的核心技术及其在实际开发中的深度应用。全书分三部分。共12章,涵盖理论解析、技术实现和应用实践。第一部分从理论入手,详细解析了Transformer与注意力机制、DeepSeek-V3的核心架构与训练技术等内容,并探讨了ScalingLaws及其在模型优化中的应用。第二部分聚焦DeepSeek-V3大模型初步体验、开放平台与APP开发、对话生成、代码补全与定制化模型开发、对话前缀续写、FIM与JSON输出、函数回调与缓存优化。以及DeepSeek提示库等主题,帮助读者快速掌握关键技术的基础理论和落地实践。第三部分则通过实际案例剖析DeepSeek在Chat类客户端、AI助理、VSCode(Visual Studio Code)编程插件等多领域中的集成开发,展示了开源大模型技术在工业与商业场景中的全面应用。本书通过深度讲解与实用案例相结合的方式,帮助读者理解DeepSeek模型从原理到开发的完整流程,学习新技术的实现方法与优化策略,全面提升在大模型领域的理论素养与开发能力。本书适合生成式AI技术研
究者、软件开发工程师、数据科学家,以及希望快速掌握大模型技术并将其应用于实际场景的AI技术爱好者和高校师生阅读。
作者简介未来智能实验室(Future Intelligence Lab)曲多名国内顶尖高校的博士、硕士组成,专注于大模型的研发与创新,聚焦自然语言处理、深度学习、计算机视觉和多模态学习等领域。团队致力于推动AI技术的突破,并为企业和开发者提供全面的技术支持,助力复杂AI项目的高效开发与应用。团队成员拥有丰富的实践经验,曾参与国内知名企业的大模型设计与落地项目,涉及对话系统、智能推荐、生成式AI等多个领域。团队通过技术研发与方案优化促进大模型在工业界的落地,并助力智能化应用的普及与行业创新。代晶,毕业于清华大学,研究领域为数据挖掘、自然语言处理等。曾在IBM、VMware等知名企业担任技术工程师十余年,拥有扎实的技术功底与广泛的行业经验。近年来,她专注于大模型训练、自然语言处理模型优化等前沿技术,具备敏锐的行业洞察力,热衷于分享行业新动态,向大众提供更有价值的知识内容,帮助更多的人快速掌握AI领域的前沿知识。
前言生成式人工智能(Generative AI)近年来取得了革命性进展,凭借其在文本生成、代码生成、多模态处理等领域的卓越表现,正在重塑人工智能技术的核心框架。作为这一技术的代表性架构,Transformer以其自注意力机制和模块化设计奠定了生成式AI的理论基础。而基于Transformer的优化与扩展,DeepSeek通过混合专家(Mixture ofExperts.MoE)架构、FP8混合精度训练和分布式训练优化等技术,为高效处理大规模生成仟务提供了强大的支持。DeepSeek-V3是DeepSeek系列中的开源大模型之一,专注于文本生成、代码补全、多模态生成等仟务,广泛应用于对话系统、智能助理、编程插件等领域。其创新点在于通过ScalingLaws指导模型优化,并结合动态上下文窗口和稀疏注意力机制,显着提升模型在处理复杂任务时的性能与效率。本书围绕DeepSeek-V3展开,结合理论解析与实际应用,带领读者全面探索这一开源大模型的核心技术与实践价值。本书旨在为读者提供一份系统性的学习指南,从生成式AI的理论基础到DeepSeek-V3的技术架构,再到...