中泰证券ZHONGTAISECURITIES计算机证券研究报告/行业点评报告2025年02月09日评级:增持(维持)报告摘要三个模型:纯强化学习复现01能力,引发新一轮革命。DeepSeek由幻方量化创立创始人为梁文峰2024年12月,DeepSeek-V3发布,性能对齐海外领军闭源模分析师:孙行臻型,2025年1月,以V3为基座,衍生出强化推理版R1Zen+泛化推理版R1,谁能执业证书编号:对标OpenAl-01正式版Emall: sunxz@zts.com.cn两大贡献:1)捅破强化学习用于,DeepSeekR1是继openAlo1之后,推理的第二个里程碑2根据DeeoSeek公开的数据,按照1张H800每小时2美元的租赁成本算,V3预训基本状况练成本只有557.6万美金,用1万张H800只需要11天就能训练宠,仅使用不到110上市公司数337的成本就达到了国际上领先模型的表现,这对当前我国突破算力卡脖子限制具备重要行业总市值(亿元)44,199.2138,242.67具备较高的基座模型能力。ero模型直接应用RL到基础模行业-市场走势对比1泛化推理模型,通过深没有奖励思维链长度的情况下,自发为态调整的ExpertBias,只影响计算和通信完全重叠,显着减少了L23)内存优化:启用上采用组相对策略优化(GRPO)无需单独的价值模型、采用基于组相关报告增强了模型的数学推理能力。开源了原生FP8权重,公开深度思1)模型侧:scalinglaw没有失基座模型仍需云上算力来送《中电科核心资产盘点-—重点央企资产盘点系列(一))2024-10-30支持访问;3)端侧:应用场景hOnvOSNEXT小艺助手接入东方中科、诚迈成本高性能AlAgent与座能打造差异化竞争优势,建议经纬恒润、中科创达、光庭AAgent集合,提升智能家居用户体验,,并具备品牌优势和壁垒,通过模同时凭借Deepseek的更低推理成本,未来有望实现建议关注:合合信息、金山办公、同花顺、万兴科技、中望软增收又增利。件等中华为昇肉通动力、烽火通信、神州数码以及相关配套硬件厂商:中科院算力产业务风险提示:技术迭代不及预期的风险;市场竞争加剧的风险;人才流失风险的风险;请务必阅读正文之后的重要声明部分
中泰证券行业点评报告ZHONGTAISECURITIES内容目录三个模型:纯强化学习复现01能力,引发新一轮革命....11基因根植+加速进代,DeepSek正式出图1.2三个模型:以V3为基座,衍生强化推理版R1-Zero+泛化推理版1R1两大贡献:发现01强化学习效果十实现有限算力的算法创新…..三、九大剑新:模型创新+系统优化+商业模式开蹶.............7行业影响:重心向推理侧迁移....11投资建议...................3风险提示.......18图表目录332025年1月AI应用全球日活总榜其他代表性模型的比较。训练时间计算上均平稳提升推理相关基准测试中的比较。上的平均响应长度向块中重叠计算和通信......委合中上一轮对话生成的上下文缓存。,后续具有和同前级的请求会命中上下文级.序…一步向“后训练、推理侧、自主智能体”偏移图表19微软和Meta或计划加大A资本支出(十亿美元)…DeepSeek-V3的训练成本相比其对标模型训练成本大幅降低.…..图表20:因表21:DeepSek-R1在推理成本方面展现出显著优势…图表22:接入DeepSeek相关标的合作及涨幅汇总…请务必阅读正文之后的重要声明部分
中泰证券行业点评报告一、三个模型:纯强化学习复现01能力,引发新一轮革命1.1基因根植+加速迭代,DeepSeek正式出图幻方量化创立,创始人为梁文峰。DeepSeek成立于2023年5月,由量化巨头幻方量化创立,其创始人梁文峰在量化投资和高性能计算领城具有深厚的背景和丰富的经验2024年成为全球最强开源通用MoE模型性能对齐海外领军闭源模型性能对标OpenAl-01正式版。圳结阶段大规模体用了强化学习技术,龙仅有机少标.极大提升了模型推理能力。同时DeepSeek开源R监理模型,允许所有人在遵循MITLicense的情况下,蒸馏R1训练其他被2000万。DeepSeek应用于2025与热情,上线20天全球日活就突破2000超过总包的日活用户1695万,2)上线仗210苹果应用商店157个国家/地区的第一名,MAU月浩多的前5国家为:中国30.71%,印度13.59%,印尼6.94%,25M1国内数据:1)豆包第一7861万MAU、DeepSeek第二3370万MAU.Kimi第三1943万MAU、文小言第四1305万MAU,MAU数据不包括接入DeepSeek的C端应用和模型云服务平台(纳米A)搜索。秘塔AI搜索、硅基流动x华为云)。DeepSeek...