中国联通ChinaunicomDeepSeek洞察与大模型应用人工智能技术发展与应用买话联通数据智能有限公司史树明2025年
中国联通UnIAl元景大模型Chinaunicom目录ContentsDeepSeek介绍02中美在AI领域的现状及对比03主流大模型与AI工具04大模型的应用场景05大模型使用建议
DeepSeek公司概况中国联通元景大模型UnIAlChinaunicomDeepSeek是私募量化巨头幻方量化旗下的一家大模型企业,成立于2023年5月份幻方量化营收:作为中国头部量化对冲基金,曾管理资金规模超160亿美元(2019年),年管理费收入超过3亿美元。幻方/DeepSeek时间线幻方量化幻方AI2025.1R12025.1R1-zer2015.62016.102017年底201820212024.12v3成立幻方量化推出首个AI模型量化策略全A1化确立A(为核心量化破千亿规模的发展方向跻身量化“四大天王”2024.5幻万|人工智能黄deepseekFIREFLYER20192019202120222023.52024.1DeepSeekV1成立幻方AI萤火一号集群萤火二号集群美国管制高端GPU成立DeepSeek幻方人工智能基础500卡10000卡芯片出口杭州深度求索人工智能基础研究有限公司后增加1100加速卡A100萤火二号扩容翻倍技术研究有限公司2亿投资10亿投资
DeepSeek-V3中国联通UnIAlChinaunicom元景大模型DeepSeek-V3(对标GPT-40)于2024年12月26日推出,因其显著的性能,用户迅速开始增长Deepseek-V3仍是基于Transformer架构的模型,是一个强大的混合专家(MoE)模型,总共有671B个(a)auua3seg/Asumooy参数,生成每个token时激活37B参数8训练成木比Ilama405B低一个最级DeepSeek-V3所采用的技术:MLA多头潜在注意力机制(降低显存占用)。MTP多token预测(提升效果、提升推理速度FP8混合精度训练、DualPipe流水线MoE负载均衡(提升训练效率,降低训练成本)Pre0eeoSeek-3多项评测成绩超越了Owen25-728和Llans并在性能上和
DeepSeek-R1中国联通UnIAl元景大模型ChinaunicomDeepSeek-R1(对标GPT-01)于2025年1月20日推出,随后DeepSeek进一步出圈R1推出后,追平GPT-01,迅速出圈海外。从DeepSeek在美国下载排名从1月22日的201名,迅速在1月27日登顶第一名;截止1月30日,DeepSeek在168个国家位居下裁接第一名DeepSeek-R1-Zero:一种通过大规模强化学习(RV》训练的模型,没有监督微调(SFT)作为初步步骤。展示了卓越的推理能力。通过强化学习,R1-Zero自然而然地出现了许多强大而有趣的推理行为;但是,遇到了可读性差和语言混合等挑战DeepSeek-R1:为了解决这些问题并进一步提高推理性能,Deepseek团队引入了R1,它在RL2前结合]了多阶段训练和少量冷启动数据。R1在推理任务上实现了与OpenAl-01-1217相当的性能AIME2024CodeforcesGPQADaMATH-300MMLUSWE-benchVeritled
DeepSeek模型效果(1/2)2世界最顶尖模型的对比中国联通元票大模型ChinaunicomRankArena(StyleCtr1)ScoreDenini:2.0-Flash:Thinkiogs13845/-511949GoogleProprietaryEXP-01:21DeepSeek-V3和R1进入到国际顶尖模型行列Senint:R.9-PX0:E*p-92-0513799872GoogleProprietaryChatGPT-40:Jatest.(2025:DeepSeek-R1是综合效果最好的开源模型,1377+6/-68643OpenAlProprietary01:29)排在众多优秀的开源和闭源模型前面DeepSeek:R14196Genini:2.0-Flash:0017747GoogleProprietaryOwen2.5-Max.GLM-4-Plus.Step-293:2024:12:371352Proprietary16K-Exo等国产模型也有不俗的表现133533164OpenAlProprietaryQwen2.5-HaxAlibabaProprietaryDeepSeek:Y316456DeepSeekoGenini:2.0-Flash:Lite:Proprietary9/-67101Google8093:mini1387+8/-77177OpenarProprietary1GLN-4-Plus-011113048/-83713ZhipuProprietary75Step:2:16K-EXD5135StepFunProprietary大模型竞技场(Chatbot Arena LLM Leaderboard, https.//Imarena. ai/ ?leaderboard)更新日期:2025-2-11
DeepSeek模型效果(2/2)中国联通UnIAlchinaunicom元景大模型(Qwen2.5-72B-Inst)数学3中文2DeepSeek-V3和R1相对于700亿以下开源模型(以干问720亿数学2中文3为代表),多项能力明显提升,扩充了其能力边男DeepSeek-R1引入深度推理能力,在代码、数学、复杂规划等方面的能力显着增强,使得对于新场景的支持成为可能数学1英文1代码3英文2代码2英文3代码1
DeepSeek不同版本...