面向审计行业DeenSeek大模型操作指南版本101适用对象:审计从业人员南京审计大学计算机学院大模型团队提供2025年2月8日
目录1DeepSeek基本概况...........................2.DeepSeek主要版.......3.DeepSeek审计能力......54.DeeoSeek部署方法..........................................41官方渠道4.1.1网页版使用........64.1.2手机版使用.842第三方渠道421硅基流动6年为......422纳米AI搜索................423阿里云...................104.24百度智能云..........114.2.5火山引擎1142.6其他平台........1243本地部............................12431下载ollama...1343.2合适版本安装......134.3.3输入安装代码。..................54.3.4测试部署模型.174.3.5部署非量化模型.185.DeepSeek审计助手.....................205.1基础操作场景.205.2审计工作辅助.......................215.3审计学习考试........225.4其他提示..........23
1.DeenSeek基本概况DeenSeek县由杭州深度求索人工智能基础技术研究有限公司(简称深度能对话、准确翻译、创意写作、高效编程、智能解题和文件解读等多种功能。其“深度思者"和"联网搜索"功能能够更全面地理解用户问题并提供准确答案。杭州深度求索人工智能基础技术研究有限公司公司成立于2023年7月17日、专注干开发先进的大语言模型(LLM)和相关技术。自成立以来,公司在2024年1月5日,发布DeepSeekLLM(深度求索的第一个大模型),目前DeepSeek-R1、 V3,Coder等系列模型已上线国家超算互联网平台。英伟达称,DeepSeek-R1是最先进的大语言模型,亚马逊和微软也接入DeepSeek-R1模型。DeepSeek大模型在多个基准测试中表现优异,尤其是在代码和数学任务上,超越了其他开源模型,其至与领先的闭源模型(如GPT4和Claude-35-Sonnet)不相上下。DeepSeek被业界认为“以高性价比著称的AI模型服务商”。原因是这家公司的出现极大地降低了大模型训练和应用的成本,如该公司开发的DeepSeek-V3训练成本仅557.6万美元,而OpenAl训练GPT-4所花费的成本高达7800万美元甚至是1亿美元,双方的成本相差至少10倍。DeepSeek-V3在数学、代码能力和中文知识问答方面还超过了GPT4,可以说是性价比超高。此外,DeepSeek团队只有139名研发人员,而开发GPT的OpenAl团队则有1200名研究人员。在审计领域,DeepSeek大模型能够帮助审计人员高效处理备类多源异构的审计数据、识别风险、提升审计质量:通过自动化的数据处理、智能化的风险识率。
2.DeepSeek主要版本目前,DeepSeek的核心版本主要有DeepSeek-V3, DeepSeek-R1,Janus Pro,表1中列出了这3个核心版本的特点和适用场景。表1DepSeek核心版本与适用场景模型版本发行时间模型大小核心能力适用场景示例通用自然语言处理(NLP),支持合同条款解析、政策法规DeepSeek-V32024-12-26671B长文本理解、多语言交互匹配、审计报告生成DeepSeek-R12025-1-20复杂逻辑推理,强化数学与财务数据分析、异常检测、671B代码生成能力风险建模DeepSeek Janu多模态(文本+图像+表格)票据识别、图表数据关联2025-1-287BPro理解与生成这三个版本原始模型权重已经在hugging face上开源,用户可以免费下载。国内使用可以通过其镜像(https:/hf-mirror.com/)获取。DeepSeek-V3和DeepSeek-R1的模型参数量较大,达到了671B,直接部署这两个模型需要1.3~-2TB(FP16)的显存支持(如128卡H100的集群)。为方便一般用户本地使用,DeepSeek团队使用Owen2.5和Llama3.3,以DeepSeek-R1为教师模型,蒸馏了6款小模型,包含15B~70B在内共有6个尺寸,如表2所示。蒸馏的模型基屋模型下载地址DeepSeek-R1-Distill-Qwen-1.5BQwen2.5-Math-1.5BHuggingFaceDeepSeek-Rl-Distill-Owen-7BOwen2.5-Math-7BHuggingFaceDeepSeek-Rl-Distil-Llama-8BLlama-3.1-8BHuggingFaceQwen2.5-14BHuggingFaceDeepSeek-R1-Distill-wen-14BQwen2.5-32BHuggingFaceDeepSeek-R1-Distil-1lama-70BLlama-3.3-70B-InstructHuggingFace
模型。单需要注意:无论是模型蒸僧还是量化,都会或多或少降低模型的能力3.DeepSeek审计能力(一)数据采集与预处理DeepSeek支持多种数据源的接入,包括财务系统、ERP系统和数据库等,确保数...