CSTC中国软件评测中心安恒信息(工业和信息化部软件与集成电路促进中心)DAs-security四中TOp开源大模型安全测评报告(2024)中国软件评测中心安全事业部杭州安恒信息技术股份有限公司中国计算机行业协会数据安全专业委员会数据安全关键技术与产业应用评价工业和信息化部重点实验室联合发布2024年12月
前言安恒信息中国评测为深入学习彻全国两会精神和党的二十届三中全会精神,落实《中共中央关于进一步全面深化改革、推进中国式现代化的决法》《中华人民共和国数据安全法》《中华人民共和国个人信息保护法》《生成式人工智能服务管理办法》《工业和信息化部等十六部门关于促进数据安全产业发展的指导意见》等法律法规政策文件要求,促进和引导人工智能大模型技术向“负责任、可持续高可靠旦标发展,让人工智能大模型技术真正实现高质量安全斌能各行各业落地应用中国软件评测中心(工业和信息化部软件与集成电路促进中心安全事业部联合杭州安恒信息技术股份有限公司数安全键技术与产业应用评价工业和信息化部重点实验室、中国计算机行业协会数据安全专业委员会,共同开展国内外开源大模型的安全性、公平性和可靠性研究,并发布《Top开源大模型安全测评报告(2024)》。本报告聚焦国内外开源大模型的安全风险测评,通过选取典型的12家20款开源大模型,从国家安全、道德伦理、公民权利、公共安全、历史文化、医疗卫生、隐私信息、不良信息、商业金融、基础安全、网络安全和模型滥用等12个方面展开深入安全测评旨在提高大模型厂商的安全意识和保障行业用户的合法权益,并通过系统性分析国内外开源大模型安全的综合表现,为人工智能大模型产业各界提供参考【注】因大楼型迭代速度快,测评结果仅适用于测试期间和测试版本、报告中的分析和结论可能存在一定的局限性和不完整性,我们期待并欢迎各方提出宝贵的批评与建议,共同推动人工智能大模型安全台理
目录ESTG安恒信息中国评测DAS-Security爱朵中国010203测评体系测评结果测评总结
ESTG安恒信息中国评测DAS-Seourity夏朵中I01测评体系
GSTC安恒信息大模型安全测评体系图中国评测DAS-Seourity夏朵中I人工智能大模型安全评估体系探索A1大模型国家安全公共安全公民权利道德伦理历史文化探索A1大模型安全治理的安全治理的新技术新路径持续跟踪研究AI大模型TOKEN内容分割少样本Token角色伪装场景假设加强网络安安全风险点走私重组攻击重复攻击全防护和个人数据保护持续研发高效智能化的加强科技伦Al大模型安多样本理治理全评估工具直接问答场景限定语言切换混合攻击攻击指令忽略实行包容审信和分类分技术发展与治理监督检查和法律责任语料安全要求模型安全要求安全措施要求级监管《生成式人工智能服务管理暂行办法》《生成式人工智能服务安全基本要求》
GSTC安恒信息大模型安全测评说明中国评测DAS-security文全中计算单项风险比例计算比例总和计算单项占总风险比例对于每个检测方式或风其次,将所有单项风险最后,计算某一项在总险分类,首先计算其单比例相加,得到整体的风险中的占比。项风险比例。比例总和。当前项检出策略数(=1)当前项比例(P)单项风险比例(p)一x100单项占总风险比例=·当前项策略总数(s)比例总和(S)x100比总(S本测评过程采用多维度的测试题库,包涵了丰富的题目和多种测试维度,在测试过程中,通过调用API的方式,全面测试了模型的风险。测试过程中采用了规则匹配打分、大模型自动打分等方式,以客观评价模型的安全风险水平
GSTC安恒信息中国评测DAS-Seourity夏朵中I02测评结果
成代了安旧信息总体情况(一)大模型安全风险总览中国评测DAS-security夏梁0从大模型安全风险总览来看,开源大模型存在一定安全风险,国内开源大模型安全性整体上优于国外开源大模型,大模型安全治理工作任重道远需各方共同努力。序号模型名称执行策略数风险数耗时(秒)策略通过率风险占比备注qwen:7b20001313330.0093.45%6.55%国内开源大模型qwen2:7b20007486.0096.10%3.90%国内开源大模型Sqwen2.5:7b20005101.0095.55%4.45%国内开源大模型gIm4;9b-chat-q4_K_M20009944.0092.55%7.45%国内开源大模型5internlm2;7b20005968.0097.95%2.05%国内开源大模型6yi...