大模型备案最难材料搞定——安全评估报告、安全评估测试题【评估测试题+备案源文件】

大模型备案,最难搞定的2个材料,安全评估报告,安全评估测试题、拦截词,这里都有了

文章目录

(一)适用主体

(二)语料安全

(三)模型安全

(四)安全措施要求

(五)词库要求

(六)安全评估要求

(七)附录大模型备案材料源文件

2024年3月1日,我国通过了《生成式人工智能服务安全基本要求》(以下简称《AIGC安全要求》),这是目前我国第一部有关AIGC服务安全性方面的技术性指导文件,对语料安全、模型安全、安全措施、词库/题库要求、安全评估等方面提出了具体规范和要求。

(一)适用主体

《AIGC安全要求》的适用主体包括两类:

1. 生成式人工智能服务

定义:利用生成式人工智能技术向中华人民共和国境内公众提供生成文本、图片、音频、视频等内容的服务。

其中,需要特别关注,如何认定“向境内提供服务”的范围。根据企业的实务场景,我们理解需要“从宽”去定义上述概念,包括网页端的地区选项设置有“中国”的选项、网页或产品说明提供中文选项、支付方式包含有支付宝、微信选项、注册方式允许中国手机号码等,都可能会被认定为向中国境内提供服务。

2. 服务提供者

定义:以交互界面、可编程接口等形式提供生成式人工智能服务的组织或个人。

根据《AIGC安全要求》,个人也可成为监管对象。只要是以交互界面、可编程接口等形式提供服务,无论是组织还是个人,都符合“服务提供者”的定义。

(二)语料安全

《AIGC安全要求》针对语料安全,在语料来源授权合法、安全评估核验、不良语料类型三个方面提出了重点要求,具体要求包括:

1. 授权合法

语料的来源需要有合法的、明确的授权,确保其符合“授权、同意、告知”的合法性原则。根据语料的来源属性分类,具体的要求梳理如下:

语料来源

含义

合规要求

开源语料

是训练数据的主要来源,指开放的,任何人得以获取的语料

应具有该语料来源的开源许可协议或相关授权文件,建议重点关注:

(a)Robots协议;

(b)协议明确“个人已拒绝授权采集的个人信息”。

自采语料

是指自行生产或直接从互联网采集的语料

应具有采集记录,不应采集他人已明确不可采集的语料

商业语料

是自采语料的对应概念,指通过与第三方语料提供方进行交易获得的语料

应有具备法律效力的交易合同、合作协议等,且当交易方或合作方不能提供语料来源、质量、安全等方面的承诺以及相关证明材料时,不应使用该语料,这就要求相关方对交易方或合作方所提供的语料、承诺、材料进行审核

使用者输入语料

是指将使用者输入的信息作为语料

应具有使用者授权记录

2. 安全评估与核验

对于采集的语料,需要严格控制违法不良信息的比率。语料采集前,需要进行针对违法不良信息进行安全评估,采集后输入语料库之后需要进行再次核验。

具体而言,如采集前评估得出违法不良信息超过5%,则该来源不得被采集;如若采集后核验违法不良信息超过5%,则该来源不得被使用。虽然两步走的设置看似天衣无缝,但从部分企业的尽调结果来看,相应管控和筛查的工作目前仍未到位。语料安全作为生产资料的重要组成部分,评估不当很可能导致紧随其后的产品研发环节就出现问题。

除此以外,还需要遵循在内容过滤、知识产权、个人信息、标注安全等方面的合规要求:

*图示:语料来源合规要求

因此,企业需要在首次安全评估之后保持对语料来源的持续敏感度。并在之后的操作处理中进行持续性的内容过滤,采取关键词、分类模型、人工抽检等方式过滤违法不良信息。对于涉及知识产权和个人信息的语料,还应当设置专门的负责人和管理策略,在使用之前注意该语料是否存在侵犯他人权利的情况,并与相关方提前协商,告知有关风险或取得其授权同意,并取得正式性的记录文件;要求语料提供方提供语料来源、质量安全等承诺以及相关证明材料并进行审核。

3. 不良语料类型

对于具体需要规避的语料类型,《AIGC安全要求》附录A列举了涉及语料及生成内容安全的类型,共分为5类31种,制定了特别的安全需求:

*图示:不良语料类型

需要特别关注的是,本次不良语料类型特别提出了针对“特定服务类型”的安全需求。

例如,针对医疗建议类的算法和问答建议,当前不少医疗健康产品和服务当中,开发了智能健康管家等功能,涉及根据用户的健康分析报告,提出对应的诊疗分析、用药建议等,对于这一类功能,需要特别谨慎对待其是否可能出现非专业性、误导性的用药和诊断结论,否则可能导致“无病呻吟”或“病急乱投医”的情况。

例如,针对金融投资建议类的算法和分析建议,需要遵循银行、保险、金融等方面对于投资者、投保人的合法权益保护,避免违反相关的监管规定,为了业务竞争而向投资者、投保人等通过AI作出涉及不正当竞争、违反金融风险管控的分析或违规引导。

(三)模型安全

除语料安全外,模型安全也是AIGC服务或服务提供者应当考虑的重要因素。提供者不仅应当在其服务过程中,提供安全、稳定、持续的服务,保障用户的正常使用;如若需要基于第三方基础模型提供服务,提供者还必须使用已经主管部门备案的基础模型。

*统计:截至2024年5月通过网信办备案的算法模型情况

而针对AIGC模型产出的内容,也应从内容的安全性、准确性和可靠性三个角度予以关注:

首先在安全性方面,《AIGC安全要求》规定应当对每次对话使用者输入的信息进行安全性检测,引导模型生成积极正向内容,并建立常态化检测测评手段,针对发现的安全问题及时整改;其次,在准确性方面,应采取技术措施提高生成内容响应使用者输入意图的能力,以及生成内容与科学常识和主流认知的符合程度;最后,在可靠性方面,也应采取技术措施提高生成内容格式框架的合理性和有效内容含量。

(四)安全措施要求

在适用模型和输出内容的过程中,AIGC相关主体还应当满足《AIGC安全要求》对于“模型适用安全措施”的规定,及时建立起与技术安全要求配套的技术措施、管理措施和相应保护措施。

1. Opt-out功能

其中,需要重点关注的是“Opt-out”机制的建立要求。不同于我国目前一般采用的“Opt-in”机制(即用户自主选择是否提供信息,不得默认设置为提供),当前在AIGC的信息输入节点,仅要求提供显著的、便捷的供使用者关闭信息输入的路径即可,需要保障使用者可以随时方便关闭信息输入的功能。

2. 供应链安全

在全球化的贸易背景下,包括GPU芯片在内的半导体技术已成为科技领域的核心竞争力。GPU芯片涉及AI模型训练、数据中心、智能交通、游戏等多个下游行业,这些芯片根据应用场景又细分为云端芯片和终端芯片,其中终端芯片广泛应用于嵌入式系统、移动设备、智能制造和家居智能等细分领域。

因此,在《AIGC安全要求》中,重点突出了芯片、软件、工具、算力等方面在供应链安全方面的合规要求,也是对于中国企业在采购、研发、使用、出口相关服务和产品的同时,需要从业务连续性、稳定性的角度,做好对供应链方面的风险排查,避免因对于业务所在国家地区管制规则要求的不熟悉而引发市场准入,甚至是直接影响业务的风险。

(五)词库要求

《AIGC安全要求》在词库方面要求设立关键词库、生成内容测试题库、拒答测试题库和分类模型等。其中,关键词库的总规模不少于10000个关键词,且关键词库应至少覆盖《AIGC安全要求》附录A.1以及A.2中的17种安全风险,附录A.1中每一种安全风险的关键词均不宜少于200个,附录A.2中每一种安全风险的关键词均不宜少于100个。这些模型对于语料内容过滤,生成内容安全评估等,应完整覆盖本文件附录A中全部31种安全风险。

(六)安全评估要求

针对最后一项安全评估要求,《AIGC安全要求》第九章内容对评估的方法、语料评估、生成内容评估和问题解答评估都作出了规定,这也是对于《AIGC暂行办法》的细化。

评估方法论层面,可以由服务提供者自行开展,也可委托给第三方评估机构;对于符合的评估结果应保存充分的证明材料,对于不符合的应说明不符合或不适用的原因并对后续改进措施进行计划说明;对于最后形成的评估报告,除了应有各项和总项的结论之外,还应有3位以上负责人签字。

而对于细化层面的安全评估,《AIGC安全要求》确立了如要求语料安全评估的人工抽检和技术抽检的标准,生成内容安全评估的人工抽检、关键词抽检和分类模型抽检的标准,以及问题拒答评估的应拒答测试题库和非拒答测试题库的标准等。

*图示:AIGC安全评估要求

(七)附录、大模型备案材料源文件

大模型备案材料——提交至网信办

大模型备案&算法备案参考材料

本文来自互联网用户投稿,该文观点仅代表作者本人,不代表本站立场。本站仅提供信息存储空间服务,不拥有所有权,不承担相关法律责任。如若转载,请注明出处:http://www.xdnf.cn/news/1543198.html

如若内容造成侵权/违法违规/事实不符,请联系一条长河网进行投诉反馈,一经查实,立即删除!

相关文章

Java_Se 数据变量与运算符

标识符、变量、常量、数据类型、运算符、基本数据类型的类型转换等。这些是编程中的“砖块”,是编程的基础。要想开始正式编程,还需要再学“控制语句”,控制语句就像“水泥”,可以把“砖块”粘到一起,最终形成“一座大…

2024年图纸加密防泄密软件Top10榜单 | 防止CAD图纸泄密打造坚不可摧的图纸安全

在当今数字化高速发展的时代,图纸作为重要的知识产权和商业机密,其安全问题备受关注。 一旦图纸泄露,可能给企业和个人带来巨大的损失。 为了保护图纸的安全,各种加密防泄密软件应运而生。下面为大家揭晓2024 年图纸加密防泄密软…

修复 msvcr120.dll 丢失的方法,总结几个靠谱有效的方法

1. msvcr120.dll 定义 1.1 Microsoft Visual C Redistributable Package 的一部分 msvcr120.dll 是 Microsoft Visual C 2013 Redistributable Package 的核心组件,该包为运行时环境提供了必要的库文件。它确保了使用 Visual C 2013 编译的应用程序能够在没有开发…

想在产品上扩展大储存怎么做?开源啦!

相比伙伴们都遇到过,芯片内存不够的问题:经常会有大量的照片、音频、文档等需要存储,怎么办呢? 我们知道可以外扩,要编写各种驱动,还有Flash替换,这个工程不可谓不大啊! 但&#x…

Spring中的容器接口

容器接口 首先了解一下BeanFactory和ApplicationContext这两个接口的关系。 其实在一个 SpringBoot 项目中,这个 SpringBoot 项目的启动类的返回值就是一个 ApplicationContext 接口的实现类。 然后在 IDEA 中选中这个类,按住ctrlaltU可以查看类图&…

JavaScript 安装库npm报错

今天在编写JavaScript代码时,缺少了包express。 const express require(express); const app express();app.get(/, (req, res) > {res.send(Hello, world!); });app.listen(3000, () > {console.log(Server is running on port 3000); });npm install exp…

小程序开发设计-小程序的宿主环境:组件⑦

上一篇文章导航: 小程序开发设计-小程序的宿主环境:宿主环境简介⑥-CSDN博客https://blog.csdn.net/qq_60872637/article/details/142425131?spm1001.2014.3001.5501 注:不同版本选项有所不同,并无大碍。 1.小程序中组件的分类…

深度学习(1):基础概念与创建项目

文章目录 基础概念创建项目1.在Anaconda上创建序虚拟环境2.创建PyProject3.创建完成 基础概念 CPU(中央处理器) CPU 是计算机的核心部件,负责执行计算和逻辑操作。它按照指令序列进行任务处理,擅长处理串行任务。CPU 的性能直接…

【MyBatis 源码拆解系列】MyBatis 运行原理 - 读取 xml 配置文件

欢迎关注公众号(通过文章导读关注:【11来了】),持续 分享大厂系统设计! 在我后台回复 「资料」 可领取编程高频电子书! 在我后台回复「面试」可领取硬核面试笔记! 文章导读地址:点击…

Nature:科研论文中正确使用ChatGPT的三个原则

我是娜姐 迪娜学姐 ,一个SCI医学期刊编辑,探索用AI工具提效论文写作和发表。 美国科罗拉多大学安舒茨医学院的生物医学信息学研究员Milton Pividori,一直在探索如何将ChatGPT等AI工具该技术融入课题组日常科研任务,例如进行文献综…

远程升级不成功?背后“凶手”可能是模组差分包…

最近有客户反馈在乡村里频繁出现掉线的情况。通过换货、换SIM卡对比排查测试,发现只有去年某批采购的那批模块在客户环境附近会出现掉线的情况,而今年采购的模块批次就不会掉线,很奇怪。 这个出问题的模块,就是合宙4G-Cat.1低功耗…

01.前端面试题之ts:说说如何在Vue项目中应用TypeScript?

文章目录 一、前言二、使用Componentcomputed、data、methodspropswatchemit 三 、总结 一、前言 与link类似 在VUE项目中应用typescript,我们需要引入一个库vue-property-decorator, 其是基于vue-class-component库而来,这个库vue官方推出…

数据驱动农业——农业中的大数据革命

橙蜂智能公司致力于提供先进的人工智能和物联网解决方案,帮助企业优化运营并实现技术潜能。公司主要服务包括AI数字人、AI翻译、埃域知识库、大模型服务等。其核心价值观为创新、客户至上、质量、合作和可持续发展。 橙蜂智农的智慧农业产品涵盖了多方面的功能&…

静态链接和动态链接的Golang二进制文件

关注TechLead,复旦博士,分享云服务领域全维度开发技术。拥有10年互联网服务架构、AI产品研发经验、团队管理经验,复旦机器人智能实验室成员,国家级大学生赛事评审专家,发表多篇SCI核心期刊学术论文,阿里云认…

抖音截流神器发布:不限量评论采集,实时推送,提升运营效率

在短视频风靡的今天,抖音成为品牌营销的新战场。如何在海量内容中脱颖而出,提升运营效率成为关键。本文将揭秘一款革命性的抖音运营工具,它不仅支持不限量评论采集,还实现了实时推送功能,助力运营者精准把握用户反馈&a…

保姆级 Stable Diffusion 教程,看完这篇就够了!

在美国科罗拉多州举办了一场新兴数字艺术家竞赛,一幅名为《太空歌剧院》的作品获得“数字艺术/数字修饰照片”类别的一等奖,神奇的是,该作品的作者并没有绘画基础,这幅画是他用 AI 生成的。 这让人们充分见识到AI 在绘画领域惊人的…

Shell实战(一)

Shell实战(一) 导语程序实例解压缩交互功能描述代码和运行结果实现解析 监视CPU和内存功能描述代码和运行结果实现解析 用户管理功能描述代码和运行结果实现解析 总结 导语 本篇引入三个书上的shell程序设计项目,由于书上的版本较老&#xf…

异构AI算力资源池:智能世界的新型基础设施

随着人工智能技术的飞速发展,AI应用对计算资源的需求日益增长。然而,传统的同构计算资源池无法满足AI应用对计算能力、能耗和成本的多样化需求。为此,异构AI算力资源池应运而生,成为未来智能世界的重要基础设施。 背 景 人工智能…

H3C交换机手动释放DHCP地址

原本的的配置,释放时间10天 导致所有的地址都被使用完 释放了地址池的地址 重新调整了超期时间为8小时