随着人工智能技术的飞速发展,大模型在各个领域的应用日益广泛。为了确保大模型的安全、可靠和合规,我国政府出台了一系列法律法规,对大模型实行备案制度。本文将详细介绍AI大模型备案清单,帮助企业了解合规要点,顺利完成备案流程。
一、备案背景与目的
1. 背景
近年来,生成式人工智能技术(如大语言模型)迅速崛起,为公众提供了丰富的智能服务。然而,这些技术在带来便利的同时,也引发了一系列安全问题,如误导用户、传播非法信息等。因此,国家出台了《生成式人工智能服务管理暂行办法》等法律法规,对大模型进行监管。
2. 目的
大模型备案的主要目的是:
- 事前风险管控,确保AI大模型在正式投入市场前已满足国家安全标准及合规要求。
- 有效预防潜在危害,构建安全可靠的人工智能生态。
- 促进人工智能技术的健康发展,为公众提供高质量的智能服务。
二、备案清单
1. 安全自评估报告
安全自评估报告是大模型备案的核心材料之一,需全面评估大模型在语料处理、模型训练、服务提供等环节的安全性。报告应涵盖以下关键内容:
- 评估方法:明确评估的自行组织或第三方委托方式,确保评估过程符合相关标准。
- 评估内容:详细列出语料安全、生成内容安全、问题拒答等方面的评估结果及证明材料。
- 评估结论:基于评估结果形成整体评估结论,确保模型的安全性符合备案要求。
2. 模型服务协议
模型服务协议是明确服务提供者和用户之间权利义务的法律文件,应包含以下内容:
- 服务范围:明确列出模型服务的具体内容,包括服务类型、服务期限、服务地域等。
- 双方权利义务:详细阐述服务提供者和用户各自的权利和义务,确保双方权益得到平等对待。
- 存储和传输方式,以及采取的数据保护措施。
- 其他条款:包括违约责任、费用和支付、服务变更和终止、争议解决、法律适用和管辖等。
3. 语料标注规则
语料标注是训练大模型的基础工作,其质量直接影响模型的准确性和可靠性。语料标注规则应包含:
- 标注细则:详细描述标注的具体规则和标准,包括词性标注、实体识别、情感分析、语义角色标注等。
- 标注流程:阐述标注的整个流程,从数据预处理、分配标注任务、进行标注、质量控制到最终的审核和修正。
- 持续改进计划:提出持续改进标注规则和流程的计划,以适应不断变化的语言使用和模型需求。
4. 关键词拦截列表
为有效过滤敏感信息,企业需制定关键词拦截列表,包括:
- 敏感词库:列举所有敏感词汇,包括政治、宗教、色情、暴力等。
- 拦截规则:详细说明如何识别和拦截敏感信息,确保模型输出内容符合法律法规和社会道德规范。
5. 其他材料
根据具体情况,企业可能还需提交以下材料:
- 企业法人营业执照副本复印件。
- 企业法定代表人身份证复印件。
- 研发团队人员名单及简历。
- 技术文档:包括模型架构、训练方法、性能指标及测试报告。
- 数据合规证明:数据来源说明、隐私保护协议、第三方数据使用授权文件。
- 安全评估报告:由认证机构出具,涵盖内容安全、算法偏见、漏洞检测等内容。
三、备案流程
- 准备材料:根据备案清单,收集并整理相关材料。
- 提交申请:企业需在线提交包含主体、算法与产品信息在内的完整资料。
- 审核材料:网信办将对提交的材料进行审核,确保模型和数据合规合法。
- 授予备案号:经审核合格后,网信办将授予备案号,企业可在其官网公示备案信息。
四、总结
AI大模型备案是企业合规运营的关键环节。了解备案清单和流程,有助于企业顺利完成备案,确保大模型的安全、可靠和合规。企业应高度重视备案工作,积极履行社会责任,推动人工智能行业的健康发展。
