一、 总则
1. 为规范本公司算法推荐服务及大模型算法的自评估工作,确保算法在设计、开发、上线及运行全周期中的安全合规,依据《互联网信息服务算法推荐管理规定》《生成式人工智能服务管理暂行办法》等法律法规及公司《算法安全管理办法》,制定本规定。
2. 本规定适用于本公司所有算法推荐服务、大模型生成服务及其相关算法的自评估活动,包括新算法上线前、重大版本变更前及在线运行算法的定期和专项评估。
3. 算法安全自评估遵循“全面覆盖、分层负责、客观审慎、闭环管理”原则,通过“业务自评 + 安全部门复核”双层机制,确保算法在机理、数据、用户权益、内容生态、科技伦理等方面的安全合规性,未通过评估的算法不得上线或须在规定期限内完成整改。
4. 算法安全自评估结果是算法上线、发布、持续运营的重要依据,与产品发布权限绑定。任何部门及个人不得强行上线未经评估或评估不通过的算法服务。
二、 组织与职责
1. 算法合规部是算法安全自评估工作的归口管理部门,履行以下职责:
(一)制定、维护并解释本规定,编制自评估清单、模板及判定标准;
(二)组织或参与重大算法的技术实测与合规核查,对业务部门提交的自评估报告进行复核;
(三)建设并运维自评估在线工作流系统,保障评估全过程留痕可追溯;
(四)将复核通过的评估报告呈报首席算法安全官签批;
(五)对评估发现的问题提出整改要求并跟踪闭环;
(六)保存自评估档案,定期向监管部门报告或备查。
2. 各算法业务部门作为自评估的执行主体,应履行以下职责:
(一)指定算法负责人,在新算法上线或重大版本变更前,主动发起自评估流程;
(二)从算法机理、数据使用、用户模型、内容生态、伦理合规等维度如实撰写自评估报告,提供技术文档、测试数据、影响分析等支撑材料;
(三)对在线运行算法按季度开展常规自评,并配合完成专项评估;
(四)针对评估发现的问题制定整改方案并限期落实,提交整改报告。
3. 首席算法安全官负责审核自评估报告及复核结论,拥有最终签批权。对存在严重安全风险、合规缺陷的算法,有权行使一票否决,暂停或终止相关算法的上线与运行。
4. 产品管理与技术管理部门应将自评估流程嵌入产品发布流水线,确保未获得首席算法安全官签发通过的算法版本,不得进入生产环境。
三、 自评估内容与要求
1. 算法自评估应至少覆盖以下维度,并结合算法类型、应用场景进行针对性深化:
(一)算法机理与安全设计:算法基本原理、模型架构、决策逻辑、可解释性及潜在风险分析,是否存在后门、漏洞、恶意代码或未声明功能;
(二)数据合规与质量:训练数据、微调数据来源合法性,数据治理流程,是否存在知识产权侵权、数据污染、代表性不足或偏见放大风险;
(三)用户模型与权益影响:用户画像构建方式、标签体系、个人信息利用合规性,是否造成算法歧视、信息茧房、用户选择权缺失,未成年人、老年人等特殊群体保护措施;
(四)内容生态与输出安全:推荐或生成内容的合规机制,涉黄、涉暴、涉赌、涉毒、虚假信息、侵权、违反广告法等内容的防控措施,大模型越权、伪造、违规AI标识等问题处置能力;
(五)科技伦理审查:算法公平性、透明性、向善性评估,是否涉及高风险领域(如人脸分析、社会决策辅助、精神健康干预等),以及对国家安全、社会秩序、公共利益的影响;
(六)安全保障措施:安全监测、应急响应、用户投诉、人工干预等配套制度的有效性自评。
2. 针对大模型算法,还必须增加以下自评项:
(一)防止模型被恶意诱导、越狱、注入的防护能力;
(二)生成内容的知识产权合规与标识添加情况;
(三)对用户输入和输出的双向安全过滤有效性;
(四)模型幻觉、错误信息生成的控制水平。
3. 自评估报告应包括但不限于以下材料:
(一)算法自评估表(按上述维度逐项作答并附证据);
(二)算法详细设计说明及架构图;
(三)训练数据集说明及合规证明;
(四)安全测试报告(含对抗测试、偏见测试、鲁棒性测试等);
(五)用户权益保护方案及影响评估;
(六)科技伦理审查意见(如适用);
(七)其他有助于说明算法安全合规的材料。
四、 自评估实施程序
1. 自评估分为以下三类:
(一)上线前自评估:所有新算法或发生重大版本变更(如模型架构调整、训练数据源更换、核心推荐策略变更、面向新用户群体等)的算法,须在计划上线日前至少15个工作日,由算法负责人发起并完成业务自评,提交至算法合规部复核。
(二)定期自评估:所有在线运行算法每季度进行一次全面自评估,于每季度末前完成,由业务部门自评、算法合规部抽检验收。
(三)专项自评估:遇重大舆情、用户集中投诉、监管通报、安全事件或公司认为必要时,立即启动专项自评估,不受排期限制。
2. 自评估实施流程如下:
(一)发起与填写:业务部门算法负责人在自评估在线工作流系统中填写《算法安全自评估报告》,上传佐证材料,确认自评结论。
(二)部门初审:业务部门负责人对自评报告真实性与完整性进行审核,同意后流转至算法合规部。
(三)安全复核:算法合规部安全合规岗对报告进行合规性审查,技术保障岗进行独立技术实测(可包括抽查数据集、复现测试用例、扫描代码安全等),形成复核意见。复核时限为接到申请后10个工作日。
(四)审核批准:复核通过的,由算法合规部负责人签署意见后,报首席算法安全官审批。对存在中等及以上风险项的,首席算法安全官可要求补充说明或退回整改。
(五)发布控制:自评估报告最终签批通过后,系统自动向产品发布系统发送准入信号,算法方可上线或发布。未获得准入信号的,系统禁止操作。
(六)定期/专项评估:定期评估由系统按计划自动启动任务,流程同上。专项评估由算法合规部手动发起,流程可依紧急程度适当压缩时限,但必须留存记录。
3. 自评估过程中发现的轻微瑕疵,可在业务部门承诺限期整改并经算法合规部认可后,有条件通过,但须在整改期内完成并提交验证报告;重大缺陷、高风险项须整改完毕并重新评估通过后方可上线。
五、 整改与处置
1. 对于自评估、复核中发现的安全隐患或合规缺陷,算法合规部应出具《算法整改通知书》,明确整改事项、期限及复验要求。
2. 责任算法部门须在收到通知书后5个工作日内提交整改方案,并在限定期限内(一般不超过30日)完成整改,提交整改报告及相关证据。逾期未完成或整改不达标的,算法合规部有权提出暂停算法服务、推迟上线、减少流量等处置建议,报首席算法安全官批准后执行。
3. 任何人若发现自评估材料存在弄虚作假、刻意隐瞒重大风险等行为,按《算法违法违规行为处置细则》从严处理;造成严重后果的,依法追究法律责任。
六、 记录与档案管理
1. 算法自评估全过程通过自评估在线工作流系统记录,确保每个环节的操作人员、时间、动作、结果完整可追溯。系统日志保存期限不少于算法服务存续期后三年。
2. 纸质或有形签批文件应同步归档,档案包括自评估报告、复核意见、首席算法安全官签批件、整改通知书及整改报告等,按项目建立独立档案卷宗,由算法合规部统一保管,以备内部审计和监管部门检查。
3. 自评估中涉及的商业秘密、个人信息等应按相关保密制度执行,严格控制知悉范围。
七、 附则
1. 本规定由算法合规部负责解释和修订。遇国家法律法规、标准变化时,应及时调整自评估内容和标准。
2. 本规定自发布之日起施行,以往相关要求与本规定不一致的,以本规定为准。
3. 本规定为公司内部核心管理制度,全体员工应严格执行。违反规定的,按照公司《算法违法违规行为处置细则》予以问责。