生成式AI暂行办法
用户跟AI聊的内容,能存多久、能拿去训练吗?
依据:《生成式人工智能服务管理暂行办法》
结论:该办法第十一条规定,提供者对使用者的输入信息和使用记录应当依法履行保护义务:不得收集非必要个人信息,不得非法留存能够识别使用者身份的输入信息和使用记录,不得非法向他人提供;并应依法及时受理和处理个人关于查阅、复制、更正、补充、删除其个人信息的请求。留存和对外提供都要有法律依据。
你可能要做的
- 梳理对话日志字段,标出可识别个人身份的部分
- 为每类输入信息确定留存期限与删除机制
- 关闭无必要的个人信息收集项
- 建立个人信息权利请求的受理入口与时限
- 明确日志对外提供的审批与法律依据
条文依据
《生成式人工智能服务管理暂行办法》 第十一条
提供者对使用者的输入信息和使用记录应当依法履行保护义务,不得收集非必要个人信息,不得非法留存能够识别使用者身份的输入信息和使用记录,不得非法向他人提供使用者的输入信息和使用记录。
《生成式人工智能服务管理暂行办法》 第十一条
提供者应当依法及时受理和处理个人关于查阅、复制、更正、补充、删除其个人信息等的请求。
一句话结论
用户输入了什么,不等于提供者就可以随便存、随便用。第十一条给提供者划了三个「不得」和一个「应当」:不得收集非必要个人信息,不得非法留存可识别身份的输入信息和使用记录,不得非法向他人提供;应当及时受理和处理个人的查阅、复制、更正、补充、删除请求。
依据
第十一条第一款把保护对象点得很具体:输入信息和使用记录。这两类数据在 AI 服务里是天然产生的副产品,很多人默认它们没有敏感性,实际上它们可能包含姓名、手机号、身份证号、health 相关信息、公司内部资料。
三个「不得」分别是:不得收集非必要个人信息;不得非法留存能够识别使用者身份的输入信息和使用记录;不得非法向他人提供使用者的输入信息和使用记录。注意「非法」二字——不是说绝对不能留存和提供,而是必须有法律依据。
第十一条第二款是个人权利响应义务:提供者应当依法及时受理和处理个人关于查阅、复制、更正、补充、删除其个人信息等的请求。这一条要求有入口、有时限、有处理结果反馈。
另外,第九条第一款规定涉及个人信息的,提供者依法承担个人信息处理者责任,履行个人信息保护义务。第十一条是这套责任在 AI 场景下的具体落点。
你要做什么
- 做一次数据地图。把系统里存的对话输入、生成结果、调用日志逐项列出,标注是否含个人信息、用于什么目的、保留多久。
- 每类数据都要有留存期限。没有期限的默认永久留存,最容易出问题。
- 精简采集项。只收集实现功能所必需的字段,手机号、身份证号这类信息要有明确用途说明。
- 对外提供(包括给关联公司、给供应商、给模型厂商做优化)前确认法律依据,并留存审批记录。
- 建立个人信息权利请求通道,公开受理方式,记录受理与处理时间。
- 对含敏感信息的输入做过滤或脱敏,避免直接落入日志。
容易踩的坑
- 日志默认永久保存。第十一条明确禁止非法留存,长期无差别留存缺少依据。
- 拿用户对话默认训练模型。这既涉及第十一条的留存与提供,也涉及第七条第三项的个人信息处理依据。
- 只删主库不删备份和日志。删除请求要覆盖全部副本。
- 权利请求靠客服口头处理,没有入口、没有记录、没有时限。
常见追问
用户输入的信息多久必须删除? 办法没有规定统一天数,要求是不得非法留存。落地做法是:结合业务必要性设定留存期限并对外告知,到期自动删除,删除操作留痕。
调用第三方模型API,输入信息传给厂商了,算非法提供吗? 要看是否具备法律依据、是否履行告知义务、厂商是否按约定处理。第十一条禁止的是非法提供,合规路径要能说清楚并留存协议与记录。
用户要求删除聊天记录,可以拒绝吗? 第十一条要求依法及时受理和处理。无正当理由不应拒绝,处理结果应当反馈并留存记录。
常见追问
- 把用户对话匿名化之后可以长期保存吗?
- 关键看是否仍能识别使用者身份。第十一条禁止的是非法留存能够识别使用者身份的输入信息和使用记录。去标识化后仍要评估重识别风险,并给出留存必要性说明。
- 用户请求查阅自己的信息,多久必须答复?
- 办法要求依法及时受理和处理。具体时限以个人信息保护法等相关法律的规定和属地网信办口径为准,企业内部应设定明确的服务时限并公开。
- 输入信息保护和使用记录保护是一回事吗?
- 第十一条把两者并列,义务标准一致。使用记录包括调用时间、功能、生成结果等,同样不得非法留存和非法提供。