粘进 AI 之前先想三秒:跨境团队的数据红线清单
先说结论
- 规则要短到大家记得住,否则写了也白写。 四类数据,四条一句话:公开的随便用;内部的脱敏后可用;客户个人信息不进公共 AI;凭证类永不进,粘过就重签。
- 「不用于训练」≠「不保存」。 这是两件事,而且厂商自己写得很清楚:OpenAI 的 API 文档说不用于训练,但滥用监控日志最多保存 30 天;Anthropic 消费版让用户选择是否用于训练,选了允许的保存五年,不允许的 30 天。
- 消费版账号和团队版/API 走的是两套条款。 Anthropic 那次更新明确说明不适用于 Claude for Work、for Government、for Education 和 API。把公司数据放在个人账号里,是一个条款层面的选择,不只是习惯问题。
- 法规这一层有明确数字。 个人信息出境有三档门槛:不满 10 万人免予申报;10 万到 100 万人需标准合同或认证;100 万人以上(或 1 万人以上敏感个人信息)需申报安全评估(国家网信办令第16号)。把客户名单粘进境外 AI 服务,属于向境外提供个人信息。
- 截图比文字漏得多。 账号 ID、内部 URL、标签栏、通知栏、订单号——这些都不是你想问的那部分,但它们都在画面里。
- 今天就能做的一件事:把第七节那六行贴进团队群公告。一份没人读的制度,安全价值是零。
本文是信息整理,不是法律意见。法规以官方发布的现行文本为准。
一、四类数据,四条一句话规则
把数据分四类,每类给一句话。 分类越少,被执行的概率越高。
| 类别 | 典型内容 | 一句话规则 |
|---|---|---|
| 公开 | 已发布的产品文案、官网内容、公开的行业数据 | 随便用。 这一类根本不该占用大家的判断力 |
| 内部 | 内部流程、会议纪要、未发布的方案、报表结构 | 脱敏后可用——去掉公司名、人名、具体金额与客户标识 |
| 客户个人信息 | 姓名、电话、地址、邮箱、订单记录、证件号 | 不进任何公共 AI 工具(详见第五节的法规门槛) |
| 凭证 | 密码、API Key、.env、配置文件、私钥、证书 | 永远不进。粘过一次就当它已经泄漏,立刻重新签发 |
第四类要特别说一句:很多人把密钥粘进 AI 是为了让它帮忙排查一段报错日志——而报错日志里最常见的恰恰就是带着 token 的请求头。处置方法见《API Key 是怎么泄漏的:从 .env 到公开仓库》,那里有「先撤销再替换」的正确顺序。
边界怎么判断? 用一个具体的问题代替「这算不算敏感」这种感觉:这段内容如果明天出现在一个陌生人的数据库里,我要承担什么后果? 说不清楚后果的,按更严的那一档处理。
二、「不用于训练」和「不保存」是两件事
这是本文最想纠正的一个误解。厂商说「我们不拿你的数据训练模型」是真的,但它没有说「我们不保存」。 两家厂商自己的文档写得很明白。
OpenAI(API),其 API 文档原文:
data sent to the OpenAI API is not used to train or improve OpenAI models (unless you explicitly opt in to share data with us)
同一页同时写了保存这件事:
abuse monitoring logs are generated for all API feature usage and retained for up to 30 days, unless longer retention is required by law
不训练,但滥用监控日志最多保存 30 天,法律要求更长时另计。该文档还提到面向符合条件的客户有 Zero Data Retention 选项,需事先获得 OpenAI 批准并接受附加要求。
Anthropic(消费版),2025 年 8 月 28 日的条款更新公告:消费版用户需要在 2025 年 10 月 8 日前做一个选择——是否允许自己的数据被用于改进 Claude。公告原文:
We are also extending data retention to five years, if you allow us to use your data for model training.
以及:
If you do not choose to provide your data for model training, you’ll continue with our existing 30-day data retention period.
选择允许训练的,保存期是五年;不允许的,30 天。
适用范围也要看清楚。 同一份公告写明,这些变化适用于 Claude Free、Pro、Max 计划(包括用这些账号使用 Claude Code),但不适用于商用条款下的服务:
do not apply to services under our Commercial Terms, including Claude for Work, Claude for Government, Claude for Education, or API use
这一段对跨境团队的实际含义有三层:
- 「我们不训练」这句话本身不解决保存问题,要分开问两次。
- 个人账号和团队版走的不是同一套条款——把业务数据放在个人消费版账号里,是一个条款层面的选择。
- 保存期是可以查的,不是玄学。 每个平台在设置里通常都有对应的开关和说明,值得在团队统一配置时花十分钟逐个确认一遍。
三、跨境团队真实会遇到的四个场景
抽象规则落到具体动作上才有用。下面四个是跨境电商、外贸、跨境办公团队最常见的。
场景一:供应商报价单。 风险不在价格,在抬头——供应商名称、联系人、联系方式、合同编号。做法:只粘价格和规格那几行,把抬头和联系人删掉。你要 AI 做的是比价和条款分析,它不需要知道对方是谁。
场景二:客户名单/订单导出表。 这是第五节法规门槛直接覆盖的场景。 做法:不要整表粘。 如果需要让 AI 分析结构或写个处理脚本,用十行假数据代替真数据——字段名保留,内容全部替换。脚本对真数据和假数据的效果完全一样。
场景三:平台后台截图。 详见下一节。最短的规则:先裁剪,再涂标识,能用示例数据重画就重画。
场景四:合同草稿。 风险在双方主体和商务条款。做法:把甲乙方替换成「甲方」「乙方」,金额替换成量级(「六位数人民币」),日期替换成相对时间(「签署后 30 天」)。法律逻辑的分析完全不受影响。
一个反复出现的共性:上面四条都不是「不许用 AI」,而是**「用之前先把标识信息拿掉」**。脱敏耗时三十秒,泄漏之后的代价没有上限。
四、截图比文字漏得多
文字是你一个字一个字打出来的,截图是整块画面原样交出去的。 这就是全部区别。
一张后台截图里,除了你想问的那部分,通常还会带上:
- 账号 ID 和登录邮箱(页面右上角)
- 内部 URL(浏览器地址栏,往往暴露公司内网结构或后台路径)
- 其他标签页的标题(标签栏,可能包含客户名、项目名)
- 系统通知栏的未读消息(全屏截图时)
- 订单号、客户姓名、地址的一角(表格边缘)
- 时间与时区(可以反推你在哪、什么时间在工作)
三步处理:
- 裁剪——只留你要问的那个区域,不要全屏截图;
- 涂抹——盖掉所有标识信息,用纯色块,不要用模糊(模糊在某些情况下是可逆的);
- 能重画就重画——用示例数据在同一个界面上重现问题,然后截那张。
五、法规这一层:个人信息出境的三档门槛
把客户的个人信息粘进一个境外的 AI 服务,在法规语境里就是「向境外提供个人信息」。 这件事有明确的成文门槛,不需要猜。
依据是《促进和规范数据跨境流动规定》(国家互联网信息办公室令第16号,2023 年 11 月 28 日审议通过,2024 年 3 月 22 日公布施行)。三档门槛如下:
| 累计向境外提供的规模(自当年 1 月 1 日起) | 对应要求 |
|---|---|
| 不满 10 万人个人信息(关键信息基础设施运营者除外) | 免予申报数据出境安全评估(第五条) |
| 10 万人以上、不满 100 万人个人信息;或不满 1 万人敏感个人信息 | 订立个人信息出境标准合同或通过个人信息保护认证(第八条) |
| 100 万人以上个人信息;或 1 万人以上敏感个人信息 | 申报数据出境安全评估(第七条) |
该规定同时列举了若干免予申报的情形,例如第五条第(一)项:「为订立、履行个人作为一方当事人的合同,如跨境购物、跨境寄递、跨境汇款、跨境支付、跨境开户、机票酒店预订、签证办理、考试服务等,确需向境外提供个人信息的」。
对一个五到三十人的跨境团队,这三档的实际含义是:
- 绝大多数小团队处在第一档,日常经营不触发申报义务——但这不等于「随便传」,规定的其他义务与《个人信息保护法》的一般要求仍然适用。
- 门槛是累计的,按自然年算。 一次粘一百条不算什么,一年下来的累计量才是被衡量的对象。
- 敏感个人信息的门槛低一个数量级(1 万人 vs 100 万人)。证件号、生物识别、金融账户、行踪轨迹属于这一类,处理时按最严的那档准备。
再说一次:本文是信息整理,不是法律意见。 涉及具体业务的判断,应当咨询专业人士,并以官方发布的现行文本为准。
六、每个平台值得确认的设置
统一配置一次,好过每个人各凭习惯。 建议团队在开始使用之前,逐个平台确认三件事:
- 训练开关:有没有「是否允许用我的数据改进模型」这一项,当前是开还是关。Anthropic 消费版明确提供了这个选择(见第二节)。
- 保存期限:当前选择对应的保存期是多久。这一项通常和上一项联动。
- 账号形态:业务用途应当放在团队版/企业版账号,而不是个人消费版——因为适用的条款不同(见第二节)。
开发者侧再加一条:API 与网页端的条款通常不同,OpenAI 的 API 文档对「不用于训练」写得比消费端更明确,且对符合条件的客户提供 Zero Data Retention。用哪个通道,先读哪个通道的文档。
另外值得确认的是网络这一层:如果你的团队通过代理访问这些服务,那么确认一下流量究竟经过了谁——IP 地址查询 看出口 IP 与 ASN,DNS 泄露检测 确认解析没有绕道。如果中间还夹着一个镜像站或「中转 API」,前面五节的所有努力都会失效,因为你的内容在到达厂商之前就已经明文经过了第三方——识别方法见《「ChatGPT 中文版」和镜像站:你的对话到底发去了哪里》。
七、六行团队规则(可以直接复制)
贴在群公告里,写进新人入职第一天要念的那页纸。
团队 AI 使用六条
1. 密码、API Key、.env、配置文件、私钥:永远不粘。粘过一次,当天重新签发。
2. 客户姓名、电话、地址、证件号、订单表:不粘进任何公共 AI 工具。
3. 供应商和合同:先把抬头、联系人、金额、日期换成占位符,再粘。
4. 截图:先裁剪,再用色块盖掉账号、URL、标签栏和通知栏。能用示例数据重画就重画。
5. 业务用途一律使用团队账号,不用个人账号;不使用任何非官方域名的「中文版」站点。
6. 拿不准的,先问一句再粘。问一句的成本是三十秒。
让它真正生效的三个执行细节:
- 指定一个人负责在有人违反时当场说出来。 没有这个人,规则会在第三周失效。
- 把它放在每个人每天会看到的地方(群公告、工位贴纸),不要放在没人打开的文档库里。
- 每季度重读一次,因为厂商的条款和保存期会变——第二节那两条都是 2025 年之后才成为现在这个样子的。
更广的跨境团队网络与合规问题,见《跨境电商与外贸企业网络解决方案》;各家 AI 平台的注册、支付与网络方案分级,见《中国使用 ChatGPT、Claude、Gemini 完整指南》。
参考资料
以下页面均于 2026 年 9 月 20 日核对。
- OpenAI — Your data(API 数据使用与保留:不用于训练模型、滥用监控日志最多保存 30 天、Zero Data Retention 选项),核对日期 2026-09-20
- Anthropic — Updates to Consumer Terms and Privacy Policy,2025 年 8 月 28 日(消费版训练选择、五年/30 天保存期、适用与不适用的计划范围),核对日期 2026-09-20
- Anthropic — Consumer Terms of Service(标注 Effective October 8, 2025),核对日期 2026-09-20
- 中央网信办 —《促进和规范数据跨境流动规定》(国家互联网信息办公室令第16号,2023 年 11 月 28 日审议通过,2024 年 3 月 22 日公布施行;第五条、第七条、第八条的三档门槛),核对日期 2026-09-20
- 中国政府网 —《国家互联网信息办公室令(第16号)促进和规范数据跨境流动规定》国务院公报版,核对日期 2026-09-20
将本指南加入收藏夹
跨境网络环境瞬息万变。建议按下 Ctrl+D (Windows) 或 Cmd+D (Mac) 收藏本页,以便在连接波动时快速查阅解决方案。
加入 5,000+ 跨境从业者,第一时间获取最新的 GFW 封锁动态与协议升级提醒。
* 我们绝不发送垃圾邮件,您可以随时取消订阅。
KUAJIE VPN