转写说明
本文基于已校验的公开原文进行结构化转写与事实梳理,非原文转载。 转写保留可核验的技术事实,并将工程建议与来源观点明确分开。
- 原作者: 全栈弄潮儿
- 原始来源: https://juejin.cn/post/7679222800792944691
- 原文发布时间: Sat, 29 Aug 2026 14:20:09 GMT
核心结论
AI 编程场景中,数据泄露的主要原因是开发者为便于 AI 分析而直接提交完整日志、配置文件或业务代码。必须保护三类信息:密钥与账号凭证、用户个人数据、未经授权的公司代码。删除对话记录或依赖工具隐私设置并不能防止已暴露的敏感信息被使用。
能力机制
敏感信息识别范围包括:数据库密码、云服务 Access Key 和 Secret Key、第三方 API Key、JWT 和 Session、SSH 私钥、个人身份信息(姓名、手机号、身份证号、银行卡号)、地址和订单信息、用户上传内容、核心业务规则、内部接口地址、未公开产品方案。
脱敏处理需达到使数据失去识别具体对象能力的程度。简单星号替换可能不足,完整订单、地址和时间信息的组合仍可定位个人。应删除解决问题不需要的字段,将时间改为相对时间或虚构值,地址精确到城市级别,金额使用测试金额,用户 ID 和订单号替换为无关联占位符。
快速开始
提交代码或日志前执行四步检查。第一步使用搜索命令检查敏感字段:
| |
第二步检查 Git 仓库的本次修改:
| |
第三步确认使用的账号类型(个人或公司)、对话是否被保存、是否开启代码用于模型改进、团队是否允许使用该工具。
第四步使用验证 Prompt 辅助检查,检查范围包括:密码和密钥、手机号和邮箱、生产环境域名和数据库地址、未公开业务信息。要求只指出敏感类型和位置,不复述敏感值,给出删除或替换建议。
适用边界
上述方法适用于代码片段、配置文件、日志输出、接口文档等可编辑文本。无法处理已提交的密钥泄露,删除聊天记录无法消除风险,必须立即禁用并轮换密钥。
AI 工具的存储和企业隐私策略并不完全相同,不能默认“不会保存”或“不会被使用”。公司安全制度和数据合规要求优先级高于工具隐私设置。不同工具的代码补全和仓库索引功能可能带来额外风险,需查看具体工具的当前隐私设置。
核验清单
发送代码或日志给 AI 前逐项确认:无密码、Token、Cookie 和私钥;无真实用户身份和联系方式;无生产数据库连接信息;无未经授权的公司核心代码;已删除与当前问题无关的内容;已确认 AI 工具和账号符合团队规定;已使用虚构数据验证提问是否足够;若密钥曾暴露,已完成轮换。
如密钥已泄露,应立即执行:禁用或轮换密钥、检查访问日志、确认异常调用或费用、从代码和提交记录中删除旧密钥、按公司流程报告安全事件、使用新密钥重新配置服务。
来源与核验
- 原始文章
- 页面事实以原始来源及其引用的官方资料为准;版本、星标和模型能力会随时间变化。
- AI Stack 不公开抓取到的全文快照,只发布独立转写与来源入口。