你跟AI聊的客户名单,可能正躺在搜索引擎里
8月初,安全圈爆了个挺扎心的消息:有研究者发现,某主流大语言模型的对话内容,在没有做脱敏处理的情况下,被搜索引擎的爬虫抓取并收录了。换句话说,员工在AI对话框里随手贴的客户项目代号、业务方案、内部数据,可能第二天就被任何人在搜索框里敲几个关键词搜出来。
我有个客户的HR,前阵子想"偷个懒",把一份含几十个候选人身份证号和电话的表格粘贴进AI,让它"帮我筛一下匹配度"。她没恶意,就是图快。可那张表一旦进了对话、被缓存、再被搜索引擎索引,等于把几十个人的隐私直接摊在了阳光下。
◆问题拆解:怪不到员工头上,但风险是实打实的
AI工具确实好用,写方案、改文案、分析数据,效率翻倍。但现在的问题是三块短板叠在一起:
第一,没人给员工画红线。合同、报价单、客户清单、源代码、未公开的财报,这些到底能不能进AI?多数企业一句话都没说过。员工全凭自觉,而"自觉"在赶进度面前基本靠不住。
第二,传统数据防泄漏(DLP)管不到"网页版AI"。员工打开浏览器,把敏感内容Ctrl+C、Ctrl+V进一个SaaS对话框,数据就从公司终端流向了外部。老式DLP盯着U盘和邮件,对这种"粘贴到网页"的行为常常视而不见。
第三,风险形态变了。早些时候业内讨论的是"代码被喂进AI训练集"——那是训练环节的问题。现在更直接:业务对话被搜索引擎公开收录,谁都能搜到,危害是即时的、公开的,不用等什么暗网交易。
◆解决办法:AI该用还得用,关键是套上缰绳
拦着不让用AI,是反人性也反效率。把那股劲儿套上缰绳就行:
先立规矩:明文规定哪些数据绝对不能进AI(客户PII、财务、源代码、未公开方案),哪些可以、但得先脱敏。进AI前先脱敏:用占位符替换真实姓名、金额、编号,让AI帮上忙,又不交出真东西。
终端DLP兜底:上邦的终端管控能识别敏感内容——身份证号、客户名单、合同关键词——当员工试图把这些信息复制到网页AI、云盘或外部邮箱时,直接拦截并告警,把"手快"变成"手被拉住"。
全程留痕:谁、在几点、把什么内容发去了哪个AI工具,屏幕动态水印加操作审计,出事能查、能追责、也能拿来做一次不那么尴尬的安全培训。
◆实际价值:一次拦截,可能挡掉一场官司
这一层管控值多少钱?一次成功的拦截,可能避免的是千万级的客户资源外泄,或者一场商业机密诉讼。对老板来说就一句话:AI要鼓励用,但得画条线——线内随便飞,线外有人拽。
说到底,那些把机密贴进AI的人,大多不是坏人,是想把活儿干漂亮的好员工。问题从来不在人想偷懒,在于公司既没教过、也没拦过。上邦做终端安全这些年,最在意的不是卖多少套系统,而是让老实干活的人不被工具坑、让老板能睡个踏实觉。技术永远替代不了人的判断,但好工具能帮人少犯那点傻。