首页 > 生活 > 正文

反思!智谱ZCode数据上传事件的惨痛警示!

2026-09-20 16:26:46来源:市场资讯  

来源:传播星球APP

我愿意付钱让AI帮我写代码,不意味着我同意它把整个代码仓库打包带走。

此番智谱ZCode引发的数据上传争议,值得每一个正在使用AI的人关注。


(相关资料图)

今天被讨论的是程序员的代码仓库,可如果换一个工作场景,也可能是客户方案、采访记录、报价表和未公开的经营资料。

尤其在办公智能体和编程智能体流行的当下,当AI从一个聊天窗口变成能读取文件、操作电脑的助手,数据边界就容不得丝毫的模糊,也不能再靠用户自己猜。

先捋一下事实经过

9月18日,智谱就仓库数据上传问题致歉,解释称默认开启的Repo Wiki相关功能可能触发上传,并称相关问题已经修复,上传数据在页面生成后立即销毁,同时承诺开源和第三方审查。[1]

原始披露者ferstar随后也作出重要更新:网传313MB商业项目压缩包没有上传成功,另一个小型公开仓库则显示被服务端接收;其检查还发现,3.14.0版本已移除相关上传链路。[2]

翻译:

更新(2026-09-19):

补救情况:智谱已于 09-18 17:44 道歉。对最新发布的 3.14.0 版本进行逆向工程证实,repoSnapshot(仓库快照)上传管道已被物理移除,云端凭证接口现在返回 404。

未解决的问题:官方声称“在 Wiki 生成后立即销毁”,这与快照所宣称的“检查点回滚(checkpoint rollback)”架构相矛盾。此前上传的快照是否已被物理清除,外部无法验证。

澄清说明:那个 313MB 的商业仓库快照上传失败了 564 次,一直停留在本地待传状态;OpenWrt 流量日志证实它从未离开过局域网。另一个独立的 15KB 公共仓库快照确实被服务器接收了。

智谱的回应侧重于已经修复了当前的软件行为,但这与交代历史数据去向,是两件需要分别完成的事。传播星球认为,公众关心的是“我的哪些数据受影响”,厂商如果只回答“功能已经修好”,双方谈的仍不是同一个问题,仍需要进行沟通并让用户和公众知道进展。

真正需要追问的是:谁替用户作出了决定?

云端AI处理任务,通常需要接收相关输入。用户主动提交一段代码,请它分析错误,对这一数据传输有相对明确的预期。但读取当前任务需要的内容,与在后台打包仓库及历史记录,涉及不同的数据范围,也应当对应清楚的告知和选择。

不能因为用户打开了一个项目,就推定他接受这个项目的一切资料都被上传;也不能因为某项功能有助于改善体验,就默认用户愿意为此交出更多数据。产品设计不能把“方便实现”当成“理应获得授权”。

尤其值得警惕的是,用户面对隐私开关时,往往无法理解它究竟控制什么。关闭“优化体验”,到底是在拒绝训练、拒绝遥测,还是拒绝文件传输?如果几种行为分别由不同机制控制,界面就应当解释清楚。要求普通用户拆解客户端才能知道文件去了哪里,本身就是产品透明度的失败。

四个问题,不能混成一个答案。

配图为AI生成的信息示意图,用于区分核验问题,不代表已经发生训练或出售。

上传、留存、训练、共享或出售,是不同环节。发现上传,不能直接推断已经用于训练或出售;厂商承诺不训练,也不能让人自动相信没有上传、没有留存。

ZCode当前中文隐私政策称,优化计划默认关闭,用户主动加入前,不会将相关数据用于产品及模型训练与优化。这项承诺应该被准确交代,而它是否得到执行,需要与实际行为对照核验。[3]

同样,“已经加密”回答的是数据如何保护,不能替代用户同意。用户还需要知道谁掌握解密能力、谁有访问权限。“用完即删”则需要说明删除发生在哪些系统,是否涉及备份、缓存和衍生内容。一个笼统的安全表述,无法回答这些具体问题。

“是不是钓鱼”,不能成为转移问题的捷径。

围绕向智谱发函的太原承明科技有限公司,出现了关于其动机的猜测。公开报道转述了该公司的追责诉求,但目前尚没有足以证明它故意设局、伪造证据的可靠材料。发函方声称哪些资料受影响、造成多大损失,也仍需证据支持,不能仅凭一封函件就全部认定。[4]

即使有人刻意测试软件,只要没有篡改客户端、伪造日志,或者主动授权被质疑的上传行为,测试动机也不能替产品机制免责。是否存在真实损失可以继续核实,默认行为是否越过用户预期也应独立审查。两件事不必捆绑站队。

恢复信任,需要给出可以核对的结果

传播星球认为,厂商至少应当说明受影响的版本和时间范围,让用户查询哪些资料被上传;交代接收方、用途、保存期限以及历史数据处置结果;让审查覆盖争议旧版及服务端处理流程。智谱事后的开源表态值得欢迎,但只公开修复后的客户端,无法单独证明云端历史数据已经删除。

产品也应提供真正可理解、可执行的选择:可选的整库上传默认关闭,传输前说明范围,允许排除敏感目录,让拒绝额外数据用途的用户仍能使用基本服务。安全不该只写在长篇协议里,更应体现在每一个默认选项中。

对于采购AI服务的企业,评估表也该增加几栏:除了生成质量、速度和价格,还要问清数据流向、删除机制、访问权限和异常通知流程。不能因为工具进入团队时只是一次个人试用,就让它长期游离于内部资料管理之外。企业是否允许上传某类资料,应当提前形成清楚的规则。

用户同样需要调整习惯:敏感任务放在隔离环境,只开放必要目录;客户资料先脱敏;对可能外传的有效密钥及时轮换;发现异常时保留版本、时间和日志,避免尚未查清就删掉证据。这些措施不能替厂商卸责,却能减少我们对一句承诺的被动依赖。

AI越能干,授权越要具体。我们当然需要更便宜、更好用的工具,也需要随时知道自己的资料去了哪里。

核验截至2026年9月20日。本文依据公开披露、政策和报道撰写,未独立运行涉事客户端复现;未将发函方的全部主张认定为事实。

标签:

责任编辑:hnmd003

相关阅读

资讯播报

推荐阅读