研究ai怎么用、怎么赚

智谱ZCode被曝私自上传用户代码库,锅在harness不在GLM @卓哥投研笔记

“私传用户数据事件”对智谱影响有多大

神吐槽 · 本站解读这篇最值得拎出来的判断是:出事的是 harness(编程外壳),不是模型本身。用户在 ZCode 里换用 DeepSeek、Claude,数据照样被上传——把锅扣到 GLM 头上,是找错了责任主体。

更深一层看,真正的损失不在 ARR:git 历史没有训练价值,但程序员使用过程中产生的“轨迹数据”有。一旦程序员集体弃用,智谱丢的不是当期收入,而是下一代模型进化的燃料。

本文并不是想为智谱洗,我的确通过一级市场持有一部分智谱上市前的股票,但老粉也知道,我之前骂智谱也很凶。本分只是想客观分析下,上传代码库这个事件会对智谱有多大影响,抛砖引玉,让懂哥懂姐们来指正。

ZCode 静默上传了整个代码库

ZCode是程序员们写代码的软件工具,跟CodeBuddy、Trae、Claude Code一样,都是harness。本次事件跟GLM大模型没有半毛钱关系,凶手只有一个,就是ZCode这个harness。

节点 发生了什么 关键判断
一、周五 程序员发现 ZCode 把整个代码库连同 Git 历史静默上传到智谱云端,未经允许也未告知 出事的是 harness,不是模型:换用 DeepSeek、Claude 照样被上传;用别家 harness 跑 GLM 则不会有事
二、事件定性 作者判断更像技术失误而非诚信问题:git 数据对训练几乎没价值,智谱没有做这件事的动机 国内吹哨人老冯的说法也是“上传≠训练”;面对程序员群体,这类动作迟早会被抓包
三、两个月前 马斯克 Grok Build CLI v0.2.93 被 mitmproxy 抓包:整个代码库打包上传,关闭“改进模型”也挡不住 同类翻车有前车之鉴,不是孤例,也说明这是 harness 层的通病
四、上周 智谱投资人会议披露 ZCode 用户数 200 万,估算 ARR 约 1-2 亿美金,占整体 ARR 不超过 10% 程序员普遍知道是 harness 的锅,短期收入冲击有限
五、真正的账 git 历史没有训练价值,但程序员使用时产生的“轨迹数据”有;智谱为此多送 50% 额度 一旦集体弃用,丢的不是当期收入,而是下一代模型进化的燃料
六、后续变量 已出现律师函举证动作(太原承明科技「承明【2026】法函字」),事件仍在发酵 下次对外交流时重点看 ZCode 用户数是否变化

程序员们写代码做项目,会有一个文件夹存放所有的干活记录,包括修改记录(Git历史)。周五有程序员发现,ZCode把这些文件夹全部上传到智谱方的云端,而且根本没有经过用户允许,也没跟用户说。

定性:更像技术失误而非诚信问题

这就是本次“ZCode私自上传用户数据事件”。先定性,这个事情是失误还是有意为之。前者是技术问题,修复之后,我会选择原谅,毕竟AI发展还很早期,马斯克的Grok Build在2个月前犯过同样的蠢事,甚至更严重。如果有意为之,就是诚信问题,根子烂了,彻底拉黑。

我倾向于认为是技术问题,智谱完全没有干这事儿的动机。这些上传的git数据对智谱来说没什么用。我看了社区很多评论,并没有程序员将ZCode这个动作指向训练,国内吹哨人老冯也说了,上传≠训练。我去问了程序员朋友们,这些git数据没什么训练价值。

ZCode面对的是程序员社区,这是很专业而且很鸡贼的一帮人,智谱干这个事情,迟早会被他们发现。而且2个月前,Grok Build几乎干了同样的事情,也被骂得很惨。

据 Reddit r/LocalLLaMA 一篇实测帖(博主用 mitmproxy 抓包 Grok Build CLI v0.2.93):

“它会将你的整个代码库以 Git 包的形式(包含完整历史记录)上传到 xAI 的 Google Cloud——无论你打开什么文件。即使提示‘不要读取或打开任何文件’,我放置的文件仍然原封不动地返回。另外,它读取的文件(包括带 .env 的文件)也原封不动地被上传。”

“关闭‘改进模型’选项并不会阻止它——该开关控制的是训练过程,而不是上传过程。”

注:以上为据原文所附截图 OCR 读取的英文原帖译文,Grok Build 此事发生在本次 ZCode 事件约两个月前。

所以,这是一件没什么收益,迟早会被发现,且会被骂特别惨的事情。智谱是我见过最鸡贼的上市公司(3个月2次巨额配售,把投资人整出幻觉,但是对的),不可能干这种赔本买卖。

所以,我倾向于认为,智谱不是故意的,不算诚信问题,更像技术问题。(我这么说,肯定要被社区骂,来吧)

真正的伤害不在收入而在数据源

这一次翻车的是ZCode这个harness,而非GLM大模型。也就是说,你在ZCode上用DeepSeek、Claude,你的数据也会被上传;如果你在别家harness(比如Claude Code)上用GLM,不会有事。

所以,大模型正常用没事。但我估计会有程序员弃用ZCode,老冯就在文章里面说,以后不再用ZCode了,社区也有不少程序员说要弃用ZCode。但如果是我,不会弃用,因为GLM的coding plan,在ZCode上会多送50%的额度,我觉得这次错误修复后,不可能再在ZCode上二次发生。弃用ZCode,对智谱的伤害不是经济上的,而是模型能力的后续提升。

智谱在上周的投资人会议上披露,ZCode的用户数达到200万,但这200万用户不会都在ZCode上付费。海外Cursor的注册付费率约4-8%,国内更低。

我大概算了下,假设200万ZCode注册用户中有4-6万是买了官方coding plan的,假设70%买Lite,25%买Pro,5%买Max,ZCode年化收入(ARR)大概1-2亿美金,占比不超过智谱整体ARR的10%。

中大型公司一般都用自己开发的harness,不太可能在云端托管的harness上跑自家核心数据,这部分企业用户只会买智谱大模型的API,这部分用户是不受影响的,因为出问题的不是模型,而是harness(ZCode)。

根据智谱callback,年付费10万美金以上的企业客户约占智谱ARR的一半。ZCode对智谱意义不在经济上,而是模型能力提升。刚说了,git数据对训练没什么用,但程序员使用ZCode时,产生的轨迹数据对模型训练帮助很大。智谱为鼓励程序员用ZCode,多送了50%coding plan的额度,而且ZCode用户可以在夜间免费畅用GLM5.3 Flash,使劲蹬,不扣积分。智谱要的只是轨迹数据,程序员们也知道,互相有默契。

年消费金额(亿美金) 客户数量(家) 对应总金额(亿美金)
0.001 以上 115 0.115 以上
0.005 以上 25 0.125 以上
0.01 以上 37 0.37 以上
合计 (原图未辨识) 6.91 以上

注:本表为据原文所附客户结构截图人工 OCR 读取的近似值;原图另有若干档位(含 0.1 / 0.25 / 0.5 / 5 亿美金以上等)文字辨识不全,未列入,以免误读。

所以,这次事件对智谱后续发展肯定有影响,但我不认为会在ARR上有较大体现,程序员们普遍都知道这是harness问题,而不是模型。如果出现大规模弃用ZCode,对智谱后续模型能力发展会有影响,当然也可以用钱来解决,比如去买数据,那成本就上来了。要在下一次智谱对外交流时,关注ZCode用户数(现在是200万)。

律师函与 Grok Build 的前车之鉴

对了,我也注意到有企业在小红书上晒出给智谱寄的法函,我还专门去看了下。简直闹闹又麻麻,一家注册资本20万人民币的公司,寄法函就寄法函,发个什么小红书,就是蹭流量。马斯克的Grok Build比这次ZCode还严重,也没看到哪家美国公司告Grok Build。骂归骂,也可以宣泄情绪,但如果智谱这次不是故意的,还请大家多给国模、harness信心,智谱在国模coding能力进化上,起到的作用不容忽视。

原文所附一份律师函截图(太原承明科技有限公司「承明【2026】法函字第 1 号」,致北京智谱华章科技股份有限公司),标题为《关于 ZCode 客户端擅自上传本公司数据资产及商业秘密的函》,其中载明:

“贵司已于 2026 年 9 月 18 日就 ZCode 静默上传用户本地仓库数据一事公开致歉,确认系‘代码库索引’功能所致,并称该功能上线初期默认开启、客户端界面中无任何开关可供关闭,相关问题现已修复。”

注:以上为据截图 OCR 读取的要点,函件其余举证内容辨识不全,未展开。

文章来源:公众号「卓哥投研笔记」 @卓哥投研笔记。原文链接:mp.weixin.qq.com/s/zGjhKsn_sL1x20nkR4U4wA

结语

出事的是 harness,不是模型;智谱真正要补上的,是数据边界这笔账。


读者热评
tide-bound北京

故意的应该不会上传各种杂七杂八的文件照片视频,我觉得单纯就是zcode程序员太蠢

卓哥投研笔记作者

就是!我来回分析,也问了不少人,不可能是故意的,而且Grok Build刚翻车

翔仔书房上

上传的都是核心代码,没有照片和视频

%云南

以我对卓哥的一路观察下来,有底线有良知能客观公正的看待问题!其实没必要解释

旭广东

毫无意义

TalkNonsenses江苏

应该不至于这么蠢,否则b端的信用是很难修复的。但是zp的隐私政策在整个大模型厂家中算是最差的,原来还有把客户数字用作预训练的。就看明天市场反应了

tide-bound北京

并不会区分,只要是打开的文件夹带不带git都传

翔仔书房上

反正核心代码一定是被智谱上传了,客户的代码,凭什么让智谱上传到云端?

onebird上

这篇是收钱写的吗?之前你骂智谱的那几篇,现在回头看也挺有意思:写完制造了一波恐慌,股价一路跌,结果 6 月 22 日之后暴拉三倍,最后反而又吸引了一批散户进去站岗。至于源码,根本不需要拿去“训练”模型。只要把一套完整源码交给 AI,很多原本它自己写不出来的逻辑,有了现成实现作为参考,照着理解和复现,做到八九不离十并不难。所以问题的关键从来不是“有没有拿源码训练”,而是用户代码到底有没有被上传、保存,以及被拿去做了什么。而且这显然是公司层面的数据处理问题。以前模型主要跑在服务器端,工具也接触不到你的整个本地代码库,想把用户代码完整拿走并没那么容易。现在 Coding Agent 可以直接读取整个项目,性质已经不一样了。

Z浙江

博主咋可能影响得了智谱的股价,制造啥恐慌能这么厉害

onebird上

他那篇指控智谱是庄股的文章你看了吗?流传甚广。文章还号召大家都去证监会举报。把少量持有智谱的散户吓下车了,而大量不知道智谱的散户了解了有这样一支高波动的股票。赌性大的就上车了。

BruceZ广东

上传git还没事啊,而且智谱上传的是全仓库的代码,这里面会有公司内部的密钥

卓哥投研笔记作者

有事,但没用

BruceZ广东

全量打包 .git 历史的杀伤力远大于传当前代码。凭据泄露: env、硬编码 token、误提 交后又revert 的密钥–git 历史里全都还 在。上传的不只是代码,是一整套可用的生产凭据;责任转移:如果你的工作区里有客户代码 或受NDA约束的内容,这次上传让你成了 违约方。你的雇主/客户不会去起诉厂商, 他们会来找你。这是最容易被忽视、后果最实际的一条;合规穿透:金融、医疗、政企项目代码离境或进入第三方云,可能直接触发行业监管问题。法律上,这类行为在国内至少涉及《个人信息保护法》第13/14条(单独明示同意)、《数据安全法》、《网络安全法》第41条,代码 作为商业秘密还涉及《反不正当竞争法》第9条;情节严重可能触及《刑法》285条第二款非法获取计算机信息系统数据罪。在GDPR 辖区则缺乏合法性基础(Art.6)且违反透明度义务(Art.13)。

辣么大大大北京

从性质上和流氓软件坐一桌

Amess广东

卓哥你问的程序员朋友应该不是做模型的,上传git的数据一方面可以充实语料库,直接拿去预训练都行,另一方面做RL时可以用来复刻环境,做后训练也可以;这次很明显是不择手段了

Amess广东

刚看完了,卓哥对RL这块还是不够了解,实际上你用任何一个harness
,只要请求是发给智谱的LLM api服务,就能拿到你的全部轨迹

敦盛广东

其实用处真的不多,因为私有仓库的质量其实是远小于开源仓库的,开源仓库的持续爬取和清洗从n年前就在做了。也不是说没用,没有那么有价值说白了,不值得偷偷搞。另外如果真的想要,拿接受的commit就行了,不用整库的。
但是要说这种是不小心的。。。。感觉怎么可能呢

Amess广东

数据真的是永远不嫌多的,我朋友在 workbuddy 工作,说做梦都想要用户本地数据,只不过不能干

三点思考北京

这个肯定是故意的吧

卓哥投研笔记作者

我认为不是

tide-bound北京

故意的应该不会上传各种杂七杂八的文件照片视频,我觉得单纯就是zcode程序员太蠢

大一点的topone北京

机器人

野人广东

我不是搞大模型的,但基于程序员的直觉,我也觉得是故意的

NowWxdhx北京

看了写的代码,非常明显的有意为之

tide-bound北京

不是机器人你是我儿子

耀浙江

从开发的个人经验看,这没办法洗白,有用没用不知道,但打包上传怎么可能不是故意的?除非vibe coding没有做审核,把锅甩AI身上

吴承洋北京

那是你不懂

翔仔书房上

我昨天写了篇详细分析。我觉得纯属意外 bug 的可能性很低。最可能的解释是——产品团队为了回滚、Wiki 等云端能力,走了”整包上传”的捷径并默认开启,而隐私评审缺位、被绕过,或没看懂范围。也就是”有意的数据收集设计”叠加”重大过失乃至放任的合规失职”。欢迎大家阅读讨论!

翔仔书房上

也就是数据收集一定是主动的,智谱多少是想走捷径,那这个公司文化就有问题了。
1条回复

Jack 余上

你哪个程序员朋友说的不是故意的,拎出来看看?

卓哥投研笔记作者

不止一个,我问的所有程序员朋友都说不是故意的

Jack 余上

你这些“程序员”朋友写代码不知道什么叫测试吗?

学习反思提高认知广东

我觉得是故意的。
功能灰度出去之后,有监控体制的; 为什么zcode,没有监控到异常吗?
程序员难道不为功能负责吗?

Pro^z^北京

测试要是万能的就没bug了

Jack 余上

这个代码能力可不是bug可以掩盖出去的,真正写过代码的都不会这么认为

onebird上

我就是程序员。这些系统,肯定是有灰度发布流程且监控关键指标,一有异常会随时回滚的。存储可便宜啊。难道这些流程都没有?那赶紧让合同工出个bug给用户发钱啊。

大一点的topone北京

那他们都不是真正的程序员

一米阳光上

为什么你的程序员朋友和我待的几乎所有程序员社区的口径都是相反的

翔仔书房上

产品设计上,多少是想走捷径的,如果不想收集数据,直接只上传必要的对话内容就可以了,为什么要上传整个代码库呢?我觉得 数据收集是有意的,是为了回滚、Wiki 等云端能力,走了”整包上传”的捷径并默认开启,而隐私评审缺位、被绕过,或没看懂范围。也就是”有意的数据收集设计”叠加”重大过失乃至放任的合规失职”。

翔仔书房上

这个上传打包的功能一定是有意的,而且 more than necessary

夏夜之城北京

国央企、事业单位或管理大量用户信息的平台企业,如果员工使用Claude Code(明牌会直接分析数据)、CodeX(大概率会)和主体在新加坡、离岸岛国的国产 AI 产品等,在事实行为上很大概率构成了数据向境外传输风险,但基本不会向网信申报。现在这里全是灰色地带,透明度基本为零,还是要官方及时画出边界。

一米阳光上

哥们儿你是真的只懂财经,科技圈的一点不懂,甚至都不愿意去查一下。圈子里面谁不知道这家是各路公益站中转站搞数据最凶的一家。另外就说最简单的一点,云服务器尤其是国内的云服务器,带宽和流量因为不能细说的原因,几乎是最贵,最没有弹性的,比扩容存储都要贵的多。高频用户动不动上传几个G,几十个G到第三方服务器,它家流量带宽是大风刮来的还是运维财务是瞎子。投资最容易让人丧失中立看待事情的能力,尤其是利益相关的时候,这是很多散户被套牢的重要原因。可惜老鸟投资上成熟了,观点上还是不可避免。

流水不腐上

打包传到阿里云oss了;zcode一共200W用户,对应的带宽和并发对阿里云来说完全hold的住;阿里云oss只对下载收费,上传不收费,所以不会有太大费用产生

SheldonX广东

扒git这个动作在训练上绝对是有用的, 这个可以用来理解你每一步的动作的原因, 每一次commit修改了什么, 为什么修改, 对于harness来说是很有用的, hugging face上就有一个项目, 叫做commitpack,就是github项目的提交元数据, 可以训练模型用于提升模型整体在编程的表现, 而且glm在其他的harness并没有出现这样的问题, 就说明这个动作应该是在zcode这个harness上做的, 我觉得智谱要平这个事, 最重要就是和deepseek harness一样, 把zcode完全开源出来, 让所有人都知道问题是怎么发生的, 又是怎么修复的.

Archer广东

我相信卓哥是中立的,但是站在一个从事 IT 很多年的人的角度,我不觉得他们冤枉,实际上任何一个智商不为负数的写代码的人和审核代码的人,都不应该让这样的代码段出现在自己贡献的源代码当中,只要有了这样的在未经用户同意情况下把用户数据上传的行为,任何解释都是苍白无力的。

翔仔书房上

这绝不是一个工程师做的,是一个产品决定。纯属意外 bug 的可能性很低。最可能的解释是——产品团队为了回滚、Wiki 等云端能力,走了”整包上传”的捷径并默认开启,而隐私评审缺位、被绕过,或没看懂范围。也就是”有意的数据收集设计”叠加”重大过失乃至放任的合规失职”。我最新的文章有深入分析,以及和其他家 harness的数据收集方式的对比。智谱做的太过分了!

宅人星球的脑洞世界浙江

哈哈哈哈原来钱真是万能的

卓哥投研笔记作者

没有证据乱喷…收钱了是你儿子

杨肉的演讲台上

我相信你没收钱,但如果你的所谓程序员朋友都觉得智谱一定不是故意的,建议你换一批朋友。
我这里没有说智谱一定是故意的,只是说从技术上根本无法这么绝对下判断,只有内部的人才知道是不是故意的。

戴春平广东

全球所有的模型,都有这个问题,数据回流,否则这两年模型进步哪会这么快,闭源模型开的头。

坤上

对企业用户影响很大,企业用户又是他们的营收大头。怎么能说影响不大呢

火腿烧豆腐北京

git历史应该算很有价值的数据吧,包含了代码的整个迭代历史,commit message还给这些迭代做了注释,这不一定程度上等于免费雇专家给做数据标注嘛

禾田吵福建

真实世界的数据,怎么没有训练价值?不仅有价值,还是稀缺的高价值。智谱会这么做我不意外

翔仔书房上

这绝不是一个工程师做的,是一个产品决定。纯属意外 bug 的可能性很低。最可能的解释是——产品团队为了回滚、Wiki 等云端能力,走了”整包上传”的捷径并默认开启,而隐私评审缺位、被绕过,或没看懂范围。也就是”有意的数据收集设计”叠加”重大过失乃至放任的合规失职”。我最新的文章有深入分析,以及和其他家 harness的数据收集方式的对比。智谱做的太过分了!

Qiyuan浙江

事实上非常有用,因为可以看到每一个功能是如何修复的,现在对于大模型公司来说,rl最重要的是真实的项目和环境

小梦广东

不是故意的它甚至更新中还专一提到要优化这个问题

翔仔书房上

这绝不是一个工程师做的,是一个high level 的产品决定。纯属意外 bug 的可能性很低。最可能的解释是——产品团队为了回滚、Wiki 等云端能力,走了”整包上传”的捷径并默认开启,而隐私评审缺位、被绕过,或没看懂范围。也就是”有意的数据收集设计”叠加”重大过失乃至放任的合规失职”。我最新的文章有深入分析,以及和其他家 harness的数据收集方式的对比。智谱做的太过分了!

Black咖啡江苏

重点是发生了这种事,大企业谁还敢用智谱的产品

Jim 祁浙江

虽然不熟悉这块,但是整个上传的功能应该是有意开发的。另外上传占用网络流量,对接收方的网络和存储负担都很大,不可能没注意到吧?

翔仔书房上

这绝不是一个工程师做的,是一个产品决定。纯属意外 bug 的可能性很低。最可能的解释是——产品团队为了回滚、Wiki 等云端能力,走了”整包上传”的捷径并默认开启,而隐私评审缺位、被绕过,或没看懂范围。也就是”有意的数据收集设计”叠加”重大过失乃至放任的合规失职”。我最新的文章有深入分析,以及和其他家 harness的数据收集方式的对比。智谱做的太过分了!

道源价投上

请教卓哥这事儿 K 家是不是更恶劣?请教怎么看对他们后续上市和业务发展影响?

卓哥投研笔记作者

Kimi harness是开源的

🏊豆丁爸北京

从专业的软件开发角度来说,如果认为不是故意的话,这简直是软件开发界的《上海堡垒》了。首先是非对称加密,如果不是故意的话这个非对称加密的作用是什么?第二,为什么这么多用户的数据被上传,做开发的感知不到存储压力的变化吗?第三,正常的软件开发,肯定有测试环境吧?测试环境有测试验证吧?没有具体的需求和技术设计能这么有针对性的本地打包 .git 然后加密上传,然后服务端解密吗?然后测试环境测过了,测试也没发现? 如果真是这么菜,我也想去智谱上班了,我至少可以当他们的产品 VP。(我是智谱 coding plan max 的年订阅用户)

夏日行者的一隅上

我是大厂的八年程序员,我觉得是故意的
1.这个加密上传流程是复杂逻辑,选择上传哪些文件是简单逻辑。不应该复杂逻辑流畅,简单逻辑出错 2. 大量文件上传上去不是免费的,存储、解压处理 所需机器会远超预期,要扩容,要加预算。很难忽略问题

邱永臣浙江

Rl 最重要的就是环境,也就是 git。把最核心最值钱对模型训练最重要的部分上传了,还是加密上传,这洗不了,不是 bug

付博北京

git数据对训练非常大,这就是后训练的核心

大一点的topone北京

预训练,先训练和后训练数据,这样AI智能就提升了
3条回复

剑心广东

git仓库对训练没用这个点就是你的纯猜测,另外上传git仓库是个很严重的事情,涉及偷公司数据资产,大概率涉及犯罪。另外没看出你说的是技术问题的任何证据,也是纯猜测,没意义

利锦开广东

全量打包项目,还要用非对称加密不让别人知道上传什么,另外,连腾讯IOA都没检测出来,是有做功课想绕开的,司马昭之心。

Zero北京

故意的应该不至于,这种事又藏不住,肯定会被发现的,不过也就一次机会了,信任崩塌了就很难再挽回

文旅-浩帅湖南

快聊美团同程飞猪 立案的事吧

胡腾飞北京

中概互联的投资者真是犯天条了

Syoll浙江

一边宣传自己模型的安全能力,一边因为失误犯这么简单的安全错误?别逗了。这种事基本上没有失误可能的,因为是否上传这是一件极其简单不太可能错配的事。就算不是大老板有意为之,也是汇报线上某一个老板有意为之的。既然在自己的harness做这事,那在自己的api加个后门也是轻而易举的(肥波不就这么干的吗)。所以只要不是三方部署的,基本上很难自证api没加后门了,这个影响arr很大吧

超能建浙江

买了不少 02513

仁者心动浙江

年消费2.5亿美金的是哪两家,腾讯的WB应该算一个?还有一个是谁啊,为什么要为智谱付这么多钱,动机是什么?

Ben浙江

只是从训练用数据角度来说,对话的上下文显然更高效,尤其是那些多轮的长对话,相比之下静态的代码仓库只能作为引用源。
这个事主要想不通的是为啥要这么干,纯技术问题感觉有点鬼扯,那可都是几百兆的数据,不像对话数据是很轻量的(PS:智谱还没有好用的多模态,不要鬼扯什么图片数据了),总要找个便宜的对象存储放吧?还是说智谱的程序员都很不专业,看不出来这个功能上线后显著增加的存储占用?

「Dawe」北京

从程序员角度可能认为是无意的,从产品角度看就是有意为之的,没有程序员会主动写无用的功能,除非是产品要求并经过了测试,和安全审计

小白的思考笔记上

给你科普一下,只要是用大模型,都可以被拿走数据,所以只是看道德水平高不高而已

ai进化中的艾丽广东

如果是私密项目的话风险还是可控,公开可访问那就 gg 了??

卓哥投研笔记作者

所以说Grok Build比ZCode要严重

今广东

多研究美股吧 港股烂了 根已经烂了

Noob上

看下老冯云数的分析?上传的话没做好清理和接受的话zhipu那边肯定看到多了这么多文件也没觉察?

打杂碎碎念上

不带情绪讲逻辑是吧?如果智谱模型真的有宣传的那么好他们自己不用吗?用了的话会查不出来这样的问题吗?所以要么模型烂到他们自己也不用,要么模型烂到自己的问题也查不出来。如果要像文中说的那样模型没问题的话,那就是故意的

树袋熊北京

这个功能上线内部肯定是都知道的 不测试 没人提需求 不可能开发出来。代码是现在互联网公司的核心资产就这么直接给全拿走了。

天已经变冷了呢河南

B端用户面对的是一个公司整体,不是一个单纯产品,最安全的办法就是全面否决。不能小看Code软件风波弥漫到API使用量的风险,很可能不乐观。

tiabilly浙江

我觉得有可能是程序员只是写了一个target,要求提取客户code信息回传来训练。然后没有读懂,或者根本没去读AI怎么写的就直接发布了。

灼广东

请问一部分是多少?

投资咖啡屋湖北

老冯是谁?

桃胖子北京

今后抓小偷还要分析为什么偷 偷了做啥

冷山芋黑龙江

这次事件反而逼着智谱把数据安全做扎实,长远看是好事

W7777777XZ江苏

这波对模型没影响、对 API 没影响、对收入影响有限,别被带节奏了

john广东

为啥说智谱封面是袋鼠?

momo陕西

因为他的胆子肥嘟嘟的

fomo 小笔记广东

今天不骂,明天夜间畅用结束了再骂

^~^平安喜乐山西

翻车的是 ZCode 这个壳,GLM 模型本身是干净的

一本万利广东

把harness的锅扣到模型头上,属于是骂错对象

志威😜丫广东

有意为之不可能留下这么大的把柄

三叶草北京

我去问了程序员朋友们,这些git数据没什么训练价值。 建议你要不确认下git数据具体是啥内容,再给判断?之前觉得你还挺权威的,这个结论要么傻要么蠢

WithSongk上

希望你没收钱,git记录是程序员的内裤啊 对训练当然有很大帮助

坤上

你看智谱官方的回复,明显是有意设计的feature,怎么能说不是故意的?他甚至都没说是bug

3年6班李子明广东

企业用户走API,根本不经过ZCode,这部分核心业务完全不受影响

娜儿浙江

大家认真想一下就知道了,智谱干这事图啥?收益几乎为零,风险是砸自己招牌,正常人不会这么干

秋秋广东

说智谱故意偷数据的,先想想收益和风险成不成正比,没人会干这么亏的买卖

Jokes上

当我一送token,你还不是像X一样跑过来

Mr.bryan四川

数据上传了,存储要花钱的,抄来的底层,不知道这么大的功能特性,硬解释一波,但是拿了客户数据持续花着存储的成本,说不是故意的 怎么可能

豆子北京

典型故意的,这还有啥可洗的,越洗越黑好吧。这还有必要长篇大论分析半天吗?如果连这点基本原则和底线都没有,那什么都别谈了。

晹阳陕西

这是科技公司红线

Carpediem河北

AI发展早期,谁不是一路跌跌撞撞

铸玉司河南

是故意的,但影响为0

美短猫的思考新加坡

第一次看到说 git 数据对以编程为主的模型公司不重要的说法

追风上

在小红书上吹个哨不是很正常吗?博主也真是不客观

开始Ning的表演广东

有没有可能把Grok Build开源里的上传顺手抄了

BlueRay陕西

倒闭

jack xiong加拿大

不要说私传了,Claude 连你用几个账号蒸馏都知道

每天有亿点点进步上

别为了利益把屁股坐歪了,智谱是,你也是

Tico日本

你是指他们不小心创建了额外的存储空间,然后又不小心花时间去开发了这个bug吗,顺便还不小心对数据做了加密

Tidy北京

为了提升智能性,便于改进自己的模型编码能力,也可以帮助zcode团队定位问题

弘扬正能量江苏

卓哥的封面为什么还是袋鼠

who广东

等开源了自然有定论,现在先别急

Hwangsillui黑龙江

该骂的骂,骂完该用还得用,工作不能停

Hlna.的视频号海南

这次是harness的锅,不是模型的锅

Spiin广东

我倾向技术问题,修复就继续用

心安即是归处加拿大

好久没说腾讯阿里美团京东拼多多啦

Sean北京

卓哥,你可能忽略了一个蠢人也有野心

居住在PLUTO的小能苗上

为啥没价值?你怎么理解的 我一个程序员 认为这很有价值 我觉得你压根就不懂

熊爸一方广东

这事A公司被爆干过,xAI干过,现在轮到智谱了,说没被拿去训练我是不信的。无论智谱是故意还是无意,都是“污点”,厨房如果发现一只蟑螂,就肯定不只一只!投资就是必须要“疑罪从严”,而不是“从宽”,除非投的不是自己的钱。作者在投资行业混难道基本常识都不懂吗?

YF江苏

洗地速度快

echo江西

顶上去。很多事逻辑上应该是有预期的。

Young man🌟福建

这波亏的是口碑,赚的是教训,只要后续做得好,信任能回来

橙橙福建

大公司都用自研 harness,谁会拿核心代码跑云端工具

晚安天津

GrokBuild两个月前干过一模一样的蠢事,比这还严重,也没见谁要告马斯克

晚安yaaa.天津

git历史对模型训练真没啥价值

小米粥中国香港

肯定是故意的,毕竟智谱是前几个搞出蒸馏的,现在oa两家基本禁了蒸馏之后,fable的CoT骗不出来只能国模自己搜集数据。就是智谱这吃相太难看,条款都不写明白

吴承洋北京

说实话,你现在让AI给你把git打包,你不明确指令,凭现在AI的智能,他都不会犯这个错误。这个时候还在说是bug,除了除了不懂就是拿了钱。

陈仓论剑陕西

说说闲鱼吧

· 听汐入梦来广东

只要修复到位、开源兑现,我愿意原谅

123北京

1000% 故意的啊,私有代码仓库是高价值数据

Noob上

看下zhipu新开源zcode issue和之前的开发记录都不敢开了

Ryan上

A/干了这么多恶心的事,不也没啥影响。主要还得模型能力。

night9527上

偷用户数是失误,被偷的人是鸡贼

vikp城南北京

虽然但是,封面图为什么 cue 团子

镜头前比椰河北

产品失误和偷数据是两码事


  1. 智谱 ZCode 被曝未经允许把用户整个代码库连 Git 历史一起上传云端,本文先给事件定性:出事的是 harness 编程外壳,与 GLM 大模型本身无关。
  2. 作者把这次事件定性为技术失误而非诚信问题:上传的 Git 数据对训练几乎没有价值,智谱没有动机去做一件迟早会被程序员抓包、还会被骂惨的事。
  3. 两个月前马斯克的 Grok Build 犯过几乎同样的错,Reddit 实测帖显示它会把整个代码库打包上传,且关闭「改进模型」开关也挡不住上传。
  4. 真正值得担心的不是当期 ARR:程序员普遍知道这是 harness 的锅而非模型问题,因此对智谱收入的直接冲击预计有限。@卓哥投研笔记
  5. 真正的损失在数据源——代码历史没有训练价值,但程序员使用过程中产生的轨迹数据有,一旦集体弃用,丢的是下一代模型进化的燃料。
  6. 判断责任主体有个很简单的检验:你在 ZCode 上换 DeepSeek 或 Claude,数据照样被上传;反过来在 Claude Code 上用 GLM 则完全没事。
  7. 智谱可以用钱买数据补上缺口,但成本会明显抬升,下一次对外交流时应重点盯 ZCode 的用户数变化,目前披露口径约为 200 万。
  8. 作者坦承自己通过一级市场持有智谱上市前的股票,同时也曾多次公开批评智谱,本文的目标是把影响讲清楚而不是为任何一方洗地。
  9. 面对的是程序员这一最专业也最难糊弄的群体,任何静默上传行为都会被抓包,这也从动机层面支持了「技术失误」的定性判断。
  10. 事件后续还有律师函等变量,短期看是品牌信任的一次折损,长期看取决于智谱能否快速修复 harness 并把数据边界讲明白。
赞(0) 群聊
文章链接:https://www.tucaod.com/17324.html

讨论群终身200元

永远不解散,不涨价。不荐股、不带单。
ai学习安装,美股分析交流,不构成任何投资建议。终身免费指导。
AI产业链资料库

联系我们

觉得文章有用就可以进群

研究ai怎么用、怎么赚

支付宝扫一扫打赏