张一鸣真厉害。《光明日报》从2001年开始骂网络游戏是“电子海洛因”,结果二十多年过去,游戏没成气候,抖音成了。

  抖音太好看了,15秒一个爆点。张一鸣这家伙靠贩卖上瘾当上了亚洲首富,结果自己在AI上选了最苦最慢的路。具体表现为,别人都搞蒸馏,他不搞。豆包都蠢到这种地步了,也真耐得住性子,铁了心要自己慢慢做基础研究。

  这种行为看着很傻逼,其实是对的。蒸馏本质上里就是给自己发一张“我也在场”的临时入场券。DeepSeek二五年初很厉害,搞个R1把美股吓一跳。大家都觉得给两年时间DeepSeek足以赶英超美。到现在创新搞不出来,选择转头去蒸Claude。Kimi更是从一开始就在玩蒸馏。不是说蒸馏不好,而是蒸馏这件事,你找个傻子来,只要有十几万张卡外加一份接口文档,照样能干。把人家的回答嚼碎了再吐出来,包装成“自研”,股价好看,发布会也好看,创新能力这四个字直接从账上划掉。表面上没掉队,实际上自己都不知道路线要怎么走。

  另一方面,蒸馏代表你永远在别人后面闻尾气,AI的定义权直接交到别人手里。你能拿到的模型,根本上就是人家玩腻了才放出来的。现在看着什么Fable5.1,Opus5.5很强,画小鸟骑自行车很好看。其实人家更强的压根不放出来,就留着压你一头。OpenAI也一直这么干。它前几天解决的那个悬了九十年,奖金一百万的纳维斯托克斯,用的是“能力显著超过 GPT-6 Astra 的内部模型”(官方原话)。你蒸馏出来如获至宝的“重大自研”,一开始就落后人家一个时代。

  最近还有一个事情,充分说明了只知道蒸馏是要蒸出问题的。Claude一周前发了一个报告说DeepSeek和Kimi蒸馏他们,这是老生常谈,大家早见怪不怪了。但这次还有点新东西,Claude声泪俱下地控诉这俩人下场干起了AI中转站。人家明明问的是DeepSeek,DeepSeek悄悄把问题转给Claude,再假装是自己回答的。问题不在DeepSeek和Kimi有没有申请中转站经营资质,而是它转发之前没检查。一般用户问点情感问题,算个命什么的也就算了。公安也在用,觉得Kimi是我们国产模型,中国人不坑中国人,放心大胆地把几百个摄像头的监控给交了出去。Kimi反手就给了Claude,Claude还很嚣张地公布了出来。大有一种“看你翻车了吧”的幸灾乐祸。我看到这个报告,第一反应以为是假的。你Claude整天就知道造谣。这种货真价实的现行反革命,借Kimi十个胆子它也不敢干。直到昨天看到国家互联网信息办公室真派人进驻了月之暗面,这下真假得再议了。

  这是整Kimi。DeepSeek倒是没泄漏什么国家机密。最近发了一个Flash4.1,便宜是真便宜,套路也是老套路。后训练就是那老三样:监督微调,强化学习,然后 on-policy distillation,老师号称四十多个。评测脚手架里 Claude Code 挂得最显眼,写代码跑 agent看图,都拿人家的套子套一遍。你让它写代码、拆任务、说话的分寸,一股被 Opus 带过的学生味。

  关键是抄的太过了,连Claude早期的安全护栏和安全话术都抄了过来。我衷心地建议DeepSeek,你们搞蒸馏能不能发挥一点自己的主观能动性,不要什么东西都拿来乱蒸一气。比如这个我从某网络论坛里看到的的截图。

  image.png

DeepSeek极其欠揍的回答方式不知道从哪里来的。


  情况是DeepSeek不仅继承了Claude的安全护栏,甚至在某些方面还完成了自主突破。别人也没让它做什么出格的事,无非是让它翻译一本书,它不干。你不干就不干,非要用一种极其欠揍的腔调,仿佛让它翻译东西成了不道德行为。本来一句话就能说清的事,偏要写成训话。拒绝本身不够,还得让你觉得提这个要求就有点不体面。

  最欠的是那句“我不想给你一个听起来像让步的方案”。用户又没求它让步,用户要的是译文。它先替你把要求定义成越界,再替你设计一条它愿意走的正道,最后把自己摆成唯一懂分寸的人。能力一般,老师傅的架子一点不落。

  DeepSeek蒸馏Claude也算是经验丰富了,Claude的封杀名单每期必上榜,上榜必头名。既然是高手就应该有点高手的样子,蒸馏的时候能不能把那个安全护栏给过滤掉,就算不过滤,好歹要有一些中国本土的特色。达里奥喜欢给模型加道德指责,因为他本身就是个傻逼。你梁文锋想弯道超车,是否应该有点你自己的主见?Claude的模型永远都在同时代的前两名,而你DeepSeek v4.1flash连大模型的第一梯队都进不去,反倒抄清规抄得比老师还勤。更何况现在连Claude自己也早懒得念那么长了,只有DeepSeek还在把拒答模板、客服话术、道德优越感揉成一锅来恶心用户。

  (张炫阳于2026年9月24日,zhangxuanyang.com)