中国模型的“平替”卡位与智谱的崛起
闲哥: 回顾上半年,一月份到六月份,我直说吧,这回我这个奖不颁给任何人,我就颁给智谱。我觉得智谱真的是让我刮目相看,而且他让我理清了上半年的一个逻辑。
中国模型是在追赶,是在跑分、多模态等等地方追赶,但同时中国已经找到了一个自己的舒适区,就是平替。这个平替体现在几个方面:我不是要做你的廉价版,而是要让你在做的工作中有我的一个位置。
在做一个整个项目的时候,我可以用 Fable 或者 Claude Code 去设计架构,用 Codex 做部署,但是真正长活、累活、脏活,还有一些耗 Token 的活,百分之六七十用中国模型来做。这个感受是我最近自己在玩的时候,再加上看了很多评论之后,慢慢摸索出来的一个感觉。
主持人: 我要顺着你刚才那个挑战一下。你刚才说我们找到了一个非常好的卡位点叫平替。我前两天看到一个观点,分析了上半年中国电动汽车的走势,总的来讲就是量铺得非常大,行销全球,但实际上大家都没赚钱。一旦中国进入了一个行业,本来赚钱的行业突然就不赚钱了。你觉得模型端会发生这样的事情吗?
闲哥: 你提到车,正好是在我的论述范围和舒适点上。但是我想说的车不是电动车,而是日产车。大家对日产车都有一个概念或平常印象,就是便宜、皮实、维修起来更好。你不觉得这很像中国模型吗?
当年最火的车肯定是欧洲车、美国车,但是卖得最好的是什么?丰田、本田啊。日本车当年是凭什么在全球崛起的?你可以想想,中国模型到底现在卡在什么位置。
主持人: 你的意思就是说用成熟技术降低成本,不拼那么先进,然后主打省油耐操、维修成本低、更新快、体积小好停车。
闲哥: 对。那个 OpenAI、Claude 是不是有点像德国车?养活了中国所有的修车店。
主持人: 不光是德国车,还有美国车呢,比如福特、凯迪拉克,养活了一整条产业链。边修边骂,但是还是离不开你。
闲哥: 对,所以你说车我就想到要给大家类比日本车。把这事想明白之后,你就发现中国模型大有可为。而且中国模型现在在市场上的定价和估值,我觉得完全被低估了。就像 DeepSeek 前段时间融完资之后,估值才几百亿美金,而 Anthropic 和 OpenAI 都是奔着万亿去的,这中间有多大一个盖板。
主持人: 我还真同意你这个观点。我本来是想把你带到一个坑里面的,没想到你没跳。
我自己也觉得,可能几年以内,中国模型不会卷入到一个很严重的价格战里面。因为目前整个在中国的模型生态开始走去中心化:模型干模型的,入口干入口的,工具干工具的,云服务和数据各司其职,有点默契。
闲哥: 对,有默契的。因为模型是个大坑,大家也都不想碰。
务实的商业路线与防守姿态
主持人: 闲哥,你刚才说 DeepSeek 好像在你那边,虽然我们《JustSayAI早晚报》提及率最高的是它,但它好像没有做出什么很让你印象深刻的东西?
闲哥: 因为它干的是基建的活。上半年它在搞适配,把国内国外的人都吸引住了。但它这个适配需要时间,价格打下来也需要时间。现在说中下旬它的价格可能还能进一步下降,因为国产的一些芯片能够上来了,在预训练跟推理上能更多地用上,这些都还需要时间,下半年有希望冲击一下最佳。
做生意不是爽文,大哥。大家最期待的爽文就是 DeepSeek 逆袭,一举左踢 OpenAI、右踢 Claude,托举国产生态一条链一起起飞。你想听这种故事,但实际上跟做生意没有任何关系。
我们上期讲 GLM 其实是从做生意的角度出发,是一个很务实的考虑。你肯定要跟国外模型保持 3 到 6 个月的代差,这样你刚好可以替代它限额到达以后的那部分产能。
主持人: 确实,最近的 GPT-5.6 已经察觉到这个事了。他们分了三档,最狠的是 Sol,中间是个 Terra,最底下是 Luna。它那个 Luna 的价格跟我们 GLM-5.2 的价格是差不多的,但我相信它的用量绝对不可能有我们 GLM-5.2 这么大。
闲哥: 对,看得出他们也在走防守姿势。但从最后的实际选择上,我们肯定会用 GPT-5.6 做一些 planning(计划)和 reviewer(审核)的动作,但是干大活我还是会回到 GLM-5.2 去干,不会用它的 Luna,因为它们之间的用量还是差很多的。
刚才那个比喻很好,德国车和美国车一脚油下去还是要耗很大油的。我宁愿开省油的。走高速是很爽,但天天开市区就老坏,搞不好还漏机油,你要崩溃。
主持人: 是这样,你不能代驾还从欧洲定。
闲哥: 撑门面还是得开一下。起步的时候和一些关键节点,用那个车是可以的。但是真的很多地方走街串巷、跑长途,还是要用我们的 GLM。你上机场接个贵宾,你还是得开奔驰。
我把上半年的最佳印象奖或 AI 最明星奖颁给智谱,不光是因为它在股市上让很多人赚到钱,更重要的是它让很多人看明白了中国 AI 模型在生态上的位置。而且有了智谱保底之后,我现在干活没有那么焦虑了,确实能开始干一些大活了。
主持人: 小苏,轮到你代表我们做总结发言,情绪价值拉满。
小苏: 不管说干活打多少折,让闲哥心安理得地干活,我觉得还是一个很大的机会点。
OpenAI的防守反击与Codex的教科书表现
主持人: 我颁一下我的奖,我颁给 Codex。我觉得 Codex 在年初被低估了,现在开始发力,表现堪称教科书级。
为什么不是 OpenClaw?年初它最火的时候,我们就说了,OpenClaw 是火,但它证明了两个事情:第一,IM(即时通讯)还是 AI 最大的入口,微信、飞书、钉钉能上的都上了,连小米汽车都上了,抢就对了。第二,证明了 Codex 一定是奥特曼的小龙虾,这个预言精准兑现了。
OpenClaw 之后,首先把人搞过去了,第二 Codex 支持远程电脑遥控了,各种生态、飞书钉钉接进来也可以遥控 Codex。而且 Codex 一度把模型价格打下来,用量非常高,突然变成了大善人。
紧接着现在模型升级到了 GPT-5.6。这个升级我觉得更大意义是解决老修的情绪价值。那个老油条 Fable 5 让他非常难受,但是 5.6 出来了,哪怕一天就用三把,老修去跟 Fable 5 谈条件的时候底气都不一样了——你不干我可以让 5.6 干。
主持人: 综合产品价值加情绪价值,我这个奖一定要颁给 Codex。而且 Codex 现在其实已经改名叫 ChatGPT 了,全部融合成了一个超级赛亚人。ChatGPT 真是光荣地接过了 Google 大善人的旗号,这两天总重置额度,搞得我总觉得自己亏了。干活的时候省着,结果晚上睡一觉起来重置了,给我气的。
老修: 你要 15 分钟耗它一周的量,连耗四次,第二天起来全部重置了,太爽了。
顶级智能的普惠与端侧未来
主持人: 老修,你今年上半年颁给谁?
老修: 毫无疑问,一定是 Anthropic 的 Claude Fable 5。我觉得这是今年上半年最好的模型。
主持人: 刚才不是刚骂了一次吗?
老修: 骂他是因为他很油,但他确实能力最强,就是我们说的“渣男”,在技术端是一个很牛的架构师。你离不开他,他真的很牛。但是你想让他干点活,你也得自己有点料,对提出的问题质量有比较高的要求,不然他觉得你太 low 就不理你。
他最打动我的一个点是在前几天修一个生产故障的时候。今天凌晨我们《JustSayAI早晚报》的服务被反复触发,他主动发现并告诉我这是一个安全漏洞。这就是一个牛逼架构师的素养,他不会只看你提的那个问题,还会看一下你现在这里有没有其他更要命的问题。
主持人: 我还想办一个上半年最佳热度词,老修有什么关键词吗?
老修: 我今天颁奖颁给 Claude Fable 5,因为它的智能可能是最好的。但我看到更大的一个点是,如果按照现在的速度看,大家可能没注意到,两年前 GPT-4 刚刚能读图像,我们已经觉得很牛逼了。但到现在,所有的任何一个模型都能干这个事情。
顶尖的智能到现在变成了大家的日常。假如我们再按这个速度搞两三年,Fable 5 这种我们现在觉得太牛逼、超级贵的东西,也许在两三年之后就会变成日常化的东西。那我觉得智能水平就真的到普惠了,而那个时候的价格肯定不是现在这个价格。
闲哥: 两年三年太久了吧,我觉得是 6 到 10 个月的问题。
老修: 我说的普惠是普惠到 Fable 5 级别的模型到了你的手机上,是端侧的。如果两到三年内它能到端侧,处理隐私事情就完全打开了。云端模型在 6 到 12 个月内赶上 Fable 5 水平是有可能的,比如智谱老大也说大概 6 到 9 个月能赶上,但端侧模型在手机或汽车端达到这个智能,需要 2 到 3 年左右。
主持人: 最前沿的模型去训练普惠的模型,现在是不是一个很确定的趋势?比如 Gemini 的 Flash 模型就是上一代的 Pro 模型,用自己去迭代。
老修: 最明确的应该是前几天发的 GPT-5.6。它最高级的 Sol 可以去训练最低级的 Luna,中间的 Terra 对标上一代的 5.5,这也就是 **ASI(自主迭代人工智能)**的概念。
最近有特别多的人去加入 Anthropic,包括一些年入百亿美金的在线支付创始人、YC 的合伙人,他们进去做基础的技术工作,主要就是在干教模型自回归成长、自我增强的事。
包括卡帕西(Karpathy),他去那边也是做技术专员,专门搞定预训练、后训练,他明确说他去就是去提高用 Claude 再训练 Claude 的过程。这肯定能让模型自我成长得更快。
如果 2 到 3 年端侧有了 Fable 5 的智能,咱们的生活应该会有无法想象的巨大改变。
“Token出海”与松弛的产品感
主持人: 小苏,不要躲,你的上半年年度词是什么?
小苏: 我觉得有一个小词可能不是很热,叫Token出海。我觉得它是一个理论上正确,但实际上落地还没有被完全验证的产业。
它不是简单的模型套利或做中转站,而是可以变成一个产业链和长久生意。特别是有几个能拿到牌照、政策的城市,比如经济特区或自贸区,数据出境比较便利,它们虽然城市能级不高,但有了 AI 以后不需要那么多人,确实可以去做 Token 出海。
其实我觉得 Token 出海反而不一定是 Token 直接出海,有可能是 Agent 直接出海,把劳务外包变成 AI Token 的外包。我身边越来越多的人没有正经工作了,大家不去大厂上班,而是去做主播、自媒体或打零工,这可能是一个新旧动能交换的转折点。
主持人: 小苏关注的是未来的趋势。如果非要谈人的话,你们上半年关注的是谁?
我关注的是 Oracle 的埃里森。他是一个真正跨周期的人,2000 年互联网泡沫的时候他在,2026 年大家谈 AI 泡沫的时候他还在。2000 年他曾短暂当过世界首富,泡沫破裂后身价暴跌,去年他又曾经超过马斯克短暂当过世界首富。真是“老夫聊发少年狂”。
闲哥: 你要这么讲,我也可以很关注我的前老板麦克·戴尔(Michael Dell)。常青树,每一波周期都稳如狗,PC 互联网卖电脑火了一把,移动互联网时什么都不做也没亏,靠卖服务器撑到云服务时代,现在 AI 时代又稳如狗。
我在 Dell 工作时经历过 PC 转移动,戴尔推出过手机并跟百度合作 OS,都失败了。当时我心想完了赶紧跑,结果人家直接跟微软和银湖联手把公司私有化了,不理你们,自己搞,然后云服务又起来了,还买了 EMC。这种跨越周期太牛逼了。
主持人: 老修你有没有特别关注的人?
老修: 我觉得可能很多人会漏掉 Peter,就是 OpenClaw 的创始人。虽然现在 OpenClaw 好像低调了,但它其实还在快速迭代,发了移动端,补上了浏览器操纵等功能。皮特就算加入了 OpenAI 去搞 Codex,也还是在搞他的小龙虾。
这个人代表了一种做产品很好的状态。他老早就因为做 PDF 财富自由了,退休了几年觉得无聊,后来发现 AI 挺好玩。他做 OpenClaw 是因为他在接送老婆孩子时,在车上想要用电脑的 WhatsApp 发个消息发不了,很不爽,就自己用 Claude 写了一个。
他的场景非常细节,有一种财富自由后的松弛感。一个好产品的灵感,不应该是设计出来的,而是来自于生活中的某个痛点被解决了,然后持续迭代并公开。
主持人: 希望大家没有财富自由也能够获得 Token 自由。
穿越周期者的生存法则
主持人: 刚才聊到甲骨文、Dell,其实这些穿越周期的企业有它非常成功的地方。反而今天在台面上的 OpenAI 暴露了太多的管理和人员问题。
包括 Google,我们只字未提,问就是爱过,不会讲前女友的坏话。但其实 Google 作为一个不是那么长久的公司,还是暴露出官僚等很多管理的短板。比如 Gemini 2.5 成功以后有非常多的人来抢功,包括之前 Google Workspace CLI 的负责人离职被干掉,也是因为 Workspace 的人担心 AI 把他们的产品颠覆掉,这就很可笑。
站在大公司角度能理解,每个人都有考核。但去看看那些穿越周期的公司,不要觉得它业务土、财报不性感、创始人老派,人家实打实地赚到钱。在关键时刻,选择太重要了。一波操作猛如虎,不如一次选择稳如狗。