程曼祺
姚顺雨在腾讯里最大的支持者是谁?
高洪浩
Martin,刘炽平。
程曼祺
Martin 可以帮他搞定什么?然后,你感受到大家对姚顺雨的评价是怎样?
高洪浩
我觉得总体评价是,他不是那种非常技术导向的人,而是非常重视组织。他经常在内部说的一句话是,做大模型这个东西,组织非常关键,很多问题归根结底都是组织的问题。
程曼祺
整体来说,腾讯对混元三这个结果满意吗?是什么态度?
高洪浩
内部其实本身对于混元三的预期就不是那么高,已经有一个非常明确的心理预期:这是一个小模型,它能解决的问题是有限的。但核心是让整个组织磨合好,让团队的士气重振。它更多像是一个重新梳理组织、重新出发的过程。
欢迎收听《晚点聊》,我是曼祺。今天这期节目比较特别,是我和《晚点》的同事高洪浩一起聊他最近刚刚报道的一个主题:姚顺雨加入腾讯之后,腾讯大模型的变化。
这篇文章在 7 月 13 日已经发布在《晚点》的公众号上,标题叫《当一个年轻人空降改造腾讯混元的 300 天》。洪浩之前在《晚点聊》也录过数期节目,他是我们报道互联网领域的主要作者,尤其常年报道腾讯和字节。洪浩,你可以和我们的听友打个招呼。
高洪浩
Hello,大家好。
程曼祺
那我们直接开始。我先问一个自己比较好奇的问题。我们一般写文章,其实会有很多素材,最后没有呈现在正文里。具体到这次报道,关于姚顺雨来了之后整个腾讯 AI 的变化,有没有一些文章里没有呈现或者没有展开,但你觉得挺有意思、可以分享的事情?
高洪浩
1. 文章之外的内部声音
我觉得还是有的,而且挺多。大家现在看到的这篇文章,更多呈现的是这个团队、这个组织积极和正向的一面。但在一个组织里面,肯定会有各种各样的声音存在,不管是老人相对负面的情绪,还是从外部加入腾讯的人不适应的状态,其实这些都有。
甚至我们也知道,腾讯内部还有另外一个团队——微信团队也在做大模型。两个团队之间有所谓的竞争,或者也有交流,相关内容其实都没有特别展开。
程曼祺
对不一样的声音,或者偏不适应的声音放得没有那么多,是因为你判断整个变化是向好的吗?
高洪浩
如果从最主流的声音、最明确的氛围来讲,大家的状态肯定和我从去年开始跟大家聊的状态完全不同,所以整个士气明显提升了。这是非常明显的变化,相当于从最低谷慢慢上升。
但你说上升的程度有多少,它不是一次大跨步的跃进,确实是在一个持续上升的状态当中。
你刚才提到微信的大模型团队 VLM 和混元之间的关系,我觉得这篇文章没有展开,一是因为这篇文章的主题还是混元;二是因为之后会形成什么样的竞争合作关系,本身就是一个很好的观察视角,也是下一个会影响腾讯 AI 变化的主要议题。
从内部角度看,它们其实有一定错位。混元想去摸高,达到所谓智能的极限;但微信的核心任务,是把模型放进承载 14 亿用户的产品里。它的资源——包括卡的储备和算力储备——能不能让 14 亿人都用上,我觉得这是微信非常大的考验。
所以它们两个的定位还是有一点不一样。但在一个大公司里面,公司的资源是有限的,给你多一点,给他就会少一点,这种平衡也是存在的。
程曼祺
还有一个我比较好奇、也和文章发布之后的变化相关的问题。你发这篇文章的时候,Kimi K2 还没有发布。Kimi K3 在 7 月 17 日发布之后表现很亮眼,反馈也比较好。你有没有和业内的人交流,他们怎么看现在的 Kimi K2,以及接下来可以预见的国内模型竞争?
高洪浩
2. 国内模型竞争加速
Kimi K2 发布之后我们也聊了一下,发布之前其实也会聊当时行业的情况和其他模型。我觉得大家的声音不太一样。
一派会觉得,Kimi 的节奏比较稳,是稳步推进的节奏。我在文章里面也写了,可能有一部分声音会认为,一直以来大模型都是各领风骚几个月,现在后来者居上的情况可能会更加明显。
比如后面做模型的人,可以用更先进的架构,可以蒸馏更先进的模型,数据也会变得更好。大家会觉得,后来者居上可能是一个趋势。
但同时,也有很多人会觉得,现在已经没什么人在做这么小的模型了,大部分都在往更大的尺寸去走。比如传闻字节在训练 10T 的模型,所有人都在摸极致。你做这种小模型的意义是什么?
我觉得两种声音都存在。一部分人觉得 Kimi 目前的节奏是 OK 的,另一部分人会比较焦急。
程曼祺
混元三是一个多大的模型?
高洪浩
接近 300B,准确说是 290B 多,也是一个 MoE 模型。确实比较小,比较像很多公司发布模型时会发的几个版本:有最大的版本,也有比较小尺寸的版本。它更接近大家发布的小尺寸版本。
我理解,一个考虑很有可能是:我作为一个新人刚到这个公司,需要在一定周期内有所交付。我不可能来了 1 年,什么都没有。我必须交付一些东西出来,让老板看到我的结果。
另外,我的整个团队基本都是新的团队,我需要在真实实践中磨合每一个环节、每一个人,磨合大家的工作方式和整个流程。
程曼祺
那我们接下来正式聊聊姚顺雨来了之后的变化。可以先从他是怎么加入腾讯开始。你大概写了一下这个过程,可以和我们的听友简单说说吗?
高洪浩
3. 腾讯寻找年轻领袖
其实是在 2024 年。大公司每年都会去各种顶会,招聘团队会和很多研究员、科学家建立联系。当时他们认识了姚顺雨,然后把他介绍给了腾讯的高层。
但介绍完以后,其实很长一段时间没有特别多的联系。一直到 2025 年,姚顺雨因为各种各样的原因希望回国,这时候他和国内一些大厂有了联系。那时各家公司可能都有更明确的意向:你是不是可以来我这里,承担混元负责人的位置。
程曼祺
据你所知,姚顺雨回国时没有考虑过创业吗?
高洪浩
我说实话,不确定他有没有考虑过创业。但他肯定和几家大厂都有过联系和沟通,大公司他都聊过。
程曼祺
腾讯除了姚顺雨之外,要找一个新的 leader,这个背景是什么?
高洪浩
最开始是在 2025 年 DeepSeek 出来以后。腾讯高管发现,一个经验可能没有那么丰富、几乎全是年轻人的组织,居然能做出这么厉害的模型。
那时候他们意识到,自己的团队已经不再年轻,很多人比较资深,背景更多是传统的搜广推。其实所有大公司都这样。比如字节最开始朱文佳也是搜广推背景,朱文佳下面直接负责大语言模型的乔木,之前也是做搜广推的,带的很多人也有搜广推背景。
他们看到,年轻人、可能并没有那么资深经历的人,也能做出好的东西,于是定下策略:要找年轻人。
程曼祺
我听到一种说法,当时有两个选择:一个是慢慢给现在的人换血,另一个是再找一支年轻团队单独组起来,和混元做赛马。
高洪浩
对。但我们今天看到的结果,还是用了混元这套架子,只不过慢慢把里面的人替换掉。所以那个时候,年轻人已经成为腾讯瞄准的目标。
高管也有一些反思和动作。比如 Martin 会自己去硅谷,和一些比较前沿的科学家,以及 Meta、Google 里的科学家、研究员交流,希望他们能够来腾讯。
以前这些研究员、做模型的人,更多是和 VP 这个层级面试,可能到 Martin 的一级或二级就结束了。现在的变化是,Martin 也会直接参与他们的面试。这是 2025 年年初之后发生的变化。
程曼祺
这个动作确实比字节晚一些,甚至晚很多。因为字节的最高层,比如张一鸣,更早就见了很多研究员。
高洪浩
对。张一鸣当时见了很多人,可能早一年多就开始见研究员了。
其实 DeepSeek 出来以后,大家看到年轻人的风潮。我觉得,整个行业对年轻人的痴狂,应该也是从 DeepSeek 出来以后逐渐形成的。
但在 2023 年大模型刚火的时候,我印象很深。当时我们也写过一篇方六写的文章,标题叫《大模型创业潮狂飙 180 天》。里面提到,我们那会儿和一个投资人聊天,投资人讲到一个 35 岁左右的创始人,直接说太老了,35 岁以上的创始人他不见。
这个认知是慢慢扩散的,我觉得更多人形成这种认知,还是在 DeepSeek 之后。
程曼祺
除了姚顺雨之外,你知道腾讯接触过其他候选人吗?
高洪浩
他这个职位的候选人,我不知道。但腾讯其实更早就开始引入外部的人了。
刚开始做混元时,大部分是老腾讯的技术专家,很多是做搜广推的那一代人。2021 年、2022 年,整个腾讯都在降本增效,所以人手远远不够,不光人不够,卡也很不够。
程曼祺
说到这里,有一个更前面的背景。腾讯在 2016 年组建了 AI Lab,对吧?AI Lab 的人后来都走了吗?还是有一些人进入了混元?
高洪浩
4. 混元的组织起点
如果这样讲,混元最开始是有 AI Lab 参与的。
一开始,AI Lab 所在的组织叫技术与工程事业群,也就是 TEG,相当于负责整个公司的底层技术。大模型出来以后,腾讯的大模型团队就是诞生在这个事业群里的。
但当时里面有很多团队都在做自己的大模型。AI Lab 做了一个,数据平台部也做了一个,基本每个团队都在做,有点类似赛马。
那个时候 AI Lab 最懂大模型,因为里面有一支小团队一直在研究 NLP。但最后他们做出来的结果并不是最好,反而是数据平台部做出来的结果,也就是今天混元一、混元二底座的团队,在内部跑起来时效果最好。
相当于几个团队最后赛马,赛出了今天的混元。之后大家合并,把所有资源集中到混元里面。每个部门可能负责不同模块,大家组成一个联合战队,做出了最初代的混元。
所以最开始混元里面绝大多数人,都是老一代的搜广推技术人员。
再加上 2021 年、2022 年腾讯做了非常大的一轮降本增效,人手远远不够,卡也不够,这是一个有点残缺的组织。
程曼祺
我们比较早的时候有一篇报道,提到腾讯在 2022 年砍掉了部分 GPU 订单。
高洪浩
对,所以混元最开始只有 2,000 张卡。这 2,000 张卡甚至不是混元自己的,而是从广告部门匀过来的。
程曼祺
广告部门为什么会有卡?
高洪浩
因为广告部门当时也在做大模型,但做的是广告大模型,不是 Transformer 这一套,而是以前 BERT 的架构,用来做广告推荐、广告搜索。
广告是盈利部门,有钱买卡,但也只有 2,000 张,于是把这些卡挪给混元使用。
程曼祺
所以从 2024 年底开始,就补充了一些不是原来那批老腾讯的人。
高洪浩
对。第一个应该是多模态方向的谭旭,他从微软加入。后面慢慢有了从字节过来的冯佳时,以及一些科学家、研究员。
程曼祺
谭旭是什么时候加入腾讯的?
高洪浩
2024 年底。
程曼祺
之前谭旭加入 Kimi 的独家报道,也是《晚点》写的。
高洪浩
对,他在 Kimi 也没有待特别久。谭旭其实不是做大语言模型的,他在微软研究院以前主要做语音,后来做多模态。
冯佳时也是多模态。彭厚文也是那时候加入的,他在微软亚洲研究院,也是多模态方向。最近小红书上传出消息,说彭厚文离开了。
那时候开始补充一些人,思路还是找偏研究背景的人。微软亚洲研究院比较偏研究背景。
程曼祺
为什么?他们当时意识到了什么问题?
高洪浩
意识到一个组织问题:混元缺少做前沿研究、偏科学家、能够去压方向的人。
腾讯最开始的问题是,做 AI 的人先进去,然后是做工程的人,但没有原生的 AI 研究团队。
这是什么意思?好像我在做一个产品,但没有产品经理。产品经理的作用是把控方向,判断什么方向重要、什么技术路线是对的。但我没有这样的人,就不知道下一步该怎么走,做很多事情好像是在白做工,也不太清楚整个行业最关心的是什么。
程曼祺
我理解,他们那时好像没有直接去找一个业界和研究结合得比较好的人。比如字节找吴永辉,他在 Google 业界待了很多年;姚顺雨虽然在 OpenAI 待的时间不长,但之前已经有很有影响力的成果,而且 OpenAI 是业内最好的公司之一,成长速度应该也比较快。
所以腾讯是后来才意识到,要找这样一种业界和研究结合的人吗?或者更直接一点说,是到那个时间点才真正意识到自己落后了,要把大模型重视起来?
高洪浩
之前大家都会觉得大模型是一个重要方向,但从有这个认知到转化为行动,中间的速度比较慢,反应慢了半拍。
字节其实也稍微慢了一点。它真正意义上意识到这件事有效,也是到 GPT-4 出来以后,已经是 2023 年 4 月了,其实也算晚了。
但腾讯比他们更晚一些。
程曼祺
回到姚顺雨加入腾讯这件事,双方正式敲定大概是什么时候?他后来为什么放弃字节和阿里?
高洪浩
大概是在 2025 年秋天确定加入腾讯的。
他为什么加入腾讯,我在文章里面也写了。他之前写过一篇很有名的博客,叫《The Second Half》。里面的判断是,下半场的比拼不再是训练技巧,而是定义真正值得解决的问题。
要找到这样的问题,很依赖大公司有没有沉淀出足够多的 context。在他眼里,腾讯和 Meta 是最关键、拥有最多 context 的两家公司。
腾讯有很多不同场景:社交数据、办公场景,比如企业微信、腾讯文档、腾讯会议;搜索场景,比如 QQ 浏览器、微信搜索;内容数据,比如腾讯视频、QQ 音乐;还有游戏。
腾讯几乎在每个垂类都有做到头部的应用,所以它的 context 在场景和类别上非常丰富。
Meta 和腾讯有一点类似。为什么不选字节?是因为他觉得字节的用户体量虽然大,抖音有 8 亿 DAU,今日头条大概有 1 亿 DAU,红果、番茄也有 1 亿 DAU,但这些 DAU 的画像比较同质化。
同时,字节所有产品的生态都围绕推荐和分发。这些东西沉淀的数据,无论质量、丰富度,还是所谓的 diversity,都远不如腾讯和 Meta 沉淀的数据有效。
程曼祺
从这个角度看,飞书对字节来说倒是一个很特别的数据沉淀。
高洪浩
我觉得是这样,虽然量可能没有那么大,远不如钉钉和企业微信。但问题还包括它怎么去使用这些数据。
程曼祺
他在 2025 年 4 月发表的《The Second Half》,我觉得挺有意思。我们会把链接放在 show notes 里面。我猜他那个时候可能已经在考虑新的工作方向。
他当时的核心判断是,AI 到了下半场的临界点。上半场大家用各种算法和模型,攻克一些很容易评估的任务,通常是对错明确、人可以比较客观评估的任务,比如下围棋、奥赛、IMO 金牌。这些并不是真实的生产任务。
接下来更重要的是给 AI 找到合适的任务,到底用 AI 来做什么,以及攻克那些按照以往评测系统不太好评估的任务。
从文章透露出来的想法看,腾讯确实挺合适。还有一个技术判断是,他认为上下半场的分界点,在于强化学习已经表现出一些泛化能力。通过强化学习后训练,可以解决不同的任务。
高洪浩
这个设想确实很好。但腾讯实际能不能把这么多应用串联起来?文章里也提到了,腾讯以往的问题就是部门墙比较严重。
我觉得所谓的信任是相辅相成的。以前每个业务都处在发展得很好的阶段,都有增长,所以不太需要依赖外部帮助。
但今天每家公司、每个业务都有很强的 AI 焦虑。大家都想迎接 AI,也害怕被 AI 颠覆,所以对于拥抱 AI 的态度比过去开放很多。
在这个氛围下,其他部门本来就比较愿意和大模型合作。但你也需要证明自己能够带来帮助。以前的混元如果能力不够,业务部门就算给了数据又怎么样?如果模型还是拉垮,就相当于浪费了数据,双方的互信就不会建立。
以前微信肯定不会给混元数据,现在也还没有给。
比如腾讯视频,它的版权需要购买,很多版权又在阅文那边,还涉及不同结算。腾讯新闻可能会给一部分数据给混元,但合作模式还是独立项目:我单独为腾讯新闻做一个东西,这批数据只能用在这个项目里,不能拿去做预训练或其他用途,这里面也有合规问题。
微信就更不用说了,它的数据更加敏感,保护也更严格。所有这些数据,都是每个业务部门最宝贵的财产。
如果混元想和它们建立更紧密的合作,就要证明自己专业、真的有用。只有这样,业务部门才可能一点一点打开防备,建立合作。
比如我听说,腾讯新闻通过元宝的入口接入了站内 App,发现用户活跃度很快提升。用户喜欢在新闻里询问元宝,让它帮助理解或总结文章,或者在评论区和元宝互动。
当业务看到 AI 能切实提升自己的产品,就会愿意说,你需要什么帮助,我可以分享一些数据,我们可以一起合作。
再比如和平精英,混元三和它有很切实的合作,帮助做 AI NPC,在游戏里确实有明确效果。这样业务才会愿意更多地开放场景。
程曼祺
这些合作现在是混元团队里的什么人在负责?
高洪浩
他们给每个业务,或者大多数业务,派出 2 到 3 人的后训练团队,专门负责对接。
程曼祺
也就是后训练的人在负责?
高洪浩
对,专门和业务沟通、交流,帮助业务优化,业务也会提供自己的数据。
所以你能看到,在现在这个氛围下,模型层和应用层的合作发生了一些变化,腾讯内部的交流和协作在变多。
程曼祺
接下来我们展开聊聊姚顺雨正式加入之后做了些什么。我觉得可以分几个议题,也正好把时间线串起来。一个是人和组织怎么变。通常一个新的 leader 来了之后,肯定会从调整组织开始。你大概了解的过程是什么?
高洪浩
5. 姚顺雨重建混元团队
最近的一个变化,是他把多模态理解这块业务也挪到了大语言模型部。
程曼祺
这是刚发生的吗?
高洪浩
四五月份发生的。
程曼祺
所以他的范围是在不断扩大?
高洪浩
对,范围在不断扩大。
程曼祺
最终计划是类似吴永辉在 Seed 那样,整个团队都由他负责吗?
高洪浩
这属于 off the record 的内容。我自己觉得可能不一定是最终计划,老板是不是这样想我不知道,但这是一个自然可能发生的过程。
在老板非常信任你的阶段,你可以做很多事情。
程曼祺
一般腾讯的老板会信任一个人多久?如果没有拿出绝对毫无质疑的成绩,他的耐心大概有多久?
高洪浩
我觉得可能是两三年。
程曼祺
这还挺久。
高洪浩
我觉得挺久。而且腾讯老板整体上比较容易信任一个人,我觉得他的耐心算比较长。姚顺雨的 scope 也在慢慢扩大。
程曼祺
具体到人员变化上是怎么变的?前面也提到,他可能是新老慢慢替换的状态。
高洪浩
姚顺雨整体是一个挺聪明的人。他知道在老板最信任他的阶段,迅速把重要岗位上的人都换掉:预训练、后训练、评测、infra,基本都换了一遍,都是他自己新招来的人。
比如 infra 有从 Seed Infra 来的肖学峰、张弛、黄启,这些人都来自 Seed 的 infra。Seed 的 infra 被认为是行业里最强的之一。
预训练方面有刘辉丹。所以确实在发生新老更替。
程曼祺
哪些老人走了?
高洪浩
老人其实没有真的离开腾讯,更多是回到其他岗位,离开了混元。
有一个混元的朋友跟我说,姚顺雨的想法挺有意思:你可以继续待在这里,只要不碰机模,爱干什么干什么,大概是这样的状态。
所以混元没有做大规模的优化、裁员,但很多人留在腾讯以后被边缘化,自己转岗到别的地方。你要留在这里也可以,但只要不碰机模,想做什么就做什么。
程曼祺
这是相对温和的手段吗?
高洪浩
我觉得也不温和。你看一上来大概两三个月就换了一拨人,这个速度和执行力还是非常高的。
程曼祺
姚顺雨正式的汇报关系是怎样的?
高洪浩
他直接向刘炽平汇报,同时也向 TEG 总裁卢山汇报。
程曼祺
卢山实际上管他们吗?
高洪浩
管。卢山现在核心管的是多模态部分,Foundation Model 他管得并不多,大语言模型这块管得也不多,但他实际上是姚顺雨的直线汇报对象。
程曼祺
姚顺雨能招到这些人,原因是什么?他们为什么愿意加入?
高洪浩
原因很多。一个是姚顺雨本身名声在外。他从 OpenAI 出来,在圈子里有一定号召力,对一些年轻研究员来说很有吸引力,这是他发挥作用非常重要的原因。
另一个是腾讯也开始大方起来,愿意给更高的价格。
程曼祺
以前混元的待遇低于市场水平吗?
高洪浩
肯定低于。从 2025 年开始,腾讯决定在市场上抢人,愿意出非常高的价格把人挖过来。
现在和字节、阿里相比,混元给出的总包待遇肯定不低,某种程度上还要更高。因为字节和阿里的组织已经相对完善,没有太多空缺;但混元要重建,有大量空缺。
每一个位置,都可以让一个原来在字节或阿里没有办法独立带团队的人,出来在混元建立自己的团队,或者做自己想做的事情。这是混元相对于 C的、相对于千问的优势。
我这里还有空缺,你来之后就能当一个 leader,或者做更多自己想做的事情,不用在 C的里面当一个螺丝钉。
程曼祺
据你所知,现在混元团队对人才的吸引力如何?
高洪浩
总体来说,对校招生和年轻研究员的吸引力非常大,甚至很多人的联系和争抢都来不及处理。
姚顺雨的作用很大。先不管他最后做出了什么,他的名字在这里,对年轻人来说本身就是吸引力。
程曼祺
现在团队已经组建得差不多了,重要岗位也基本换了一批人。最近也有人离职。现在混元的架构负责人还是一个在读博士生,这在腾讯过去是不是比较少见,甚至可以说是破例?
高洪浩
我觉得这是非常大的变化。
看传统移动互联网业务,比如抖音负责人韩尚佑真正当上抖音负责人的时候也就 30 岁左右,抖音的市场和运营负责人支颖是 1992 年出生的。这种情况在腾讯很难发生。
腾讯重要业务的 leader,一定是在公司内部有非常深厚的积累,待了很多年,今天看可能是偏年长、偏老派的管理者。
真正年轻的管理者想在腾讯出头并没有那么容易。当然也有一些很年轻的人,但据我所知,还没有做到副总裁层级。总办减一这个层级比较少,但做到 GM,也就是 VP 再往下一级的年轻人,是有的。
程曼祺
整体来说,现在混元团队的氛围是怎样的?
高洪浩
这点令我比较意外。有非常多的人感觉到,团队已经有了一点创业团队的影子:层级很少,context 共享,信息透明,大家的反应效率比以前快,和外部其他业务的合作也有一些共同愿景,愿意为某个目标共同努力。
但不可避免地,它还是一家大公司。大公司的问题仍然存在。人员肯定远多于 Kimi、DeepSeek 这样的团队,人一多,混日子的人肯定存在,效率还是不如那些公司。
很多人是带着戒备去的,这说明一是人多,二是人的信息不透明。我突然想到一个点子,要找谁说,可能要找一圈人,这些都会影响效率。大公司固有的问题还是存在。
程曼祺
我们之前聊的时候,你说氛围也有比较割裂的一面,具体是怎么割裂?
高洪浩
一方面是新人和老人。新人来了之后,肯定会觉得自己很适应这个文化氛围,所谓“只见新人笑”。
但对老人来说,我的 scope 被砍掉了,传统的工作方式不 work 了,肯定是另一种感受。
程曼祺
这就是腾讯整个组织想要变化的方向吗?
高洪浩
大体上可以这么说。
程曼祺
你感受到大家对姚顺雨的评价是怎样的?
高洪浩
评价很两极。
程曼祺
怎么个两极?
高洪浩
什么样的评价都有。我比较关心的是,真正和他一起工作的人是什么感受。
总体评价是,他不是那种非常技术导向的人。比如梁文锋、杨志玲,他们非常 focus 在技术上,甚至很大程度上只管技术。
字节那边,张一鸣会管产品、组织和管理。但我接收到的评价是,姚顺雨非常重视组织。他不会直接否定别人,也不会在技术路线上给出非常 sharp 的见解,而是把这些事情交给下面的人,自己更关心组织。
他经常在内部说,做大模型,组织非常关键,很多问题归根结底都是组织的问题。
程曼祺
这让你有点意外吗?
高洪浩
我本来没有预设,对我来说确实有点超出想象。他很年轻,1997 年出生,今年 29 岁。
我觉得一个特别年轻、又是研究出身的人,不一定会特别在意组织。但说实话,他真的比我想象中老成很多。
程曼祺
你感受到的反馈是,和他一起工作的人也觉得他比想象中老成?
高洪浩
他也有年轻的一面,比如嘻嘻哈哈、一起打篮球。但在真正的认知上,他会想:我要关心组织,要怎么快速在一个组织里证明自己,拿到 scope。
如果背后没有高人指点,一个年轻人不一定会想这么多。即使有人指点,也要有这方面的悟性。大家对他重视组织这一点的反馈特别多。
程曼祺
我获得的一些反馈也有重合。和梁文锋接触过的人会评价,两个人的风格不同:梁文锋在技术上会深入细节,比较 sharp,其实也不太想管别的事情,但现在不得不处理很多事。
研究员更多的反馈是,姚顺雨好像没有他们想象中在技术上那么 sharp。但除此之外,他们会感受到他非常在意组织。
高洪浩
我在文章里面也写了,大家普遍的感受是,如果把这个组织形容成一个层级,他更关心最底层——不是底层人,是一线同事的感受。
他会关心最年轻的研究员,包括实习生,经常找他们要反馈。他们提出的反馈,他能很快接收到,然后和相关业务负责人调整。
比如数据平台不好用之类的问题,他可以非常快地反馈和处理。我觉得这也是组织悟性的一种体现。
程曼祺
从这个角度看,他也适合创业。但创业需要一个很核心的驱动力,我不知道他有没有创业的 drive。
如果按照他设想的理念,大模型下半场需要很多 context、数据沉淀,这对创业公司不一定是优势。
高洪浩
不一定。如果你找到一个值得解决的问题,而且这个问题很好、大公司在这个方向又没有积累,创业公司还是可能有机会。
只不过目前的情况下,直接从应用层切入,可能不是特别好的时机。现在变化太大,还不太清楚。
程曼祺
他很在意一线员工的感受,所以确实没有听到太多关于他技术判断的评价。
他最近比较关注哪些趋势?
高洪浩
这要分阶段。四五月份的时候,混元三马上要发布,他当时的精力可能还在 infra 上:怎么把 infra 的效率做得更高,支撑接下来发布的新模型。
在技术上,像文章里写的,他会觉得现在大模型真正可以探索的方向相对有限,更希望和业务结合,找到业务里的实际问题,然后在后训练、强化学习这些方向上寻找突破。
程曼祺
据你所知,姚顺雨和刘炽平现在大概怎么沟通?他和腾讯高层谁沟通得比较多?是什么样的沟通、讨论和协作方式?
高洪浩
那是他们两个人的事情,我怎么会知道?我不知道。
程曼祺
他们有定期的 AI 会议吗?
高洪浩
总办会定期开,每个月都有,但总办会并不是完全关于 AI,而是每个业务都有总办会,也有临时会议。
我知道从 2025 年开始,Pony 要求混元相关的负责人,每周向他汇报。具体是总监以上还是 GM 以上,我不确定。
我觉得他们的沟通频率应该挺高,具体姚顺雨和他们之间可能每天都有沟通,发个信息什么的。因为他们也在香港,姚顺雨也经常在香港,所以联系应该很频繁。
程曼祺
回到最开始的问题,姚顺雨在腾讯里最大的支持者是谁?
高洪浩
Martin,刘炽平。
程曼祺
Martin 可以帮他搞定什么?
高洪浩
作为一个改革者,有几个点很重要。
第一是信任。有了信任,就能获得很多放权,包括钱的权利、人的权利,在 AI 上还有卡的权利。
如果有 Martin 的信任,我可以用最多的钱招最好的人,换掉老人。如果没有 Martin 的背书,这些东西落实不下去。
第二是时间。我可以给你尽可能多的时间。比如文章最开头提到的,我可以承诺你多长时间不看 benchmark。
第三是卡。现在腾讯的卡,文章里面也提到,基本由两个人协商决定:一个是 TEG 的卢山,一个是 Davis 林锦华。他是总办成员,也是腾讯的战略负责人,同时负责腾讯广告。
战略和广告两条线往上走都是 Martin。这样说应该很清楚了。
所以我觉得,姚顺雨得到 Martin 充分授权和信任以后,施展空间相对比较大。当然不是 100% 的施展空间,但相对来说比较大。
但有一点,老板的承诺只是承诺。我们容易天真地觉得,老板信任你、愿意给你这些权利,这就是一件永恒的事情,但其实不是。
老板的信任取决于他的耐心。如果他对你有两年的耐心,你就有两年的信任度;如果他只有半年的耐心,那你就只有半年的时间。这个东西是很飘忽不定的。
对于改革者来说,最聪明的做法,一定是在老板最信任你的阶段,做最激进的事情,而不是慢慢来,消耗了半年的耐心以后再做。越往后,做事情的阻力肯定越大,除非你能持续拿出成绩,让老板的耐心不断延长。
否则越往后,做事的难度越高。你得不断证明我是对的、那个是错的,陷入自证。对一个改革者来说,这是非常痛苦的。
程曼祺
前面聊的是组织和人。接下来聊聊他来了之后,混元在模型成绩和成果上的变化。
他加入之后打出的第一炮就是混元三。整体来说,腾讯对混元三这个结果满意吗?是什么态度?
高洪浩
6. 混元三重振士气
内部对于混元三的预期本身就不高:这是一个小模型,它能解决的问题有限。但核心目标是把组织磨合好,让团队士气重振。
所以这个目标达到了。现在从内部视角看,基本算达到预期。对总办的老板们来说,结果是 OK 的。
程曼祺
OK 不是超出预期,而是符合预期?
高洪浩
对,是符合预期。
有一个细节。当时姚顺雨刚去的时候,内部从上到下的口径和传递下来的信念是:以前的问题我们都知道,只是没有找到合适的人,而且做改变需要时间。现在他来了,一切已经 ready 了,所谓超越千问,只是时间问题。
这是当时的预期。混元三发布之后,这个预期至少没有改变。
程曼祺
你觉得这个预期被强化了吗?
高洪浩
我觉得还是符合预期,在他们预期的节奏当中。他们的判断也挺清醒,比如接下来的混元四未必能真正进入第一梯队,还是有差距,只不过差距正在缩小。再往后,才可能拿出真正有影响力的模型。
程曼祺
这是腾讯管理层本来的风格,还是姚顺雨团队的预期管理做得很好?
高洪浩
当然会做预期管理。比如混元三发布之前有一个混元三 Preview,那非常明显就是一个做预期管理的版本,是 4 月 20 多号发布的。
我来了大概半年,要定期交付一些东西。这个预期管理既是对老板的,也是对团队的。
如果混元三相比混元三 Preview 又有一个明显提升,这也是很好的预期管理节奏。Preview 对很多人来说依旧没有那么好用,但相比混元二已经是质的飞跃,这对预期管理非常重要。
程曼祺
高层对他的想法是,他来了之后追赶上其他公司指日可待。这个压力应该很大。
据你所知,同事眼中姚顺雨是怎么处理和消化这种压力、这种高期待的?
高洪浩
打篮球。他经常组织同事一起打篮球。
整体上,他周围的人不太能感受到他身上紧张的氛围,更多能感受到他雷厉风行、非常 sharp,是一个内强外强的人。
有的人可能是色厉内荏,但他不太是。他从内到外都表现得比较决绝。
程曼祺
所以同事眼中,他相对从容,感觉心里有数?
高洪浩
对。我至少聊下来的大部分人,都没有感受到他慌张或者焦虑。
程曼祺
他的决绝具体表现在什么地方?
高洪浩
比较强势。比如从换人就能感受到,几个关键岗位说换就换,完全不顾及关系和过去的利益绑定。
当然,也有一些人政治敏感度很好,在他刚去之前就和他建立了比较好的关系,现在仍然在不错的位置上。
程曼祺
你是说徐谦和姚顺雨建立了比较好的信任?
高洪浩
对。
程曼祺
据你所知,他们认为混元三不足的地方是什么?接下来混元四会增强和补充吗?
高洪浩
混元三就是一个中规中矩的小模型,尺寸也就这么大,在很多任务上还没有做得那么好。
我觉得混元四核心会补充多模态能力,把文本模型的规模做得更大一些,数据也肯定还有优化空间。
数据和 infra 都是刚刚重建的。整个混元的 infra 用了 3 到 4 个月从零重新搭了一套体系,这些东西还要继续优化和磨合。
程曼祺
第三个可以展开聊的,是模型和产品的关系。前面也提到,姚顺雨想推动模型和产品深度合作。
有一个很具体的事情,是他正在做一个整个公司都能用的强化学习平台,希望腾讯各个产品都能在这个平台上做后训练,让业务和模型之间的联动更有机。
你可以先给大家简单讲讲,现在腾讯有哪些主打的 AI 产品?
高洪浩
7. 腾讯整合 AI 应用
应用层产品现在讨论比较多的,一个是 Work Body,他们的办公 Agent;一个是 Code Body,做 Coding 的平台;还有 Chat Box,也就是元宝。
此外还有知识库产品 ima。应用宝团队做了 Marvis,也是一个 Agent 产品,但权限比较大,因为他们和微软有深度合作,所以它在 PC 上的权限比较大。Marvis 是桌面端的 Agent。
还有专门做设计的 Agent。前段时间他们还做了一个有点像朋友圈的东西,叫元宝派。
程曼祺
元宝派还在吗?
高洪浩
在,但可能只有一两个人还在做,DAU 大概 3 万。
程曼祺
DAU 3 万是什么情况?
高洪浩
这也是大公司的一个问题。当你发现一个方向错了,不会直接承认失误、直接砍掉,而是让它慢慢挣扎,找一些方向,最后再止损。对大公司来说,这种事情比较难做。
程曼祺
元宝派是在元宝里面的?
高洪浩
对。
主要的产品可以先算 WorkBuddy、CodeBuddy、元宝和 ima。这些都在 CSIG,也就是云与智慧产业事业群。
除了微信的小微、企业微信的 Agent,这些是在微信事业群里面,其他核心的 AI Native 产品基本都在 CSIG。
这也是调整之后的结果。最开始有一部分产品在 PCG。比如 ima 是 QQ 浏览器团队孵化出来的,QQ 浏览器原来在 PCG,后来 QQ 浏览器、搜狗搜索和 ima 一起挪到了 CSIG。
腾讯文档现在也基本和 Work Body 整合、融合。腾讯文档原来在 PCG,后来也挪到了 CSIG。
程曼祺
这种层面的调整,在腾讯以前比较常见,还是比较少见?
高洪浩
不多见。以前的业务划分非常明确:做云就是做云,做技术就是做技术,做内容就是做内容。
比如 PCG 更多是对标字节的那些产品,做内容、做信息流,所有东西归在一起,和 CSIG 没什么关系。
在我去年写的《腾讯在 AI 拐点到来前的 700 天》里也提到过,当时腾讯想整合所有 AI 产品。大概是老板提出一个问题:有没有人能把这些产品接起来,去打这一仗,用元宝接住所有 AI 应用?
最后还是 CSIG 的汤道生站出来了。之后这些原生 AI 产品基本归到 CSIG,方便统筹和协调。
程曼祺
我在想象那个画面:是汤道生往前迈了一步,还是所有人都往后退了一步?
高洪浩
不好说。
但高层想把它们统一起来,本身也是一个趋势。阿里也把很多应用交给吴泳铭那边,模型分开。字节一开始就有一个例外,豆包不在 Flow 那边,而是在江南那边。
程曼祺
现在腾讯这些主打的应用,好像都是生产力方向,没有特别偏娱乐、内容和陪伴的产品?
高洪浩
字节做得比较多,腾讯现在基本是工具和生产力方向。
娱乐、陪伴类也有一些,但更多还是和原来的应用结合。比如和平精英和混元的合作,本质上就是游戏里的 AI NPC。
腾讯音乐会做一些音乐生产产品,但帮你生成音乐,还是偏工具。
腾讯视频的火龙,是 AI 漫的平台,也算生产工具和消费工具:你可以在上面看 AI 漫,也可以自己生产。
单独的娱乐内容相对比较少。
程曼祺
模型层面,混元是一个主打的模型。混元里面又有视频、语言、声音、世界模型和 3D。微信有自己的模型,IEG 游戏部门也有自己的世界模型。
混元的视频生成、生图和 3D,现在是不是还不在姚顺雨负责范围内?姚顺雨主要负责动态理解?
高洪浩
对。
程曼祺
前面聊到模型层和应用层合作更紧密,尤其是强化学习平台,希望共享腾讯各个业务和产品的数据。这个设想挺好。你知道他们现在到什么阶段了吗?
高洪浩
准备今年推出,应该还没有大规模推开。
程曼祺
据你所知,他先准备拉哪几个种子用户?
高洪浩
得先在内部找几个人。核心应该是 Work Body 和元宝,因为它们和 CSIG 的绑定最深。
程曼祺
WorkBuddy 和元宝现在的负责人是谁?
高洪浩
WorkBuddy 的负责人是原来腾讯云下面的负责人 Betty。元宝的负责人是吴祖荣,他现在也兼任腾讯会议负责人。
这两个人加入腾讯都比较早,在内部也比较出名,属于比较能打的人。
程曼祺
据你所知,姚顺雨和他们沟通得怎么样?
高洪浩
沟通和联系非常紧密。比如春节那次 Chatbot 大战,姚顺雨基本每周都会和元宝团队沟通。
现在他也经常和 Work Body 团队沟通。Work Body 非常重要,因为混元训练的很多数据要从 Work Body 那边来。所以这两个团队应该是目前联系最紧密的。
程曼祺
前面聊的都是变化中比较积极的一面。最后想聊聊腾讯要把 AI 大模型做得更好,可能面临的悬念、变数和不利因素。
第一个和刚才的问题紧密相关:模型和应用的协作。在腾讯这个体系里,最重要的应用显然还是微信。你可以讲讲现在了解到的混元和微信之间整体是什么关系吗?
高洪浩
8. 微信倾向独立建模
完整描述的话,其实没有很直接的关系,基本上没有关系。
硬要说混元和微信,微信的 Agent 里面有部分调用混元的能力。
程曼祺
微信的 Agent 是小微。小微现在是全网都能用,还是灰度?
高洪浩
现在是灰度,大概只能支撑 100 万量级。
程曼祺
我已经可以用了。它可以调用混元?
高洪浩
对。它应该有 3 个模型:微信自己的大模型、DeepSeek 和混元。根据不同场景或不同能力,选择调用不同模型。
程曼祺
微信上元宝经常出现的一个地方,是大家在评论区 @ 元宝,让它总结文章。现在这个用的已经都是混元了,对吧?
高洪浩
对。它走的还是元宝入口。元宝之前底层模型一个是 DeepSeek,一个是混元;现在绝大部分用户的问题,底层模型基本都是混元。
元宝也没有接 DeepSeek V4,现在里面的 DeepSeek 还是 V3。这也能反映出,腾讯还是想推混元这个模型。
程曼祺
除了这些模型调用,其他合作比较少?
高洪浩
如果说整个微信事业群层面的合作,或者模型和模型之间的合作,其实没有那么多。
但业务之间会寻求合作。混元的能力更多,也做多模态;微信的某些业务会自己去找混元,我知道他们确实有一些合作上的联系。
程曼祺
他们之间有人员流动吗?比如混元的人去微信 VLM,或者 VLM 的人去混元?
高洪浩
有,双方都会有这种情况,属于内部活水。
程曼祺
谁的行情高一点?从混元去 VLM 的人多,还是从 VLM 去混元的人多?
高洪浩
说实话,混元的待遇肯定比 VLM 高很多。
一方面,微信给不出那么高的工资。混元现在相当于重新搭建体系,所有职级和标准都可以重新定;但微信原本有一套薪资体系和规则,要重新调整并不容易。
另一方面,微信从传统上也没有那么激进,不太愿意从外部找很多人,更希望从内部培养自己的人,成为中坚力量。
程曼祺
VLM 现在的团队构成是怎样的?
高洪浩
核心还是最开始的技术团队。他们很早就发布过技术报告,在大模型和语音方向做过研究。
核心负责人还是微信的技术负责人 Harvey,也就是周浩。他从微信刚成立时就已经在里面了。
程曼祺
微信未来会补充一些新人吗?比如像混元这样,补充更多 AI Native 的人才?
高洪浩
据我所知,确实有一些沟通。比如 Grok 之前的戴子航,他们也会去外面看看,有没有更合适、能独立带起整个大模型团队的人。
但微信和张小龙的要求都很高。你是不是真的能够适应微信的文化、适应微信的规则,也不好说。所以想招一个这样的一号位并不容易。
程曼祺
子航看过凯文·凯利的《失控》吗?
高洪浩
哈哈,《失控》。可能戴子航没看过这本书。开玩笑,因为以前有传闻说,微信面试时会喜欢问你有没有看过凯文·凯利的书。
程曼祺
张小龙自己对大模型的理解和参与多吗?
高洪浩
现在非常多。内部团队普遍也有一点焦虑。
小微上线内测以后,怎样找到一个适合微信的方向,是一个问题。微信有自己的束缚:它是一个 14 亿用户的全民级产品,所有规则都已经定得很死。你只能在微信的规则里跳舞,怎么跳脱这些规则,真正形成 AI Native 的能力,我觉得很难。
比如用 Agent 点餐、打车,我是不是真的有这样的需求?直接调用小程序点餐,效率是不是真的高?内部其实没有明确判断,只是说现在有这样一个生态,可以尝试用这种方式 AI 化。
最终怎么走,更多还是交给用户。微信是极其用户导向的团队,用户喜欢什么、决定用什么,团队就看用户反馈。
程曼祺
你自己用了一段时间小微之后,觉得它什么地方好用?
高洪浩
在一些和微信场景强相关的地方,确实可以用到,但我自己的需求没有那么大。
比如我们聊天时,你发给我一段话,里面有一些词我不懂,我可以直接点击聊天界面或者那段话,然后询问小微这段话是什么意思、这个词是什么意思。
这类和聊天场景更相关的应用比较直接。你发过一篇文章,我可以直接丢给小微,让它总结文章讲了什么;还可以总结聊天对话、群聊记录。
但到底有多少人有这样的需求,我不清楚,因为我自己没有太多这样的需求。
程曼祺
这种需求带来的数据质量,或者数据类型,怎么样?
高洪浩
我不太确定你指的是什么。
程曼祺
比如你刚才说的场景,我想到一种可能:在人际关系中,有时候不知道怎么回复。比如男女朋友吵架,或者上司给你发了一段有压力的话,你觉得 AI 真的能帮你很好地回答吗?
高洪浩
肯定会有人去问 AI,但他只是看一个参考,不是 AI 说什么就直接照搬。这样的使用情况可能不少。
但我在想,这种数据对模型提升的作用有多大。我觉得可能没有什么真实作用。
我还尝试过用 Agent 点餐,调用麦当劳、瑞幸的小程序,让 AI 帮我点餐。我觉得效率太低了:等它搜索到想点的东西,一步一步确认,最后到支付环节,我自己已经手动点完 3 次了。
程曼祺
而且它没有完全把你解放出来,你还得在里面点确认。
高洪浩
对。第一次做完之后,地址之类的信息都有了,但最后支付还是需要自己确认。
程曼祺
但你也没试第二次。你有重复点餐的需求吗?
高洪浩
我没有这样的需求。
所以我觉得,关键在于想象力到底能发挥到什么程度。比如微信之前做电商,推出了小蓝包,我觉得那是一个很突破想象、又很微信 Native 的能力。
程曼祺
就是可以给别人送礼物的那个功能?
高洪浩
对。但很多事情还是有规律的。电商是一个重运营的事情,有大量脏活累活要做。按照微信的做事方式,它可能不太愿意做这些事情,更想四两拨千斤,这里面就有 gap 和矛盾。
小蓝包可能一时很火,但我不知道后面持续的量怎么样。它在某些特定需求里能用,但肯定没有办法成为主流电商平台,因为上面的商品太少了。
程曼祺
我之前也用过几次,某个品类里能选的东西特别少。
高洪浩
对。
程曼祺
说回 AI。你觉得混元和微信的 LLM 团队,长期来说会怎么走?会一直并存吗?
高洪浩
大概率会长期并存。
程曼祺
微信 VLM 现在释放了哪些模型成果?
高洪浩
他们在今年 1 月发布了一个 258B 的 MoE 模型,应该比混元三稍微小一点。
他们没有公开发布,但会在技术博客上更新。它不是对外提供 API 的状态,而是自己使用,主要用在小微 Agent,以及微信搜索等微信自带的场景里。
程曼祺
他们最近 7 月 14 日还更新了一篇技术文章,关于浅空间计算扩展。
高洪浩
对,核心就是在极致资源效率下怎么做。和混元分开,是因为他们要考虑在 14 亿人的环境里使用。
程曼祺
为什么微信不用一套底层模型?比如在一套底层模型上做面向微信的优化,微信团队主要去做优化部分?
我知道 Martin 和小龙也聊过这个事情。小龙的态度大概是,他不觉得混元是第三方,肯定不同于 DeepSeek、千问、Kimi 这些外部模型;但他极度在意微信本身的隐私和用户数据,所以更倾向于自己做一个模型,能够更可控。
高洪浩
他们内部也在讨论、探讨一些方式,比如联邦学习等技术,来规避使用混元时的数据和隐私风险。
程曼祺
我觉得从技术和资源使用效率上,腾讯没有必要从头训练两套预训练模型。只做一套,数据仍然由腾讯自己控制。
高洪浩
我理解,这涉及腾讯的组织特点。腾讯这个中枢对下面有掌控力,但不会干预你到底要不要在集团体系下大一统地使用某个东西。
腾讯不太会要求所有人一定怎样做、一定不能做什么,或者一定使用混元。大家过去经常把腾讯比作美国的联邦制:每个事业群自主性很强。
游戏部门也在做自己的世界模型,混元也在做 3D 和世界模型。上面不会强制要求大家必须使用同一套东西。
但现在不一样的地方,是有一个很强的限制:算力。
程曼祺
对每个中国公司来说,即使是特别大的中国公司,倾尽全公司的资源,能获得的算力和海外头部公司相比,至少还是差一个数量级,甚至可能差两个数量级。这是很严峻的情况。
高洪浩
所以我不知道后面会怎么变。我觉得这就是腾讯组织带来的惯性:每个事业群自主性和独立性比较强,真正遇到这种情况时,能不能拧成一股绳?
目前来看,我没有看到像字节那样,最顶层对下面所有业务群有很强的掌控力。
程曼祺
面对 AI,腾讯拧成一股绳有必要吗?先不说能不能做到,你觉得有必要吗?
高洪浩
我觉得 Martin 肯定认为有必要。
程曼祺
你从什么迹象看出来?
高洪浩
我觉得有一部分人认为很有必要,而且这种必要不是从 AI 开始才出现的,而是从字节出现以后,他们意识到这件事的必要性。
字节的核心是把所有资源拧成一股绳,所有数据打通,所有东西形成循环。它的主干是连在一起的,上面的应用再分开。
我和腾讯内部的人讨论过,他们过去很引以为傲的合作方式——跨部门协作,每个人拿出自己的优势,一起做一件事——确实有价值。
但这种事情走到极端,就是极端的分享领导权。它对抗的是非常集权、自上而下、快节奏的世界,而后者需要统一领导,不是协调各种资源和利益。
内部曾经举过《黑鹰坠落》的例子。电影里,美国三角洲部队在索马里完美执行了抓捕任务,但抓捕之后要等游骑兵支援。游骑兵同样精锐,却陷入自己的战斗,无法很好支援三角洲部队,最后导致任务惨败。
相比之下,比如美国今年抓捕马杜罗,虽然行动中用了空军、海军,但整个行动由三角洲部队自上而下驱动,而不是部门之间协作,所以完成了抓捕。
他们会意识到,部门和团队之间的协作,在竞争没有那么激烈时是比较好的方式;但面对字节这种自上而下、集权很强的公司,可能会出现问题。
程曼祺
看来腾讯对三角洲的研究很多。
高洪浩
毕竟做了《三角洲行动》。
程曼祺
正好回应一下文章发布后的一条高赞评论。
评论先观察到,当年微信是自己跑出成绩,而不是先获得集团授权。微信是在广州跑出来的,王者荣耀是在成都跑出来的,因为游戏工作室在成都;而腾讯总部做微博、电商、搜索、云、微视都失败了。
当时微视还是 IEG 和 PCG 的负责人任宇昕带头,资源比今天姚顺雨更强,但也失败了。
评论后面说,从文章看,姚顺雨的思路在腾讯待不久,也注定失败,因为他选择了违背腾讯两大基因的路线:一是强技术路线,二是从集团层面向下推动业务。这两条路在腾讯都没有成功过。
你怎么看?首先,这个事实成立吗?腾讯总部真的做不成新业务?
高洪浩
这本身不太符合事实。QQ 是不是在总部做出来的?早年腾讯网、腾讯新闻、QQ 音乐,都是腾讯做出来的。
但这个评论确实说明了一个问题:在大公司内部,应该怎么创新。
我以前和微信的朋友聊过。有人问张小龙,为什么微信会诞生在广州?他的回答是,正因为在广州,不需要知道深圳的人在做什么,反而可以安心按照自己认为正确的方式做东西,否则可能就不会有微信。
这也是大公司内部创新的困境:到底是在备受关注、拥有大量资源的情况下做出来的东西更好,还是小资源、少干涉、没有微操的情况下更可能成功?
张小龙很喜欢凯文·凯利的《失控》,其中一个核心观点就是,很多创新发生在边缘地带。
每个公司都有这种情况。比如钉钉最开始的时候,千问最开始在阿里内部,可能高层确实管得没有那么多,团队拥有很多空间。
但每个人的看法不一样。千问内部也有人认为,至少 2023 年之后,很多资源已经集中到千问这边了。
程曼祺
混元团队主要 base 在深圳吗?
高洪浩
主要在深圳,北京也有一些人,基本都在深圳。
程曼祺
你自己怎么看腾讯 AI 接下来的情况?如果接下来再写腾讯的题,你会关注什么议题?
高洪浩
一个组织改革,或者一个空降的人进入组织,是有周期的。每个阶段面临的挑战都不同。
现在这个阶段,也就是我写文章的阶段,是姚顺雨在腾讯最受信任的阶段。这意味着他可以大刀阔斧做很多调整。
做人事调整、组织调整、战略明确,相对来说都容易。你有权利、有想法,就能执行。
但过了这个阶段,比如再过 300 天,他面临的挑战就不一样了。
一方面,他需要拿出更令人惊喜的东西;另一方面是文化问题。人员调整完成、团队进入轨道之后,开始深入协作,和更多团队做 co-design,腾讯大的组织文化也会渗透进这个小团队。
到那时,怎么兼容它,挑战和难度会更大。
可以拿陆奇的改革举例。陆奇最开始也是大刀阔斧做改革,调整组织、调整战略,提出稳住主航道,也就是搜索,同时决胜 AI。
但想法落实到实际之后,出现了大量百度核心业务高管流失。这说明组织调整没有充分考虑和原有组织文化的兼容性。
怎么让调整和人匹配,可能是更难的事情。
程曼祺
当时陆奇加入百度,大概是 2017 年。那时 AI 还是收入非常远期的事情。无论自动驾驶还是计算机视觉,都不会在那个阶段带来足够大的收入增长,撑不起第二曲线。
现在 AI 似乎已经被初步证明了,但也有变数。我说的是整个 AI 行业,不是腾讯。
比如有些公司说二季度、三季度都能盈利,但另一方面也有数据显示,它们面临很强的竞争和价格战压力。AI 除了 Coding 之外,还能不能更快扩散到更多场景?
高洪浩
有更多场景应该没有太大疑问,最终会进入很多场景。但具体扩散路径和节奏,不太容易看出来。
最近还有一个动向:SAP、OpenAI 和很多大型 PE 用十几亿美元、几十亿美元做专门部署的合资公司。
这说明即使有最强模型,要服务大 B 客户落地,也不是模型自己自动完成的,还需要很多 FDE,也就是前线部署工程师,而且人数不少。
所以整个行业后面的节奏还会有变数。它会跟行业本身的变化走。如果长期找不到很好的商业化前景,就很难说。
程曼祺
什么事情发生,可以判定腾讯在 AI 竞争中算是后来居上?
现在我觉得腾讯大体上还在追赶。相比字节和阿里,结果很明显:它要拿出第一梯队的模型。
高洪浩
这涉及一个问题:如果不考虑全球,只算国内,第一梯队到底有几家?
这是我一直困惑的地方。大家总会说,谁能留在牌桌上。Seed 和 DeepSeek 是被提到最多的两家。
我们接触很多不同公司的人,不管字节内部还是外部,大部分人都会认为字节的 C的团队一定会留在牌桌上,因为它有最好的资源、最好的人才、最多的钱、最好的 infra。
但它确实没有做出 Kimi、DeepSeek、千问这样的口碑,也没有做出特别有影响力的模型。Coding 上更不在第一梯队,可能连第二梯队头部都不一定在。
程曼祺
大家认为它会留在牌桌上的依据是什么?
高洪浩
这是我一直的困惑。大家很容易拍脑袋说谁最有可能成功、谁最能留在牌桌上,但依据到底是什么?
可能是资源、人才密度、组织形态、老板重视程度。但如果让我自己判断,我会把 C的列在里面,只是不知道这种感觉的来源是什么。
程曼祺
我觉得有一个来源,是对短期历史惯性的记忆。字节在过去 5 到 8 年是中国最强的科技公司,在信息技术领域最强,赚钱能力强,组织力也强。
高洪浩
这确实是很大的来源,但它是偏感性的。
回到腾讯后来居上,就是要拿出第一梯队模型。但这个标准套在字节上又不完全适用。字节在 Coding 和大语言模型上,也没有一个一锤定音的最强模型,不像字节的视频生成模型那么惊艳。
但大家仍然认为字节在 AI 竞争中属于第一梯队,可能是因为它在某些环节处于第一梯队:人才密度最高、卡最多、infra 是头部。
对腾讯来说,确实需要拿出比较好的模型,因为它没有字节那种光环。阿里也没有,但千问在口碑和开源社区调用量上有一定认可。
整个公司层面,很多创业者、投资人还是更相信字节。一个明确指标是,字节出来的人更容易融资,不管是研究背景还是产品背景。
这是因为过去一段时间,字节一直证明自己很强,组织和理念也比腾讯、阿里更先进。
我上次和一个做 AI 内容应用的创始人聊到一个话题。他见过很多抖音早期的人,做内容很多年。他认为中国互联网公司里,网易的人在内容上有能力,但他们单独出来很难融资,去别的公司做联合创始人可能还行,自己创业就比较难。
字节过去几年是少数一直在做新产品的公司,番茄、红果都是从新产品做到过亿 DAU。它一直在做出成功的新产品,所以大家天然觉得这家公司有活力。
现在腾讯很多团队大量引入字节的人,替换过去的老团队,改变组织方式、产品方式和理念。
但字节的人出来也有双刃剑:他们之前做很多事情,是因为字节内部有底座可以使用,有一个高效的 loop。这个 loop 大部分不是来自个人,而是来自公司多年的积累。
这其实也是张一鸣最开始强调的:产品成功不是任何一个人的成功,而是整个公司的成功,是一个体系的成功。
所以字节没有所谓“抖音之父”“头条之父”。张楠也不能简单说是创造抖音的人。很多公司里,某个产品的个人形象很强,但字节没有这样的形象。
程曼祺
这个话题展开得有点远,我们回到 AI。
9. AI 竞争等待转折
今年 1 月,你写过一篇 BAT 三家 AI 公司的情况,标题是《字节、阿里、腾讯 AI 大战全记录:一场影响命运的战争》。我觉得今年年底可能还会写类似报道。
如果今年再写,你会怎么看这三家之间的竞争?可能的主题是什么?
高洪浩
现在没有那么清晰。
去年大家都在做 Chatbot,有 DeepSeek 这个变量。今年当然有 Coding,但 Coding 的竞争是不是真的像 Chatbot 一样你死我活,我还没有感受到。
程曼祺
你觉得 Chatbot 是你死我活吗?
高洪浩
当时大家的心态是你死我活,当然今年已经被证伪了。去年的心态是,Chatbot 是一个超级入口,我抓不住可能就没了。
比如豆包可以延伸成电商入口、搜索入口、娱乐入口。春节时红包大战体现得特别明显。
这可能是 To C 和 To B 的区别。To C 理论上更有网络效应,也更有赢家通吃的效应。
Coding 更偏生产力工具。如果说到 To B,我经常会想,它是不是会回到当年的 SaaS 化。从商业角度看,如果是 SaaS 生态,想象空间可能比较有限。
程曼祺
你说的 SaaS,指的是它什么特点?
高洪浩
一个是增长比较慢,第二是收入表现不如 C 端产品。
还有一个特点是,它不会一家独大,一个行业里肯定有几个头部。
当然现在 Coding 的扩散非常快,增长速度也很快。理论上,等扩散到能用的人都用到了以后,增长可能不会那么快,但这个节奏很难判断。
它的体量肯定远小于互联网广告,因为使用 Coding 的人就是这么多。未来当然会有更多人使用,也不一定要直接用它写代码,通用 Agent 可能会出现。
我觉得核心已经不在 Coding,而在通用 Agent。Coding 支撑通用 Agent,这个东西到底有多大的想象空间?
程曼祺
Coding 对应的通用 Agent 用户,其实就是白领、办公室人群,这个数量可以算出来。
高洪浩
对。只不过国内现在最核心的程序员,很多用的还是国外模型。
程曼祺
我原本也以为这样。
高洪浩
但据我所知,在字节、腾讯、阿里内部,大量程序员也使用豆包、千问进行 Coding。
程曼祺
也用豆包编程?
高洪浩
对,也用千问。现实和我想象中有一点差异。
很多人主力用海外模型,比如 OpenAI 或 Anthropic 的模型,同时用国内开源模型补充性价比,完成一些相对简单的任务。
我还和 Work Body、Trae、Qoder 的人聊过。现在普遍存在一个问题,就是公司的坐席率。
比如公司有 1 万名员工,采购产品时按 1 万个坐席买,但真正用上产品、每天使用的员工比例并不高。
Work Body 和 Coding 产品现在有按坐席卖的方式,也有其他方式,但如果按照坐席率,或者 C 端付费情况来看,都没有那么乐观。
目前白领工作的场景,增长率斜率还是很低。从程序员到更大众的专业人士、白领用户,这条路还很长,至少还没有到一个明显的拐点。
程曼祺
有时候拐点的判断很难。去年 3 月也算一个拐点,至少相比之前是。
有时候新的拐点来了,回头看前面的东西,就会变成“回首向来萧瑟处,也无风雨也无晴”,没那么明显了。
高洪浩
后来我意识到,今年大家觉得 Coding 很火,所有大公司都转向 Coding,但其实去年年底这些公司已经意识到了,也已经在转。
Anthropic 突然起来,其实是在去年年底或者下半年,4.6 的时候,那几家公司都已经在转了。只是 Coding 没有破圈,仍然局限在一个小圈子里,所以媒体和更广泛的认知会觉得大家是今年才积极转向 Coding。
程曼祺
这让我想到今年年初,我和戴雨森录过一期播客,里面讲了很多 Coding 怎么支撑通用 Agent,怎么让大模型在数字世界里相当于有了手,可以做很多事情。
他当时说,未来已来,但是分布不均。
高洪浩
我觉得确实如此。2025 年年初,核心 AI 圈的人都会觉得 Coding 很重要,因为当时发模型基本都要评 SWE-bench。
但意识到它重要,和把它作为最重要的战略、把全部资源投入进去,是两回事。
海外可能 Anthropic 比较明显。国内智谱大概从 2025 年上半年开始,把 Coding 作为特别重要的方向,Kimi 也是。你也看到这几家最近在 Coding 上的成果比较好。
程曼祺
现在这个时间点,确实很难做特别具体的预测。看你年底能写出什么文章。
高洪浩
我在想,今年下半年可能会有非常大的转折。
程曼祺
有可能。现在美股已经有很大波动了。你说的是泡沫吗?
高洪浩
泡沫的转折不只是在资本层面。
我觉得可能会发生一个大的转折:从程序员这个群体来说,AI 基本验证了确实可以替代很多工作。但再往下,更广泛的知识工作者和白领能被替代多少,以及速度够不够快,还没有验证。
如果扩散节奏跟不上之前的速度,预期也会掉头,这本身就是一个转折。
程曼祺
现在普遍认为,美国可能在今年年底或明年,中国可能晚半年到一年。
高洪浩
但另一面是,从 2023 年开始,每年秋天到年底,大家都在说 AI 到头了、见顶了、泡沫要破灭。这件事 2023、2024、2025 年已经发生了 3 次,每年秋天都这样。
AI 行业很神奇,有一种伤春悲秋的节奏。
程曼祺
没有伤春,春天大家还是很积极。
高洪浩
对,春天很积极。
程曼祺
从商业化角度看,目前也就看到两个比较明确的方向:Coding 和视频生成,没有看到更多。
高洪浩
这些领域后面肯定会有系列报道。但需要更具体的数字,才能测算规模和增长,看清楚量变。
程曼祺
今天非常感谢洪浩。不能叫做客《晚点聊》,因为我们是一起录了一期节目,聊聊你写的这篇姚顺雨报道。
之后我们可能还会有更多尝试,和同事一起讨论我们报道的主题。相比创始人或技术专家访谈,这会提供不一样的视角,不光是技术,也会涉及商业、公司组织和整个行业的竞争。
高洪浩
谢谢。
程曼祺
今天节目就到这里。各位拜拜。
高洪浩
拜拜。