腾讯 Hy3 开源与开放权重的成本终局:当 295B 参数模型变成免费商品,谁的护城河还在
腾讯 Hy3 开源与开放权重的成本终局:当 295B 参数模型变成免费商品,谁的护城河还在
2026/07/07
Hy3 开源的真正含义:不是腾讯赶上了,而是中文大模型的定价地板被彻底打穿
腾讯 Hy3 在 295B 参数规模上选择 Apache 2.0 协议,表面上是腾讯与智谱 GLM-5.2 的又一次正面对位。但这件事的实质意义,不是腾讯赶上了开源竞争,而是中文大模型推理层的定价地板,在同一天被两个 295B 参数的开放权重模型同时踩到了零。
在这之前,顶级中文模型的推理成本由头部闭源模型设定——调用 API 意味着向模型公司付费,按 token 计费,定价权在供给侧。开放权重改变的是这个基本结构:当模型权重公开,企业可以自行部署,推理成本变成算力成本,而不再是模型授权成本。算力成本是市场定价的,模型公司的议价权归零。
这个逻辑在英文模型领域已经成立数年——Llama 系列、Mistral 的崛起,让 AI 推理 API 的价格在过去两年跌了 97% 以上。中文大模型市场的定价侵蚀来得晚,但 GLM-5.2 和 Hy3 的同日共存,意味着这条路现在也在中文领域打通了。
同日出现的一个细节完美地印证了这一点:AMD 的测试数据显示,在 AMD 芯片上部署 GLM 5.2,推理成本仅为英伟达方案的一半。这不是 AMD 的营销,而是一个结构信号:当开放权重把模型本身变成免费商品,硬件之间的竞争就成了推理经济学的新主战场。英伟达过去凭借 CUDA 生态锁定了 GPU 市场的推理成本,但当模型层已经商品化,算力采购者开始有能力做真实的成本比较。
开放权重的护城河是什么:谁赢、谁输、谁在转型
分析师 Martin Alderson 在 Hacker News 上发布的「GLM 5.2 与 AI 利润崩塌」打出了一个更尖锐的判断:开放权重模型将使 AI 服务商的利润空间系统性收窄,走向商品化竞争。这个判断不是新颖的,但 Hy3 的出现让它在中文市场第一次有了可交叉验证的数据点。
输的是:以 API 调用定价为核心商业模式的中等规模模型公司。它们既没有顶级模型(可以靠能力差距维持溢价)的能力优势,也没有开放权重(可以靠生态和部署量取胜)的用户密度,处于最脆弱的中间位置。
赢的是三类主体:
第一类是算力基础设施。当模型层变成商品,部署模型的计算资源成为新的稀缺。三星 Q2 营业利润暴增 19 倍、SK 海力士赴纳斯达克上市、鸿海 Q2 营收增长 39.8%,这些数字共同指向:AI 算力基础设施的利润在模型层利润被侵蚀的同时快速集聚。
第二类是应用层。开放权重让每个开发者都能免费获得顶级语言能力,应用层的边际成本大幅降低,能在特定场景建立用户粘性的应用公司获益。Vercel CEO Guillermo Rauch 提出「模型层与 Agent 应用层必须解耦」,正是这个判断的基础设施视角:当模型本身不构成差异,能在模型之上建立 Agent 工作流和用户生态的平台,才有长期护城河。
第三类是拥有专有数据的机构。无论模型多强,在特定行业场景中,有价值的是结构化的领域数据和基于数据的推理能力,而不是语言生成能力本身。金融、医疗、法律等领域的专有知识库,不会被开放权重复制。
转型最难的是腾讯、百度等在自建大模型上有大量沉没成本的平台型公司。它们需要同时回答:开源之后如何盈利?用户粘性建立在哪里?在搜索、广告、企业服务等场景里,大模型能力本身能带来多少差异化?这些问题比技术本身更难。
成本终局还有多远:NVIDIA 的护城河与时间窗口
AMD 半价运行 GLM 5.2 的数据,不代表英伟达的护城河已经消失。CUDA 的生态锁定仍然真实——大量 AI 工作负载在 CUDA 上有深度优化,迁移到 AMD ROCm 有工程成本。英伟达的 Kyber 架构今日同步传出延迟至 2028 年的消息,这暗示英伟达在新一代基础设施产品上仍处于交付压力下,竞争窗口客观存在。
但这里有一个时间逻辑:开放权重模型的推理优化在快速迭代,AMD 和其他替代方案的软件生态在追赶,英伟达的 CUDA 护城河的实际宽度正在被持续测量。当两家顶级 295B 中文模型同时开源,对推理效率的需求倒逼硬件层竞争加速——这是一个需求端推动的市场结构变化,而不只是供给侧的技术竞争。
腾讯 Hy3 和 GLM-5.2 的共存,标志着中文大模型从「谁能做出来」的阶段,进入了「谁能让人用得起并且持续使用」的阶段。从这个角度看,今天的开源发布不是终点,而是一场更长周期竞争的起点。
参考资料
- Tencent releases Hy3, a 295B-parameter model competitive with GLM-5.1 and 5.2, Apache 2.0
- 腾讯混元 Hy3 正式发布,元宝同步上线 Hy3 Agent 能力、免费开放
- GLM 5.2 and the coming AI margin collapse (part 1)
- AMD 跑 GLM 5.2,成本只要英伟达一半
- Vercel CEO Guillermo Rauch on the fight to split off models from agents
- Nvidia delays Kyber AI rack architecture to 2028