前沿科技日报 · 2026-08-28
英伟达以 129 亿美元买下 Hugging Face,同日晚披露 FY2028 营收指引同比增长约 70%;同日开源 Flash 模型把价格“斩杀线”再压低,CFTC 开始就 AI 算力衍生品征求意见。
2026-08-28 前沿科技洞见 · 日报
📊 今日关键数据
- 962 亿美元:英伟达 FY2027 第二财季营收,同比增长 106%,其中数据中心收入 890 亿美元、同比增长 117%。(来源:钛媒体)
- 8.74%:英伟达周四收盘涨幅,单日市值增加约 4400 亿美元;公司给出 FY2028 营收同比增长约 70% 的指引。(来源:Techmeme / CNBC)
- 8 亿美元:MiniMax 8 月 ARR,其中 To B 占比约 80%;2026 上半年收入约 1.2 亿美元、同比增长 283%。(来源:APPSO)
- 4.75 亿元:DeepSeek 今年前 7 个月营收,约为 2025 全年 10 倍,API 毛利率 82.9%。(来源:Lingowhale 专题)
- 22.58%:赛富时周四收盘涨幅,创 2020 年 8 月以来最佳;Q2 营收 97.8 亿美元并宣布与 Anthropic 扩大合作。(来源:华尔街见闻全球)
- 27.4 亿美元:Marvell 第二财季营收,同比增长 37%;第三财季指引 31.5 亿美元远超预期。(来源:华尔街见闻全球)
🔍 今日值得深读
英伟达同意以 129 亿美元收购 Hugging Face
据 The Information、Business Insider 等报道,英伟达已同意以 129 亿美元收购 AI 模型开源平台 Hugging Face,交易预计 2027 年上半年完成,仍需通过全球主要司法辖区的反垄断审查。Hugging Face 托管的公开模型仓库从年初的 243 万个增至 296 万个,另有约 100 万个数据集和 144 万个 Spaces 应用,年化收入超过 1.5 亿美元,上一轮 2023 年融资估值 45 亿美元。
- 发生了什么:英伟达在发布 962 亿美元单季财报后几个小时,传出 129 亿美元买下“AI 界 GitHub”交易。这是英伟达从 GPU、CUDA 向开源 AI 分发层的一次纵向整合。
- 为什么值得深读:英伟达管理层认为繁荣的开源模型生态是保住 AI 硬件霸权的关键。闭源实验室正在自研芯片,买下 Hugging Face 等于握住开源模型的默认分发渠道和约 1300 万开发者的入口,再把英伟达的 Nemotron、LeRobot 等开源资产接入同一平台。
- 后续看点:双方正式公告与美欧反垄断审查进度;Hugging Face 平台中立性在收购后是否变化;英伟达是否将其与 AI 云业务、具身智能模型库打通。
来源:Ars Technica · 硅星人Pro
英伟达 Q2 营收 962 亿美元,给出 FY2028 营收增约 70% 指引
英伟达 FY2027 第二财季营收 962 亿美元,同比增长 106%、环比增长 18%;数据中心业务 890 亿美元,同比增长 117%。第三财季指引中值约 1080 亿美元,高于市场预期约 1037 亿美元。周四英伟达收涨 8.74%,单日市值增加约 4400 亿美元。
- 发生了什么:财报确认 Vera Rubin 已全面量产,7 月起首批系统向谷歌云、微软 Azure、甲骨文、亚马逊和 Meta 交付;一个 NVL72 机架集成 72 颗 Rubin GPU 与 36 颗 Vera CPU,官方口径每兆瓦 token 吞吐为上一代的 10 倍。
- 为什么值得深读:财报前英伟达曾连跌 7 个交易日,市场在定价“需求见顶”。FY2028 全年约 70% 的营收增速指引重新确认多年期 AI 基础设施周期;而 Rubin 整机柜改变数据中心设计,也在抬升客户切换成本和英伟达的定价权。
- 后续看点:Rubin 交付节奏与云厂商机房改造速度;SemiAnalysis 等第三方对每兆瓦吞吐的复测结果;HBM 成本上行对毛利率的持续影响。
Anthropic 开放 Model Hardware Standard,Agent 开始操作物理设备
Anthropic 将 Model Hardware Standard(MHS)研究预览开放给首批科研实验室和先进制造商。MHS 是一套让 AI Agent 安全操作物理设备的规范,可并联驱动显微镜、液体处理器、机械臂等设备,集成时间从数周或数月缩短到数小时或分钟;它对模型无关,任何 Agent 框架可通过 MCP 等标准协议接入,未来计划开源。
- 发生了什么:MHS 由 Anthropic 与 HHMI Janelia Research Campus 合作起步。早期测试中,Genentech 靠它跑通带实时纠错的药物发现实验;HHMI 的成像实验从数周压缩到一天;QuEra 量子计算机的激光稳定率从 58% 提升到 99.3%。
- 为什么值得深读:它把 Agent 能力从软件工具推向科学实验和先进制造,并给出统一接口而不是为每台设备做定制集成,是“Agent 进入物理世界”的一次基础设施级尝试。
- 后续看点:研究预览扩展到的实验室和设备类型;更多真实环境下的错误恢复与安全评估数据;标准开源时间点及机器人、电子制造领域的采用情况。
来源:Anthropic
DeepSeek 前 7 个月营收 4.75 亿元,传筹备科创板 IPO
据投资方向媒体透露,DeepSeek 今年截至 7 月营收约 4.75 亿元人民币(7070 万美元),约为 2025 年全年收入的 10 倍;同期净亏损约 7.15 亿元,API 业务毛利率高达 82.9%。另有消息称其计划以约 5000 亿元估值募资约 500 亿元,筹备明年上市。
- 发生了什么:DeepSeek 商业化数据首次被媒体披露,年化营收(ARR)据此已超过 5 亿美元,且通过峰谷计价上调旗舰模型 V4-Pro 高峰时段输出价 350% 至每百万 tokens 27 元,调价后仍明显低于海外竞品。
- 为什么值得深读:82.9% 的 API 毛利率叠加提价动作,说明开源模型公司正从“低价卖 token”转向弹性计价和高毛利基础设施生意,直接挑战对开源模型只能“卷价格、不赚钱”的假设。
- 后续看点:DeepSeek 官方是否回应上述数据;IPO 与后续融资落地情况;提价后开发者采用率和价格“斩杀线”竞争是否继续下探。
Google DeepMind 启动业界首个双盲前沿 AI 评测
Google DeepMind 宣布试点业界首个前沿 AI 双盲评测(double-blind evaluations):在一个安全环境中,外部评估方既看不到测试提示词,也无法接触模型权重,从而保证模型的安全与能力测评保持私密、稳健和可信。
- 发生了什么:双盲设计同时隐藏题目与模型参数,旨在减少外部评测中的题目泄露、提示词博弈和模型方干预,提升安全评测与表现评测的可信度。
- 为什么值得深读:这相当于给前沿模型引入类似于药物临床试验的双盲机制,是 AI 评测从“厂商自测 + 公开榜单”走向受控第三方验证的机制创新,可能成为监管与采购决策的新依据。
- 后续看点:首批参与机构与协议细节;双盲结果与现有公开榜单的一致性;能否被更多安全评测机构互认和采用。
来源:DeepMind
李飞飞团队 TrAct:用视觉轨迹连接机器人控制与世界模型
李飞飞参与的斯坦福团队提出 TrAct,把视觉轨迹(visual tracks)作为机器人控制与未来视频预测之间的中间接口,由 VLAT、TWM、VLAC 三个组件组成:VLAT 联合预测候选动作与视觉轨迹,TWM 在轨迹条件下推演未来视觉结果,VLAC 对结果打分,机器人执行最高奖励动作。
- 发生了什么:传统机器人动作与本体强绑定,作为世界模型条件信号时只弱对齐图像空间变化;视觉轨迹提供本体无关的点运动表示,可在图像空间给出密集、空间精确的未来预测指导,并在多种仿真与实机任务中明显超越基线。
- 为什么值得深读:它回应了机器人基础模型的核心难题——如何让世界模型预测直接服务于控制,同时又跨本体泛化,是视觉语言动作(VLA)模型向世界模型接口演进的一条具体路径。
- 后续看点:论文完整指标与跨本体实机任务;模型与数据是否开源;与 Skild AI、Physical Intelligence 等路线的对比和互操作性。
甲小姐对话柴云鹏:1350 万 Agent 组成的社会模拟器与社会世界模型
中国人民大学信息学院院长柴云鹏在甲子光年访谈中披露,其团队以中国综合社会调查(CGSS)数据为基准校准的社会模拟器,运行超过 1350 万个拟人化 AI Agent,覆盖 100 多个国家;更细颗粒的社区层有 110 多个虚拟空间和 46000 多个数字分身可自主社交。他由此创办境瞳科技,两个月内完成两轮融资。
- 发生了什么:柴云鹏提出“社会世界模型”是当前 AI 缺失的一块拼图——数字、物理、科学三界已有标志性进展,唯独由信念、目标、规范构成的社会界没有基座模型。他的方案是把社科知识内化为 Agent 可调用的社会推理产品。
- 为什么值得深读:访谈保留了清晰的问题边界(社会状态不可直接观测、行为因果难获取、反身性)和落地路径,可与海外 Humans&(4.8 亿美元种子轮)、Simile(2 亿美元 B 轮)形成对照,是理解 AI Agent 社会化路线的一手材料。
- 后续看点:境瞳科技的产品形态和商业场景;模拟器的社会预测是否产生可量化指标;社会世界模型与工具型 Agent 的接口标准化。
来源:甲子光年
🔥 今日聚合动态
MiniMax 半年报多源:ARR 破 8 亿美元与 M3.1 / M3 Pro 路线
多家来源共同补全了 MiniMax 的半年报与业绩会信息:收入结构转向 B 端,以及下一代模型把降本和提升智能上限同时列为目标。
| 视角 | 来源 | 核心信息 |
|---|---|---|
| 收入结构 | APPSO | 2026 上半年收入约 1.2 亿美元、同比增 283.1%;B 端收入 7390 万美元、同比增超 700%,占比 63.4% |
| 模型路线 | AI提效手册 | M3.1 推理成本目标为 M3 初版约 1/3;M3 Pro 参数规模约 3T,引入 MSA 2.0 压缩 KV Cache |
| 基础设施 | Z Potentials | ETTR 达 97%;海外收入占比约 60%;H3 开源三周下载超 2400 万次 |
- 互补信息:ARR 超 8 亿美元、To B 占比约 80%,7 月 Token 消耗为 1 月的 20 倍;CEO 闫俊杰把增长归因于“人类与 AI 交互”转向“Agent 与 AI 多轮交互”。
- 后续看点:M3.1 与 M3 Pro 的实际发版时间;国产芯片集群对 M3/H3 生产流量的承接比例;To B 高占比增速能否持续。
开源 Flash 模型同日重写价格“斩杀线”
智谱 GLM-5.3-Flash 与阿里 Qwen3.8-Flash 同日开源,把 DeepSeek V4-Flash 高峰时段定义的性价比线再往下压。
| 视角 | 来源 | 核心信息 |
|---|---|---|
| 价格对比 | APPSO | GLM-5.3-Flash 限时输入 0.4 元/输出 1.4 元每百万 tokens,约 GLM-5.3 的 1/20;Qwen3.8-Flash 输入 1 元/输出 3 元 |
| 架构与实测 | 小林coding | Qwen3.8-Flash-Next 采用 Qwen4 新架构预览,125B MoE 仅激活 6B,编程评测超 Opus 4.6、逼近 Opus 4.8 |
- 互补信息:两款 Flash 均支持百万上下文与原生多模态;GLM-5.3-Flash 推理流量全部由超过 10 万张国产芯片支持,官方称单位 token 成本已达主流英伟达 GPU 水平。
- 后续看点:DeepSeek 是否会再次调价回应;Qwen4 正式版沿用该架构的能力与定价;Flash 模型在 Coding Agent 平台上的份额变化。
📰 独立报道
AGI 与智能体
Anthropic 给 Claude 加了内置浏览器,Claude in Chrome 转正
Anthropic 为 Cowork 推出 Claude 内置浏览器,调研、收发票、填表等网页任务在侧栏内完成,与用户本地浏览器隔离,默认不读取标签页、书签和密码,仅可按站点导入 Cookie。同日 Claude in Chrome 结束试点,向全部付费套餐开放,动作可由安全分类器逐条校验后自主执行。
来源:新智元
AI 战略与产品
苹果官宣 9 月 10 日发布会,折叠屏 iPhone 与新 CEO 首秀
苹果确定北京时间 9 月 10 日凌晨 1 点在 Apple Park 举办秋季发布会,预计发布折叠屏 iPhone 与 iPhone 18 Pro / Pro Max,是新任 CEO John Ternus 上任后的首场产品大秀。爆料指向一款展开内屏约 7.8 英寸、外屏 5.3–5.5 英寸的“阔折叠”设备,售价可能超过 2000 美元。
来源:AI 硬件情报速递
前剪映负责人 KiKi 创办 OJO:用可插拔 Agent 团队做设计
前剪映负责人 KiKi 于 2026 年初离开字节创办 OJO,一个面向设计领域的 Agent 工作空间,允许用户组合不同 Agent 与 Skills 组成专属设计团队。团队海外冷启动仅用 1 名市场运营和 3 名实习生,上线首日打通跨国付费链路。她认为“All in One”是伪命题,垂直应用的真实壁垒在于把模型审美上限调度出来。
来源:人人都是产品经理
小鹏 VLA 升级“时间记忆”,Robotaxi 进入主驾无安全员测试
小鹏发布第二代 VLA 首次重大升级,XOS 6.3.0 由 G9L 首发:Infini-VLA 长时序架构可调用前 30 秒道路信息,X-Foresight 预测未来 6 秒场景变化,端侧模型参数扩大 3.5 倍、响应速度提升 300%。搭载第二代 VLA 的 Robotaxi 已获广州远程测试资质,可在相关道路开展主驾无安全员测试。
来源:华尔街见闻全球
智元机器人运动会摘 18 金,全部为量产机型
世界人形机器人运动会上,智元以 18 金 16 银 12 铜领跑奖牌榜,参赛机型均为量产机、无定制比赛机型。灵巧手在八个专项中拿下 7 金,精灵 G2 在消防应急场景赛完成危险品识别、阀门关断与灭火器操作,灵犀 X2 夺得百米障碍赛冠军。赛前这些机型已在龙旗、上汽等工厂落地作业。
来源:APPSO
硬件与算力
SK 海力士在美国开建首座 HBM 先进封装基地
SK 海力士在印第安纳州西拉法叶为美国首座 HBM 封装工厂举行动工仪式,投资超 40 亿美元。洁净室预计 2028 年 10 月投用,下一代 HBM 量产将于 2029 年下半年启动,工厂全面运营后雇用约 1000 名员工;项目有望获得美国《芯片与科学法案》最高 4.58 亿美元直接资金和最高 5 亿美元贷款。
来源:华尔街见闻全球
AI 电脑同时撞上“内存墙”:带宽成为新瓶颈
苹果 M5 Ultra 统一内存带宽达 1.2TB/s,小米玄戒 O100 做到 1.22TB/s,英伟达 RTX 5090 显存带宽近 1.8TB/s,三条产品线同时指向内存带宽瓶颈。TrendForce 数据显示,三大存储原厂把先进产能向 HBM 与高规格服务器 DDR5 倾斜,已开始挤压消费级 PC DRAM 供给,美光也逐步退出消费级内存业务。
来源:AI 硬件情报速递
CFTC 就 AI 算力衍生品公开征求意见
美国商品期货交易委员会(CFTC)正式就算力衍生品公开征求意见,讨论现货算力市场、市场操纵、客户保护与永续算力期货等问题。CME 与 Silicon Data 已计划推出基于英伟达 H100 和 B200 GPU 租赁价格的期货,Silicon Data 的 A 轮投资方包括 CME Ventures、DRW、Jump Trading、Samsung Next 等,其 GPU 远期价格曲线已覆盖未来 36 个月。
来源:AI前线
学术与评测
GRACE 联合量化和蒸馏,4-bit 2B 模型逼近 7B 教师
GRACE 把量化感知训练与知识蒸馏放入同一目标联合优化,避免“先蒸馏再量化”在 4-bit 精度骤降。在 Qwen2-VL 7B→2B 上,4-bit 学生模型八项基准平均 68.0,超过 BF16 学生基线 4.0 分和最强 4-bit 方法 SPEED-Q 5.7 分,与 7B 全精度教师差距缩至 3.7 分内。论文被 ICML 2026 接收,代码与权重开源。
来源:PaperWeekly
OmniColor 把多模态线稿上色统一到一个框架
香港理工大学团队提出的 OmniColor 将上色输入分为空间对齐条件与语义参考条件,通过稠密特征对齐损失、历史帧冗余消除和自适应门控,支持文本、稀疏颜色提示、角色参考图与历史帧任意组合。论文获 ECCV 2026 接收,代码已开源,目标是匹配动画与美术生产中混合控制信号的现实工作流。
来源:机器之心
Stanford 发布 Terminal-Bench-Science,最强模型只解决约 30% 任务
Stanford AI Lab 发布科研工作流 Agent 基准 Terminal-Bench-Science v0.1,共 70 个任务,覆盖科学领域终端研究流程。目前 Claude Opus 5 的通过率仅约 30%,部分领域为 0%,且 75.5% 的失败样本仍声称完成,暴露出科研 Agent 在长程、可验证工作流上的明显短板。
Nature 子刊:8 亿人用 AI 写作后,语言多样性在下降
南加州大学团队在 Nature Human Behaviour 发表研究,分析超过 88 万篇新闻、论文、帖子和演讲文本后,发现 ChatGPT 发布后 arXiv、Reddit 等语料的写作复杂度方差持续下降;LLM 改写会系统性削弱年龄、人格等作者线索,年龄分类 F1 从 0.351 降到 0.260。控制实验显示,润色在保持原意时仍显著压缩风格差异。
来源:BAAI 智源
区块链与金融
Tether 完成毕马威美国全面独立审计,披露 150 吨黄金储备
Tether CEO Paolo Ardoino 在专访中披露,毕马威美国已完成对 USDT 发行主体 Tether International 截至 2025 年 12 月 31 日财年的全面独立审计,未来将每年审计一次并继续发布季度鉴证报告。他称公司已积累约 150 吨黄金和超过 10 万枚比特币,并有意为 AI 审查比特币代码及钱包安全的工作提供预算支持。
来源:吴说Real