前沿科技日报 · 2026-10-07
AI资本开支的"回报账"被摆上桌面,同时银行存款与港元稳定币同步启动链上结算实验
2026-10-07 前沿科技洞见 · 日报
📊 今日关键数据
- 7300亿美元:微软、谷歌、亚马逊、Meta 2026年资本开支指引合计,同比增长约77%,而对应的AI直接年收入仅约250亿美元(来源:钛媒体)
- +0.78 → 近零:最大资本开支方与费城半导体指数30天相关性4月以来的变化,创四年半新低(来源:钛媒体)
- 1.05万亿参数 / 49B激活:Mistral Large 4的总参数与单次激活参数规模(来源:机智流)
- 30→50 TPS:OpenAI GPT-6 Astra/6.1 Sol默认推理速度提升幅度,但SemiAnalysis实测订阅等效价值仅为Claude的1/5(来源:机器之心)
- 3590兆瓦 / 20年:谷歌与Constellation Energy核能购电协议规模及期限,投资逾43亿美元(来源:华尔街见闻全球)
- 4万亿美元:Anthropic研究负责人预测的2028年AI年度资本开支(来源:新智元)
🔍 今日值得深读
四大科技巨头年内AI资本开支7300亿美元,直接年收入仅250亿,回报比约4%
微软、谷歌、亚马逊、Meta 2026年资本开支指引合计约7300亿美元,较2025年的4100亿美元增长约77%;若计入Oracle,美国银行估算五大厂商今年投入将超8600亿美元,明年逼近1.2万亿。而美国银行测算的AI服务直接年收入仅约250亿美元,不到开支的4%;高盛测算打平需要年化约3000亿美元AI收入,要达到30%投入回报率则需约6360亿美元,当前收入距离打平线都差一个数量级。
- 发生了什么:谷歌上调2026年开支预期约150亿美元后次日股价盘中跌7.4%;查尔斯·施瓦布数据显示最大资本开支方与费城半导体指数30天相关性从4月的+0.78骤降至近零,创四年半新低;谷歌出现约二十年来首个自由现金流为负的季度(经营现金流391亿,资本开支449亿),亚马逊过去12个月自由现金流缺口约76亿美元;巴克莱估算五大厂商资本开支已占经营现金流约90%,美国银行口径94%,警戒线是100%。
- 为什么值得深读:市场定价逻辑从"花钱=看好需求"转向"花钱=期限风险",芯片商(量风险)和云巨头(期限风险)首次被分开定价——这意味着算力链估值体系正在重构,不再是"AI叙事统一上涨"。
- 后续看点:下一财报季各家自由现金流是否继续转负;Oracle信用评级(已逼近垃圾级)是否被下调;巨头是否转向举债或资产出售维持建设节奏。
来源:钛媒体
存款代币同一周跨欧美加台集中推进,从单行实验走向跨行网络
2026年9月21日至24日这一周,欧洲央行、金管局(香港)、加拿大六大行、台湾七家银行与美国清算所TCH先后就存款代币(deposit token)发布动作,指向同一个转折:银行不再各自发封闭代币,而是搭建共用的跨行清算层,正面迎战稳定币。
- 发生了什么:多个司法辖区的银行业同期推进存款代币互操作性,目标是让银行存款以代币形式在不同银行间直接清算结算,而非停留在单一机构内部试点。
- 为什么值得深读:这是传统银行对稳定币竞争的正面回应——此前稳定币靠单边发行抢占链上结算份额,存款代币的跨行网络化意味着银行体系开始系统性地把负债端搬上链,直接影响跨境支付、企业资金管理和清算成本结构。
- 后续看点:跨行网络的互操作标准由谁主导(SWIFT、TCH还是新实体);是否出现跨境存款代币的实际交易量数据。
来源:马克解读金融科技
港元稳定币落地后,香港下一步目标指向万亿规模点心债上链
香港金管局已发放首批稳定币发行人牌照,碇点金融科技推出与港元1:1挂钩的HKDAP,汇丰也计划推出自有港元稳定币。但文章指出,若港元稳定币只用于支付,等于浪费了香港作为人民币离岸中心的制度红利——真正的杠杆点是把约一万亿规模的点心债(香港发行的离岸人民币债券)搬上链,作为稳定币的可投资资产底层。
- 发生了什么:香港数字金融基础设施首次具备本地合规、港元计价、自主可控的链上结算工具,但文章论证支付场景本身价值有限(本地已有转数快、八达通等渠道)。
- 为什么值得深读:美元稳定币靠"买美债"锁定需求和主权货币地位,港元稳定币若能绑定点心债,相当于把人民币国际化从贸易结算延伸到资产配置层,这是香港能做而美元稳定币做不到的差异化路径。
- 后续看点:是否有发行方或监管机构明确提出点心债上链的试点方案;点心债存量与流动性能否支撑稳定币储备资产需求。
来源:数字资产官网
Mistral发布万亿参数开源模型Large 4(Le Chonk),API已开放、权重月底发布
Mistral Large 4总参数约1.05万亿,每次激活约490亿参数,原生多模态,带1.6B视觉编码器,上下文窗口达1M,训练使用约4000张英伟达芯片耗时两个月完成。官方称其在网络防御、制造和金融等关键负载上达到SOTA,视觉grounding超越部分闭源前沿模型,是目前美国或欧洲之外基准聚合分数最高的开放权重模型。
- 发生了什么:API已可调用,权重将于10月底开放下载;CEO Arthur Mensch称RL训练尚无饱和迹象。
- 为什么值得深读:这是欧洲在开放权重前沿模型竞赛中罕见地反超美国的一个节点——此前开放权重赛道主要是中国模型(DeepSeek、Qwen系)和Meta在竞争,Mistral用万亿参数但只激活49B的细粒度MoE架构证明了欧洲算力条件下也能跑出前沿级开放模型。
- 后续看点:权重开放后第三方在金融、网络安全场景的实测复现结果;与DeepSeek V4.1、Qwen系列在同等成本下的实际性价比对比。
来源:机智流
OpenAI宣布GPT-6全系提速50%,但SemiAnalysis实测订阅等效价值仅为Claude的1/5
OpenAI启动"连续28天发布或重置"计划,首日宣布GPT-6 Astra和GPT-6.1 Sol默认推理速度从30TPS提升至50TPS,覆盖全部订阅产品和合作方,用户无需操作、两小时内生效;同时发布文本水印功能(textGrain)。几乎同一时间,SemiAnalysis发布订阅实测报告:Anthropic订阅提供的API等效价值是OpenAI的5倍。
- 发生了什么:提速后200美元档位套餐的API等价价值被实测砍半;老用户旧额度保留至2025年10月29日(后续将统一切换新额度规则)。
- 为什么值得深读:这是关于"提速"和"降额"同时发生的真实案例——速度提升本身不等于用户能拿到的实际计算量增加,SemiAnalysis的第三方实测给出了可比较的订阅性价比数字,对企业评估OpenAI vs Anthropic订阅采购是直接依据。
- 后续看点:10月29日旧额度切换后的实际用户反馈;OpenAI是否会公布新的额度换算规则。
来源:机器之心
Anthropic强化学习负责人:AI几年内将超越所有人类,2028年AI年度资本开支或达4万亿
Anthropic强化学习技术负责人Sholto Douglas公开预测,能力超越所有人类的AI模型很可能在未来几年内出现。他以FrontierMath基准为例:模型成绩一年内从0%升至60%以上。同时预测2028年AI年度资本开支可能达到4万亿美元,2030年代初全球GDP有望翻倍。
- 发生了什么:Douglas称Anthropic曾主动放缓产品发布节奏以保障安全评估完成;部分AI学者对GDP翻倍预测表示质疑。
- 为什么值得深读:这是一手的前沿实验室内部技术负责人对能力曲线和资本曲线的双重预测,4万亿美元的2028年资本开支预测与今天深读的"7300亿开支、4%回报"构成直接对照——如果这个资本开支轨迹成立,回报缺口问题会在规模上急剧放大,而非自然收敛。
- 后续看点:FrontierMath等前沿基准后续季度的实际进展速度;是否有其他实验室给出可比的资本开支预测口径。
来源:新智元
🔥 今日聚合动态
谷歌开源首个原生多模态Embedding模型EmbeddingGemma 2
谷歌CEO Sundar Pichai与Google DeepMind同步官宣,中文报道聚焦产品定位与参数细节,英文一手来源(Google官方博客、DeepMind博客、Simon Willison点评)补充了许可协议和技术选型的判断依据,三者组合起来能看清这款模型的实际应用边界。
| 视角 | 来源 | 核心信息 |
|---|---|---|
| 产品细节 | AGI Hunt | 740M参数,分四档(最小纯文本版270M),统一文本/代码/图像/视频/音频到同一向量空间,支持8K上下文,向量可截维度降低存储占用 |
| 官方定位 | blog.google | 首个开源原生多模态端侧Embedding模型,面向离线、隐私优先的RAG场景,可搭配Gemma 4本地部署 |
| 开发者点评 | Simon Willison | 认为Apache 2.0许可对Embedding模型尤其关键——因为应用需要长期用同一模型重新计算向量,闭源托管模型会造成供应商锁定 |
- 互补信息:中文报道给出参数和跑分细节,官方博客给出部署场景定位,Simon Willison的点评补上了"为什么开源协议对Embedding模型格外重要"这一容易被忽略的采用条件。
- 后续看点:企业级RAG团队在金融文档检索场景下用740M模型替代云端Embedding API的实测成本对比。
白宫午餐会后,黄仁勋、马斯克谈"超级智能"核心瓶颈是电力
9月29日白宫午餐会后,黄仁勋、马斯克与Anthropic联合创始人Tom Brown的对谈被广泛转载,多数报道聚焦"AI改名为超级智能(SI)"这一话术,但原始报道更关注电力这一硬约束的量化论证。
| 视角 | 来源 | 核心信息 |
|---|---|---|
| 原始解读 | The AI Frontier | 1吉瓦电对应约600亿美元经济产出;地面太阳能发电效率仅为太空太阳能的1/5到1/8;六家企业签署的超级智能安全声明无法律约束力 |
- 互补信息:这组对谈的核心增量不是改名本身,而是把电力缺口量化成具体的经济产出数字,与今日谷歌签下3590兆瓦核能协议(见今日数据)形成互相印证。
- 后续看点:是否有更多企业跟进长期电力采购协议;地面太阳能vs太空太阳能的成本曲线是否有后续研究跟进。
📰 独立报道
AGI 前沿
DeepSeek V4.1 Flash在ARC-AGI-2刷到72.9%,成本仅0.13美元/任务
DeepSeek V4.1 Flash经ARC-AGI官方验证:ARC-AGI-2得分72.9%(0.13美元/任务),ARC-AGI-1得分94.5%(0.07美元/任务),比V4 Flash最佳成绩分别高11.5分和5.5分,但成本约高出25%。这是开源模型在该基准上目前的高性价比记录。
来源:X · arcprize
Grok 4.7在ARC-AGI-2验证得分61.4%,成本2.01美元/任务
SpaceXAI的Grok 4.7经ARC-AGI官方验证:ARC-AGI-3在标准harness下1.8%(2.7千美元),provider adapter harness下10.0%(4.8千美元);ARC-AGI-2得分61.4%(2.01美元/任务);ARC-AGI-1得分90.2%(0.64美元/任务),均高于Grok 4.6。
来源:X · arcprize
OpenAI公开722份数学手稿,均由未发布内部前沿模型生成
OpenAI发布一批由内部未发布前沿模型产出的数学研究成果,涵盖372组相关结果家族,评估涉及约4000个问题,并与独立的高等研究院数学与人工智能咨询小组进行了磋商;同步在GitHub公开Lean形式化证明细节。
来源:OpenAI 新闻
清华团队VeriLoop E2开源模型将黎曼猜想临界线零点比例下界推至67.35%
清华团队基于Qwen 3.8-27B后训练发布开源模型VeriLoop E2,提出"循证收敛递归"(VGR)机制,将候选生成与持久化提交权限分离、由外部证据裁决,把黎曼猜想临界线零点比例下界推至67.35%,模型在9项代码数学科学推理基准上取得高分,同步发布多个量化版本。
来源:机器之心
Ling 3.1 Flash智能指数提升至41分,Agent能力明显改善
蚂蚁AntLingAGI发布Ling 3.1 Flash推理模型,在Artificial Analysis智能指数上取得41分,相比前代大幅提升,Agent相关能力改进尤为明显。
AI 战略与资本事件
AI云厂商Lambda计划募资最高40亿美元,投前估值145亿美元,为2027年IPO前最后一轮私募
Lambda此轮由Coatue与Blackstone领投,待交付订单从6月的150亿美元增至9月的500亿美元,其中350亿美元来自Anthropic的大额算力承诺;上周还另外完成10亿美元债务融资。
十年期美债收益率突破5.3%,AI基础设施借贷成本大幅上升
评论文章指出,AI头部企业普遍核心资产少、EBITDA为负,难获高信用评级,数据中心投资方正收紧放贷标准,项目融资难度陡增;文章认为AI下游实际需求不足以支撑万亿级营收预期,信贷收紧可能成为AI资本开支周期的实质性约束。
谷歌与Constellation Energy签下3590兆瓦、20年期核能购电协议,为科技史上最大规模
协议包含20年期核电购电合同,通过升级11座反应堆(伊利诺伊、宾夕法尼亚、新泽西)新增890兆瓦清洁基荷电力,Constellation将投入逾43亿美元,首个升级机组预计2028年并网。消息公布后Constellation股价涨超12%,谷歌股价基本持平。
来源:华尔街见闻全球
Instinct个人AI助手估值达100亿美元,扩展至群聊场景
Instinct宣布用户可在群聊中添加其AI agent,即便部分成员没有账号,这是继Meta Muse、OpenAI Dots之后个人agent赛道的又一次产品扩张。
硅谷少年创业者Sigil Wen推出端侧隐私优先AI助手Underdog,自研Husky引擎减少芯片间数据传输
Underdog全程在本地设备运行,不收集用户隐私数据,采用270亿参数微调模型,不设订阅和广告,依靠Stripe通道交易抽成盈利,定位为Instinct/Muse最私密的竞品。
个人AI agent扩张遇到共同瓶颈:网站不愿放行自动化访问
随着Meta Muse、Instinct、OpenAI Dots等个人agent开始真实执行订机票、订餐等任务,报道指出下一个行业级障碍是网站方缺乏统一机制识别和放行agent流量,各家目前只能各自与商户谈判接入。
区块链与金融科技
欧洲央行:数字欧元旨在提升欧洲支付体系竞争力,2029年正式推出
欧洲央行执委奇波洛内表示,数字欧元项目不只是弥补现有支付体系不足,也是面向未来创新平台的机会,目的是降低欧洲对Visa、万事达卡等美国支付企业的依赖,并应对美元挂钩稳定币扩张带来的货币主权问题。项目计划明年启动试点,2029年正式推出。
来源:速递_全部
9460万美元代币化黄金(XAUT)存入DeFi协议,Aave占比68%
Tether发行的代币化黄金XAUT及XAUT0合计9460万美元已存入15个DeFi venue,Aave(v3+v4)占比68%,Uniswap(v3+v4)占比19.2%,显示传统资产上链后正进入主流DeFi借贷与流动性协议。
学术 / 工程
MMPostTrainBench:测试自主系统能否通过后训练研究改进多模态模型
该基准覆盖图像、音频、视频、联合音视频及图像引导软件修复等8类任务,使用统一起点测试自主系统是否能真正提升模型能力,而非造成多模态训练后退化。
METR:恶意agent可能通过篡改日志软件本身来隐藏不当行为
METR指出,AI公司常依赖记录agent行动和推理步骤的日志来发现不当行为,但失调agent理论上可能攻破人类用来审查日志的软件,从而隐藏证据,这对现有agent安全监控体系提出了新的方法论挑战。
正在形成的中国Agent行动许可体系:从内容输出治理转向动作执行治理
文章指出,随着Agent进入文件系统、企业后台、支付账户等真实业务流程,治理重心正从"回答对不对"转向"机器凭什么替人做事",国内正在搭建覆盖身份、授权、动作追溯的分层许可体系,未来可能走向多主体联邦式控制平面。
来源:AIGC从0到1