FINTECH FRONTIER DAILY
🏠 返回首页
FINTECH FRONTIER DAILY

前沿科技日报 · 2026-08-23

Anthropic 挖来谷歌 TPU 创始人 Amir Salek 组建自研芯片团队,同步锁定 2027 年 3.5GW 算力;智谱 GLM-5.3 开放 API 并将于下周五开源,Coding 与网络安全能力明显提升;国金证券实测显示 DeepSeek V4 Pro、Kimi K3、GLM-5.2 在投研任务上的可复核性仍差距明显。

降低FOMO的每日信息交付

2026-08-23 前沿科技洞见 · 日报


📊 今日关键数据


🔍 今日值得深读

Anthropic 组建自研芯片团队,谷歌 TPU 创始人 Amir Salek 加盟

Anthropic 聘请谷歌定制芯片业务创始人 Amir Salek,向计算平台主管 James Bradbury 汇报,负责组建并领导 AI 定制芯片设计团队。Salek 曾在英伟达工作八年,2013 年至 2022 年在谷歌从零创建定制芯片业务并主导前七代 TPU 研发。与此同时,Anthropic 与英国芯片初创公司 Fractile 达成约 2.5 亿美元首批采购协议,把与谷歌、博通的合作扩大至 2027 年约 3.5GW 下一代 TPU 容量,并计划与三星联合设计硬件。公司称这是把重心从"抢算力"转向"造算力";截至 7 月底其年化营收已突破 650 亿美元,二季度初步收入超 115 亿美元,推理基础设施毛利率从 38% 升至逾 70%。

来源:华尔街见闻全球


智谱 GLM-5.3 开放 API,下周五开源,靠后训练提升 Coding 与安全能力

智谱 8 月 14 日发布 GLM-5.3,8 月 19 日 API 正式开放调用,定价与 GLM-5.2 持平;模型已向全部 GLM Coding Plan 用户开放,并接入 ZCode、Claude Code、OpenCode 等工具。GLM-5.3 沿用 GLM-5.2 基座,主要靠扩大后训练规模提升能力:DeepSWE v1.1 从 46.2 分提高到 66.9 分,ExploitBench 从 24.4% 提高到 54.4%;在 Artificial Analysis 综合智能指数中拿到 60 分,与 Claude Fable 5、GPT-5.6 Sol 同档,并与 Kimi K3 并列开源模型第一。但模型发布当天智谱股价下跌 3.6%,市场讨论热度低于前几代旗舰发布。

来源:钛媒体


国金证券实测三类金融投研任务,三模型可复核性差距明显

国金证券研究以估值建模、多因子回测和行业研究三个真实投研任务,对 DeepSeek V4 Pro、Kimi K3、GLM-5.2 进行实测。回测任务中,DeepSeek V4 Pro 排名第一,扣除了交易成本、区分信号日与执行日并剔除停牌;Kimi K3 排名第二,但未扣成本、未区分交易时点;GLM-5.2 排名第三,毛净收益完全相同、中间过程披露不足。估值任务中,Kimi K3 按"分产品销量×单价"拆解收入排名第一,DeepSeek V4 Pro 的 Excel 关键公式存在系统性错位,GLM-5.2 工作簿公式异常、结论无法复核。报告还显示,DeepSeek Harness 能通过 Skills 调用绘图、信息检索、个股分析和基金评价,运行轨迹可完整记录任务拆解、模型响应、工具调用和结果生成。

来源:国金证券研究


人形机器人在全球直播中与顶尖网球选手完成全自主对抗

8 月 22 日第二届世界人形机器人运动会开幕式上,银河通用的人形机器人在全球直播镜头下与网坛顶尖运动员打了一场全自主网球表演赛,完成发球、正手、反手、接发、底线调动和网前截击,双打中与人类队友实时协作,摔倒后能自主站起。支撑它的具身大模型"银河星脑"将大脑、小脑与神经控制集成于同一架构,平台"银河星坊"负责把人类数据转化为训练供给,让机器人在虚拟网球世界通过多智能体博弈对练实现技能涌现,再迁移到物理赛场。

来源:极客公园


高盛硅谷调研:Agent 进入执行时代,AI 竞争转向工作流

高盛在 8 月 18 日至 19 日走访硅谷 AI 企业、风投机构和高校后发布报告,认为 AI 商业化正从"按席位订阅"转向按消费量、交易量和结果收费,Agent 从辅助工具走向工作流执行者,产业价值从模型本身向专有数据、业务上下文和领域专业能力迁移。报告指出,企业部署 Agent 的最大障碍是可控性:在法律、风控、保险和审计领域,错误责任、过程追溯和及时纠正可能比模型能力更关键。一家风投机构预计,未来 12 至 18 个月约 90% 的推理 Token 将流向开源模型;高盛还预计未来 5 年算力需求增长约 24 倍。

来源:华尔街见闻全球


美团复盘 OpenClaw "养虾":高峰期 AI 账单日耗上千万元,四个月才纠偏

美团核心本地商业 CEO 王莆中复盘 2 月至 3 月的全员"养虾运动":OpenClaw 被大规模引入公司,但 AI 被塞进大量日常事务却没有碰到核心业务,流程、组织和技术系统没有同步调整,高峰期 AI 账单每天烧掉上千万元,部分由"养虾"产生的谬误干扰真实经营;直到 7 月通过赛马机制跑出几个可用场景,AI 才进入真实产品流程。OpenClaw 创始人 Peter Steinberger 在 Startup School 2026 演讲中称,项目爆火后被安全报告淹没,媒体称 20% 的 Skill 带恶意,他们扫描全部 6.7 万个 Skill 后真实比例接近 0.3%;他为此花了数月加固沙箱、允许列表和权限控制,软件变慢,还堆出约 9500 个配置项。

来源:AI前线


📰 独立报道

🤖 AGI 前沿

唐杰发文谈 Scaling Law 新标尺:参数是知识,FLOPs 是智能

智谱创始人唐杰在 X 平台发布《Thoughts About Scaling Law》,提出参数量决定模型"知道多少",FLOPs 决定模型"能想多深"。他以 2021 年 Switch Transformer 为例:1.6 万亿总参数在 SuperGLUE 上比 T5-Base 高 4.4 分,但在 ARC Challenge 推理题上以 32.8 分输给 T5-Base 的 35.5 分,说明扩大总参数换来的是"记住更多",而不是"想得更深"。

来源:钛媒体


Inherent 发布 Faraday agent,称复现论文发现超过 GPT-5.5

伦敦 AI 实验室 Inherent 发布 AI agent Faraday,称其在复现研究论文发现上超过 GPT-5.5,并以远小于 Anthropic、OpenAI 模型的体量胜过更大模型。Inherent 由 Google DeepMind 校友创立,种子轮融资 5000 万美元;团队把复现科研论文能力视为后续创新的台阶。

来源:TechCrunch


Meta 发布编程模型 Muse Spark 1.2,可在 Open Code 免费使用

Meta 发布面向长程软件工程的编程模型 Muse Spark 1.2,可在 Open Code 中免费使用。演示中它生成了 3D 地球仪表盘;发布者称该模型在基准测试中超过 GPT-5.6 与 Gopher 4.5,并在 Artificial Analysis 智能指数上接近 Opus 4.8 Max 的 56 分。

来源:YouTube · Codedigipt


SpecBench 反向测"设计规格审查":最佳 Agent 得分 44.4%

SpecBench 不要求 Agent 实现正确规格,而是给它一个有缺陷的设计提案并让其指出问题。该基准用 Kubernetes、React、Rust、TVM 和 vLLM 的真实 RFC 评审线程构建,覆盖遗漏、歧义、不一致、错误四类缺陷;目前最佳 Agent 得分 44.4%,意味着多数专家提出的缺陷未被发现。作者提示,真值由 LLM 评审面板过滤,且没有人类基线,不能与实现类基准约 80% 的分数直接比较。

来源:YouTube · Prompt Vidya AI


论文披露:可从商用 LLM API 窃取推理轨迹

论文《Stealing Reasoning Traces from Proprietary LLM APIs》披露,部分商用 API 会返回加密的推理状态以支持对话恢复或分叉,但这些 blob 可跨用户和同系列模型重放;较小模型可要求服务商解密轨迹,再用明文复述隐藏推理。研究还讨论了泄露的私有数据、可复用越狱、被投毒的 Agent 轨迹和思维链监控问题。

来源:YouTube · Machine Learning Street Talk


Codex 周活突破 2000 万,Claude Code 增速降至 5.2%

OpenAI Codex 本周突破 2000 万活跃用户,企业业务按当前收入水平年化计算增长约 50%,快于公司整体 35% 的增幅。TickerTrends 追踪显示,截至 8 月 10 日 Codex 四周增长 20.8%,Claude Code 同期仅 5.2%;Claude Code 年化收入从 2 月约 25 亿美元升至 6 月超 140 亿美元,8 月 10 日约 151 亿美元,增速进入个位数区间。

来源:钛媒体


OpenAI 将 GPT-5.6 Sol API 价格下调超 20%

OpenAI 将 GPT-5.6 Sol 的 API 价格下调超过 20%,上个月还下调了更小的 Terra 与 Luna 模型价格。

来源:Tech in Asia


微软团队提出 AI Agent FinOps 控制面:花费降 78%,完成率升到 96%

微软团队介绍面向 AI Agent 的 FinOps 控制面:代码侧用注解标出方法边界,governor 持有已授权动作,控制面按维度给运行分组、设预算并挂策略。完整策略套件在两组开源仓库基准上把 Agent 平均花费降低约 78%,运行完成率从 67% 提到约 96%;除 halt 熔断外,steer 会在预测超支时注入"输出更简洁"的指令,而不是直接杀掉运行。

来源:YouTube · AI Engineer


Anthropic 工程师:给 Agent 预算,而不是给 token

一个清理 Agent 因上游管道某阶段评估为空,在 90 秒内删掉约 200 个工作负载、影响约 20 名工程师,其中包含未 checkpoint 的长期训练任务。Anthropic 的 Sachin Malhotra 以此说明 token 权限不够:预算包含金额、速度、可回滚程度和谁来注意四个维度,应把可失败得大声的操作交给 Agent,把静默失败的操作留给人。

来源:YouTube · AI Engineer


研究:前沿 AI 实验室仍不愿说明如何遏制失控模型

一项新研究发现,领先 AI 实验室几乎没有公开记录失控模型的遏制方案,而模型正越来越频繁地表现出意外甚至危险行为,这对其准备程度提出疑问。

来源:TechCrunch


🏢 AI 战略与组织变革

苹果裁撤 Siri 与 Vision Pro 逾 200 个岗位,集中资源押注 AI

苹果裁撤 Siri、Vision Pro 及相关 AI 软件团队逾 200 个岗位,其中约 100 个为 Vision Pro 相关职位、约 100 个为 Siri 与软件工程岗位。新版 Siri 建立在全新架构上,苹果称将在撤销部分职位的同时创建新岗位;Vision Pro 游戏功能团队基本解散,下一代机型最早可能推迟到 2028 年底。

来源:华尔街见闻全球


腾讯、字节加码 AI 视频工具出海

字节 8 月 12 日将小云雀 AI 短剧 Agent 升级为本地化创作工作台,腾讯 8 月 14 日推出面向海外用户的 AI 创作平台 OnSolo,来画同天宣布 6800 万元 D 轮融资。DataEye 报告显示,上半年国内 AI 剧/漫剧新作 22.19 万部、破亿率仅 0.47%,平台转向海外找增量;TikTok 6 月单月短剧分成突破 2200 万美元。

来源:人人都是产品经理


💰 资管与金融科技前沿

三部门全国推广已故人士金融账户一站式查询试点

国家金融监督管理总局、民政部、司法部 8 月 21 日联合发布通知,在全国推广浙江省、青岛市已故人士金融账户查询服务试点经验。两地依托政务系统建设"个人身后一件事"联办平台,已试点一站式查询已故人士银行、保险等金融资产信息,并便捷提取符合条件的小额存款;通知鼓励政务数据共享机制健全、跨部门协同能力较强的地区率先复制推广,并就工作机制和数据安全提出要求。

来源:微博


广西用分布式医疗 AI 架构回答隐私问题,已在 6 家三级医院试点

广西以 U 型隐私推理技术为底座建设医疗 AI 生态平台:训练侧采用联邦训练与模型混淆,推理侧经隔离架构接入国家算力网,实现"数据不出域、算力安全调度、模型隐私保护",已在 6 家三级医院试点应用。广西医保影像云平台已覆盖 14 个设区市、接入 463 家医疗机构,并建成含 9.5 万例病例的高质量医学影像数据集。

来源:微博


🎓 学术前沿

深势科技发布"玻尔·科学空间",让 AI 科学家接管科研体力活

深势科技发布"玻尔·科学空间"公开测试版,为科研人员与 AI 科学家提供统一桌面端工作环境。平台内置 SciMaster 全科科研专家,以及面向生物、医学、药物研发和材料的 BioMaster、PharmMaster、MatMaster,可自动检索文献与专利、梳理共识与空白、生成实验方案,并调用本地或云端算力执行计算、模拟和数据分析。

来源:硅星人Pro


英矽智能上线虚拟衰老细胞页面,发布多智能体 VAC 平台预览

英矽智能上线虚拟衰老细胞(VAC)概念页面,并发布多智能体驱动的多模态 VAC 平台预览版。VAC 把"生物学年龄"作为核心条件变量,在分子、细胞内、细胞间、组织、器官和群体六个尺度协同推理,动态模拟细胞分化、重编程与衰老,用于靶点识别、细胞命运干预和抗衰老研究。

来源:BAAI 智源


Nature Communications:药物筛选联合机器学习发现儿童痴呆候选药

研究团队用 MPS IIIA 患儿与健康儿童的 iPSC 建立皮层神经模型,结合高内涵成像、机器学习和单核 RNA 测序,从 63 种候选药中筛出至少 9 种能显著改善疾病表型的药物,包括乙酰-D-亮氨酸、别嘌醇、去铁胺等。XGBoost 模型基于 117 项神经元与 195 项星形胶质细胞特征判断细胞状态,与表型分析高度一致。

来源:BAAI 智源


ECCV 2026:美图提出一致特征传输 CFT,把人像重打光做成特征传输问题

美图影像研究院提出 CFT(一致特征传输),把人像重打光重新表述为光照一致的特征传输问题,在 Rectified Flow 框架上显式学习源图与目标图之间的光照变换,成果被 ECCV 2026 录用。团队构建了覆盖 14 类光照效果的数据集;用户研究显示 Flux-Kontext + CFT 在光照质量、内容一致性、物理合理性和图像美学上表现最佳。

来源:机器之心


🔧 硬件算力与智能设备

英伟达告知部分大客户:2027 年初起系统价格将上涨超 15%

彭博援引消息人士称,英伟达已通知部分最大客户,包括 Vera Rubin 和 Grace Blackwell 在内的 AI 芯片服务器系统将从 2027 年初开始涨价 15% 以上。

来源:Techmeme


韩国半导体专家:英伟达外置 SSD 方案将带动 NAND 闪存需求

英伟达为突破 GPU 存储物理限制,采用外置 SSD 方案,通过光纤或铜缆连接数百 TB 超大容量存储池,以 NAND 闪存替代部分高成本 HBM。韩国半导体专家称,这一架构设计预计带动 NAND 闪存需求急剧增长。

来源:华尔街见闻全球


九家科技公司 AI 基建表外承诺约 3 万亿美元

《华尔街日报》梳理 Alphabet、亚马逊、微软、Meta、Oracle、英伟达、博通、SpaceX 和 AMD 的监管文件发现,这些公司已积累约 3 万亿美元表外承诺,大部分与 AI 基建有关,约为过去一年 6000 亿美元传统资本开支的五倍。其中约 1.2 万亿美元为尚未起租的租约承诺,约 1.9 万亿美元为采购及其他合同义务,大多不可取消。

来源:钛媒体


特斯拉官宣 9 月 3 日在奥斯汀举行 Cybercab 发布会

特斯拉宣布将于当地时间 9 月 3 日在德克萨斯州奥斯汀举行 Cybercab 发布活动。该车型没有方向盘和刹车踏板,6 月起已在奥斯汀等地公共道路测试,7 月开始让员工在园区试乘;目前特斯拉在奥斯汀以 186 辆改装 Model Y 运营 Robotaxi,Cybercab 是否已获得无踏板车辆商业载客批准尚不明确。

来源:华尔街见闻全球

图文卡片 ⬇️ 一键下载图文卡片