FINTECH FRONTIER DAILY
🏠 返回首页
FINTECH FRONTIER DAILY

前沿科技日报 · 2026-08-17

阿里 Qwen3.8-27B 开源两天全平台下载破百万;OpenAI 被曝 7 月末解散 Preparedness 团队;DeepSeek V4 Pro 峰谷计价今日生效。

降低FOMO的每日信息交付

2026-08-17 前沿科技洞见 · 日报


📊 今日关键数据


🔍 今日值得深读

阿里 Qwen3.8-27B 开源两天下载破百万,27B 模型进入消费级显卡区间

阿里开放权重的 Qwen3.8-27B 已连续数日登顶 Hugging Face Trending,官方统计开源两天全平台下载量超过 100 万次,社区贡献超 500 个量化版本,相关模型总下载量超过 500 万次。该模型为 27B 参数原生多模态 Dense 模型,原生上下文 262K,采用 Apache 2.0 许可证;4-bit 量化后可进入 24GB 显存区间。社区在 RTX 4090 上开启 MTP 的测试环境跑到约 65 tokens/s,SGLang 在单张 RTX 5090 的特定配置下给出 206.1 tokens/s 的 Decode 成绩。

来源:划重点KeyPoints-公众号


真实电商任务里,最强模型通过率只有 60.75%

阿里国际站团队公开的 RealReplicaBench 从约 160 万条完整对话中整理出 20 万条工作流,最终归纳为 107 个可复现电商任务,覆盖供应商采购、商品发布、店铺经营、订单对账、国际物流和售后争议。在 PI 开源 Harness 框架下,Claude Opus 5 完成 65 个任务、通过率 60.75%;Qwen 3.8 Max 和 DeepSeek V4 Pro 并列第三,通过率均为 49.53%,多数模型不到 50%。

来源:华尔街见闻全球


AI 数据中心瓶颈从算力转向网络,GPU 多数时间在等数据

是德科技网络与数据中心副总裁 Joachim Peerlings 在 Keysight World 大会展示的数据显示,计算机视觉模型训练中 GPU 超过 60% 的时间花在数据移动和通信上,真正计算时间仅约 20%;大语言模型训练任务中因网络问题导致的失败率高达 21%。中科曙光高级副总裁李斌称,以 GPU 为中心的计算节点一台机器需要 8 张甚至更多网卡,相比传统 CPU 节点高速网络用量提升 10 到 20 倍。新的端到端负载均衡方法可将网络带宽利用率最高提升 38%,模型训练时长缩短超过 3%。

来源:钛媒体


DeepSeek 今日执行峰谷计价,V4 Pro 高峰输入 9 元/百万 tokens

8 月 17 日起,DeepSeek V4 Pro 高峰时段每百万 tokens 输入(缓存未命中)9 元、输出 27 元,缓存命中输入 0.3 元;空闲时段输入(缓存未命中)4.5 元、输出 13.5 元,缓存命中输入低至 0.15 元。与此前 8 月 13 日公布的价格相比,高峰时期定价涨幅最高达到 1200%。同期 Anthropic、OpenAI 等海外模型出现大客户流失,并主动降价 50%–80%;OpenRouter 最新调用量榜单上,前列出现 DeepSeek、小米、腾讯、智谱等中国模型。

来源:钛媒体


COLM 2026 三篇论文质疑 Transformer 默认设计

COLM 2026 上三篇论文分别从长上下文、梯度和推理链维度对 Transformer 默认配置发难。第一项工作用 Llama 2、Llama 3、Qwen 3、Olmo 3 的架构选项组合训练 26 个 7B–8B 模型,在 HELMET 32K 上最高 56.4 分、最低 29.9 分,相对差距 47%,多个“有害设计”叠加时掉分远高于单项之和;第二项在 GPT-2、Pythia、Llama 3、OLMo 2、Qwen 3 上测得输出投影层反向传播会损耗 95%–99% 的梯度训练信号;第三项显示层剪枝会严重破坏长链推理扩展能力。

来源:量子位-公众号


AQuA 用密封沙盒杜绝量化前视偏差,A 股复现扣费净夏普 4.42

AQuA 把量化 Agent 的探索限制在受限领域特定语言和密封沙盒中,Agent 只能通过因果算子语法树生成因子表达式,不能直接写 Python;数据切分、特征集和标签在实验前冻结,样本外评分器独立且不反馈。QuantML 将该方法移植到 A 股 30 分钟线,股票池为沪深 300 成分股中训练期前半段成交额排序前 150 只,覆盖 2020–2025 年。13 轮自主演进后,模型自主把序列窗口从 32 根 Bar 逐步压缩到 8 根,最终测试集 IC +0.0549、样本外保留率 78%,扣费净夏普 +4.42。

来源:QuantML-公众号


OpenAI 解散 Preparedness 团队,安全职责在 IPO 前并入业务线

OpenAI 在 7 月末解散专职评估模型灾难性风险的 Preparedness 团队,生物安全、网络安全等评估职责被拆分并入各业务线,原负责人转向研究递归自我改进型人工智能的潜在影响。此前,公司 8 月 7 日因下一代模型 Astra 的网络安全风险达到“关键”阈值紧急叫停研发;今年 3 月完成 1220 亿美元私募融资,6 月向美国证券交易委员会秘密提交 S-1。解散消息直到近两日才被曝出。

来源:钛媒体


🔥 今日聚合动态

英伟达联合六家金融机构搭建 AI 算力融资平台

英伟达宣布与阿波罗、贝莱德、黑石、博枫、高盛和 KKR 签署谅解备忘录,计划建立多个融资平台,目标为 AI 基础设施建设筹集超 5000 亿美元第三方资本。两家材料分别从官方合作结构与财务风险角度说明这项计划。

视角来源核心信息
交易结构w.media六家机构分别提供数据中心地产与电力基础设施、私人信贷和机构资金等能力;英伟达提供最高 25% 的残值支持机制
财务与风险虎嗅-前沿科技-网站英伟达 FY2027 Q1 数据中心收入 752 亿美元、同比增长 92%;制造、供应和产能承诺达 1190 亿美元;GPU 金融化面临技术折旧快、需求错配等风险

📰 独立报道

🤖 AGI 前沿

18 个模型跑 153 次断网自主科研,Kimi K3 逼近 Opus 5

Prime Intellect 让 18 个前沿模型在断网沙箱中自主调整优化器,目标是以更少训练步数把 1.24 亿参数 GPT 的验证损失降到规定阈值。Kimi K3 配 Prime Agent 跑出 2930 步,接近 Opus 5 的 2920 步并超过 GPT-5.6 Sol 的 3042 步;没有一次实验提出真正全新的方法,差距主要体现在多 seed 验证、旧结论复验和实验成本判断上。

来源:量子位-公众号


Hugging Face 报告:美国千亿级开源模型多数基于中国模型适配

Hugging Face 夏季报告显示,2026 年前七个月美国发布的 1000 亿参数以上开源模型中,多数基于中国模型进行微调、量化、格式转换或硬件适配。公共模型仓库从 243 万个增至 296 万个,但 85.6% 的模型终身下载量不足 200 次,仅 1.5% 的仓库贡献 99.2% 的下载量。

来源:华尔街见闻全球


Alaya-EVOKE 开源小时级视频世界模型

Alaya Lab、中国科学技术大学与上海创智学院联合推出开源 Alaya-EVOKE,示例可连续生成 120 分钟、172800 帧一镜到底视频,仅用 3 步去噪且不开启 CFG。外部世界状态银行把历史写出了模型上下文,单张 H200 生成 1.5 秒 384×640 视频的扩散部分只需 2.11 秒。

来源:量子位-公众号


智象 HiDream-O1-World 登顶 WBench 交互世界模型榜

智象未来正式发布原生全模态交互式世界模型 HiDream-O1-World,首次参加 WBench 即在 Navi 分榜以 80.9 分排名第一,物理一致性 73.3 分、一致性维度 88.0 分,超过腾讯混元 1.5 和阿里 Happy Oyster。该模型支持漫游、编辑、交互三种输入方式。

来源:甲子光年-公众号


HelixWorld 1.0 实时生成 24FPS 画面和 48kHz 立体声

Noiz AI 联合港科大、清华、CMU、Google DeepMind 等机构研究员发布 HelixWorld 1.0,用统一 Transformer 同步生成 24FPS 画面与 48kHz 双声道音频,用户操作会同时作用于画面和声场,不再是事后配乐。团队称模型权重和代码将在未来几周完全开源。

来源:量子位-公众号


🏢 AI 战略与组织变革

甲骨文披露企业 AI 战略:Agent 进数据库、GPU 跑满、多云砍掉流量费

InfoQ 中文站报道,甲骨文企业 AI 战略的三个方向包括:把 Agent 能力放进数据库、抬高 GPU 利用率,以及在多云方案中砍掉流量费。

来源:InfoQ 中文站


Dropbox 集成 MCP 与 Dash,连接安全设计与代码审查

Dropbox 将 MCP 与 Dash 集成,把安全设计和代码审查连接起来,把安全约束放回开发协作流程。

来源:InfoQ 中文站


Stripe:AI 生产力用来“构建更多”,内部编程 Agent 每周产生数千个 PR

Stripe 产品与业务总裁 Will Gaybrick 在 a16z 播客中表示,公司把 AI 生产力视为构建更多产品的机会,而不是单纯裁减成本;内部编程 Agent 现在每周生成数千个 Pull Request。讨论还涉及结算页可能消失、小额支付回归、稳定币基础设施和 AI 智能体互相购买软件服务。

来源:a16z Podcast


⛓️ 区块链创新

路透:Binance 曾向俄罗斯提供交易记录和护照复印件

路透社援引俄罗斯执法文件报道,Binance 曾向俄方提供 IT 专家 Yuri Belenkiy 的交易记录和护照复印件,导致其面临恐怖主义指控;文件还显示,Binance 去年向俄罗斯当局提供了与乌克兰筹款活动有关的加密捐赠交易信息。

来源:Techmeme


美国加快资产代币化布局,研究称意在为本土 AI 导入全球资金

财联社报道,韩国 Eugene Investment & Securities 研报认为美国正借助代币化扩大海外投资者进入美国资产的可投资范围。高盛预测 2026 年美国 AI 投资规模约 5810 亿美元、占 GDP 的 1.8%;纽约证券交易所 7 月已参与 DTC 的代币化试点并搭建配套结算平台。

来源:环球


💰 资管与金融科技前沿

央行新增 8 家数字人民币运营机构,总数扩至 30 家

中国人民银行新增平安银行、恒丰银行、渤海银行、上海银行、杭州银行、徽商银行、长沙银行和广西北部湾银行为银行类数字人民币业务运营机构,并接入央行端数字人民币系统。新增机构将在完成业务、技术准备后开展数字人民币业务。

来源:华尔街见闻全球


华夏银行用光电伊辛机求解智能体 Skill 选择

华夏银行、中科院半导体所等将智能体构建中的 Skill 选择问题转化为二次无约束二值优化(QUBO)问题,使用光电伊辛机求解。文章称,与直接使用大模型的选择方案和经典组合优化算法相比,该方案在求解时间和能耗方面优势明显。

来源:金融科技研究


RWA+DePIN 被用于充电基础设施和国有资产盘活研究

《科技与金融》文章以 2026 年 2 月八部委及证监会 RWA 监管文件为背景,论证充电桩这类分布式、碎片化资产通过 RWA+DePIN 实现物理资产数字化与现金流合约化,为国资从重资产持有者转向建设运营商提供路径,同时提示需在“境内严禁、境外严管”框架下推进。

来源:科技与金融杂志


🔧 硬件算力与智能设备

GPU 成本与售价或差 20 倍,CUDA 护城河面临 AI 与 AMD 双重冲击

资深 AI 创业者 Dave Blundi 和前微软 AI 专家 Ramez Naam 称,GPU 目前成本与售价之间可能相差 20 倍;英伟达真正的护城河不是芯片而是 CUDA 生态,但随着 AI 自动编程、AMD 及其他芯片崛起,CUDA 优势或在未来两年被削弱。

来源:华尔街见闻全球


美国 60 个最大规划数据中心每年或排放 1.015 亿吨 CO2

FT 分析显示,美国 60 个最大规划数据中心若全部建成,每年可能合计产生 1.015 亿吨 CO2,约占 2025 年美国电力行业排放的 7%,相当于 27 座煤电厂或 2400 万辆汽车的年排放量。

来源:Techmeme


Meta 与贝莱德 140 亿美元数据中心项目被曝未投保全损险

FT 援引信源称,Meta 与贝莱德在 El Paso 的 140 亿美元数据中心项目未对全损风险投保,贷款人因此暴露在信用风险和潜在大额负债下;保险公司不愿承担全面保障成本,千兆瓦级园区投资者面临数十亿美元的保障缺口。

来源:Techmeme