前沿科技日报 · 2026-07-19
商汤发布面向长程任务的 SenseNova U1 Pro,奕行智能展示 RISC-V AI 算力超节点,国家发展改革委发布人工智能合作发展行动计划
2026-07-19 前沿科技洞见 · 日报
📊 今日关键数据
- 140 万亿 Token/日:国家数据局称,中国 2026 年 3 月的日均 AI Token 消耗达到该水平;2025 年 12 月为 100 万亿,2024 年初为 1,000 亿。(来源:Techmeme)
- 295 百万美元:BrainCo 已融资约 2.95 亿美元,并展示以脑电信号控制的机器人手臂。(来源:Tech in Asia)
- 22 个连续分镜:商汤称 SenseNova U1 Pro 可在复杂视频创作中一次输出最多 22 个逻辑连续分镜。(来源:钛媒体)
🔍 今日值得深读
商汤发布 SenseNova U1 Pro,定位长程多模态任务交付
商汤在 WAIC 发布 SenseNova U1 Pro,将其定位为原生多模态智能体基座,统一理解、生成与行动能力。公司称,该模型采用 NEO-unify 内核,并面向设计美感、图文细节控制和长程任务规划提供能力。
该产品把多模态创作的目标从单次生成扩展到可连续执行的任务流程。商汤披露,U1 Pro 预览版已开启邀请测试,正式服务计划于 8 月上线并同步推出 API 与定价。
- 关键事实:模型可一次生成最多 22 个逻辑连续的分镜;SenseNova U1 及其 Skills 代码库截至 7 月中旬 GitHub Star 合计超过 8,000。
- 为什么值得深读:多模态系统能否把规划、编辑和最终交付放进同一工作流,是内容生产工具从单点生成走向任务执行时要验证的问题。
- 后续看点:8 月公开服务后的 API 能力、价格,以及其在小浣熊和 Seko 之外的企业工作流表现。
来源:钛媒体
奕行智能展示 RISC-V AI 算力超节点与智能体软件栈
奕行智能在 WAIC 展示基于 Epoch 芯片的 RISC-V AI 算力超节点方案,组成部分包括 ELink 高速互联、液冷整机和全栈软件。报道显示,单柜可支持 32 至 128 卡的高带宽互联,并以横向组网扩展至万卡级集群。
该公司同时介绍了 EVACA 软件栈与 KernelFab 算子工具,后者让智能体在真实硬件或仿真环境中执行编译、运行、测量、诊断与优化,而非只生成代码。其披露,相关算子开发周期可由周级缩短至天级。
- 关键事实:ELink 超节点单柜提供百 T 级聚合带宽,并支持 32 至 128 卡 Scale-Up 互联。
- 为什么值得深读:大模型部署的可用吞吐量取决于芯片、互联、编译器和算子适配能否一同工作,峰值算力不足以说明实际效果。
- 后续看点:VISA 虚拟指令集开源计划的工具链覆盖范围,以及全栈 RISC-V Token 工厂的交付进度。
来源:智东西
中国发布人工智能合作发展行动计划
国家发展改革委会同有关部门发布《人工智能合作发展行动计划》。文件列出优质数据供给、智能算力普惠、开源生态共享、人工智能应用、人才、规则标准、安全治理和人工智能向善等八项行动。
计划提出在部分领域建设跨境可信数据空间,推动面向发展中国家的普惠智算服务,并倡议共同建设开源社区、开源合规体系与安全准则。对跨境数据、模型生态和安全治理而言,这些均是具体的合作对象。
- 关键事实:行动计划覆盖数据、算力、生态、应用、人才、规则、治理和伦理八个方面。
- 为什么值得深读:跨境数据流动、开源合规和安全信息共享被纳入同一行动框架,金融等强合规行业需要留意其后续配套安排。
- 后续看点:跨境可信数据空间的试点领域,以及普惠智算和开源合规规则的具体实施机制。
来源:清华金融评论
腾讯云披露企业智能体接入旧系统的工程约束
腾讯在 WAIC 发布企业级智能体开发平台 ADP 4.0 海外版和桌面智能体 WorkBuddy App。腾讯云副总裁吴运声称,企业智能体相关客户需求和平台使用量今年同比至少翻倍。
报道将企业落地的主要障碍归结为既有 ERP、CRM 等系统缺少 API、MCP 或 CLI 接口;此外,企业还需要把构建、评测、发布、权限、日志和审计串成可运行的流程。ADP 4.0 此次加强了技能和执行过程的可观测、可审计与安全管理。
- 关键事实:腾讯称其企业智能体相关客户需求和平台使用量今年同比至少翻倍。
- 为什么值得深读:智能体进入业务流程前,旧系统接口、权限边界和运行审计往往比模型演示效果更先决定能否上线。
- 后续看点:ADP 4.0 海外版的可用地区,以及企业知识服务与 MCP 接口在存量系统中的接入方式。
来源:智东西
📰 独立报道
🤖 AGI 前沿
MOOSE-Star 提出科学发现训练的分解式检索与组合框架
MOOSE-Star 面向从科学背景中生成假设的训练问题,将直接学习假设的组合搜索拆分为规划、检索和组合步骤。报道介绍,该方法以分层检索和有界组合降低检索成本,并发布 TOMATO-Star 数据集用于训练。
- 关键事实:TOMATO-Star 包含 108,717 篇已分解论文,构建过程使用 38,400 GPU 小时。
- 后续看点:代码开源后,该框架在不同学科语料和真实科研任务中的复现实验。
来源:BAAI 智源
港科大研究指出重复 Token 可扰乱 MoE 路由
一项 ICML 2026 研究报告,重复输入可诱导混合专家模型的路由负载失衡,并通过批处理影响同批及后续正常请求。研究描述的黑盒测试不需要模型权重、梯度或部署后端细节。
- 关键事实:报道称,在测试条件下首字延迟最高增加 148%。
- 后续看点:模型服务方是否加入重复 Token 检测、批处理隔离或路由负载保护措施。
来源:新智元
上海 AI Lab 发布可自我修改外层运行规则的 Self-Harness
上海人工智能实验室提出 Self-Harness,让模型分析失败轨迹并修改提示词、工具规则等外层运行配置;每次修改再经回归测试检查是否退化。该方法强调不更换底层模型,而调整模型运行时的外部约束。
- 关键事实:报道称,Qwen3.5 在该框架下的性能提升 104%。
- 后续看点:公开评测中对不同任务和不同模型的增益,以及回归测试的覆盖范围。
来源:量子位
WIRED 报道提示注入正在干扰自动化网络安全智能体
WIRED 报道称,研究者正用“context bombing”等提示注入方式让恶意自动化攻击智能体提前停止或偏离任务。该案例说明,智能体读取网页、文档和外部工具返回值时,输入内容本身也可能成为控制面攻击入口。
- 关键事实:报道将这一类防御描述为通过上下文内容让攻击智能体自行终止。
- 后续看点:安全智能体是否把不可信页面内容与系统指令、工具权限隔离处理。
来源:WIRED
🏢 AI 战略与组织变革
Replit 介绍由智能体参与开发、销售与支持的工作方式
Replit 提出“自驱型公司”的工作方式:由人设定目标,多个智能体参与执行。报道称,智能体已被用于代码审查,并扩展到销售、数据和支持等非工程部门。
- 关键事实:其披露的人均代码产出提升接近三倍,事故数量未增加。
- 后续看点:该方法在非工程流程中如何定义人工复核、权限和事故归因。
来源:AI提效手册
阿里发布企业级 AI 应用创作平台秒悟团队版
阿里在 WAIC 发布秒悟团队版(Meoo Team),为团队提供统一身份、采购与额度管理、应用和技能访问控制以及资产共享。平台支持以自然语言生成应用、网站、H5 页面或微信小程序,并可一键部署。
- 关键事实:阿里称,秒悟自 4 月上线以来每天已有上万名用户创作,其中超过一半没有技术背景。
- 后续看点:团队版对企业应用、技能和云资源的权限模型,以及与现有企业系统的集成范围。
来源:华尔街见闻
华为云讨论面向金融场景的企业智能体工程能力
华为云在 WAIC 企业智能体论坛介绍 AgentArts 与开源框架 openJiuwen。报道显示,平台把构建、运行与运营拆分为 AgentStudio、AgentRun 和 AgentOps,并加入多层控制器、身份、网关、会话隔离和细粒度权限等能力。
中软国际同场发布灵析企业智能体平台 V3,并与华为云、工商银行、银联、邮储银行等机构发起“智慧金融专区”行动。该平台面向金融等行业处理数据语义、本体、多智能体调度和运行审计。
- 关键事实:华为披露,openJiuwen 在 Coding 场景将首 Token 时延降低 22%,缓存命中率提升 30%,吞吐提升 20%。
- 后续看点:智慧金融专区沉淀的技能资产能否形成可复用、可审计的行业组件。
来源:智东西
💰 金融科技前沿
InfoQ 关注智能体高频调用对账单风控的压力
InfoQ 报道指出,智能体可在短时间内发起大量模型与工具调用,传统按周期出账、事后核对的风控流程难以及时识别异常消耗。对面向企业客户提供智能体服务的平台而言,调用速度、预算控制和权限治理需要同步设计。
- 关键事实:报道聚焦智能体算力消耗速度超过传统账单风控响应速度的问题。
- 后续看点:云平台和模型服务商是否提供会话级预算、即时熔断和异常调用告警机制。
来源:InfoQ 中文站
🎓 学术前沿
Sebastian Raschka 梳理大模型低、中、高推理努力模式
Sebastian Raschka 发布文章讨论大语言模型如何学习低、中、高三种推理努力模式。文章把“推理努力”作为模型在不同任务上分配计算量与思考长度的对象,而非单一的模型能力标签。
- 关键事实:文章明确聚焦低、中、高三档推理努力模式的学习问题。
- 后续看点:这些模式在同一模型内的切换控制,以及成本、延迟和任务正确率之间的实测关系。
🔧 硬件算力与智能设备
Oracle 数据中心项目因许可和供电方案调整增加成本
The Information 经 Techmeme 报道,Oracle 在新墨西哥州 Project Jupiter 的数据中心项目遇到许可障碍后,将部分供电方案从燃气轮机转向成本更高的燃料电池。报道认为,这使 AI 超大规模园区的建设成本进一步上升。
- 关键事实:报道将 Project Jupiter 的计划规模列为 1,650 亿美元,并称供电方案调整带来数十亿美元额外成本。
- 后续看点:当地许可进度、燃料电池交付能力,以及电力基础设施是否继续成为项目排期约束。
来源:Techmeme
台积电计划在 2028 年量产 A14 制程
Tech in Asia 报道称,台积电计划于 2028 年量产 A14 制程。该报道将其与 2nm 技术比较,称 A14 可实现最高 30% 的功耗降低。
- 关键事实:报道给出的量产时间为 2028 年,功耗降幅为最高 30%。
- 后续看点:A14 的量产节点、客户导入节奏,以及能效指标在高性能计算产品中的实际兑现情况。
来源:Tech in Asia
Zoox 因浓烟事件召回 Robotaxi 软件
Amazon 旗下 Zoox 在一起车辆遇到浓烟的事件后召回 Robotaxi 软件。报道称,Zoox 已在拉斯维加斯和旧金山提供超出封闭测试范围的免费乘车服务。
- 关键事实:本次召回针对 Robotaxi 软件,触发原因是浓烟场景。
- 后续看点:修复后系统对低可见度与异常环境信号的处理方式,以及监管对恢复运营的要求。
来源:Tech in Asia