前沿科技日报 · 2026-07-17
Kimi 发布 2.8 万亿参数 K3 并宣布 7 月 27 日开放权重,欧盟要求 Google 向竞争 AI 开放 Android 与搜索数据,Visa 推出面向机构的稳定币管理平台 VSP
2026-07-17 前沿科技洞见 · 日报
📊 今日关键数据
- 2.8 万亿参数:月之暗面发布 Kimi K3,并计划在 7 月 27 日开放权重(来源:Techmeme)
- 54%:VentureBeat 对 107 家企业的调查中,报告已出现智能体安全事件或险情的比例(来源:VentureBeat)
- 32%:该调查中为每个智能体配置独立且受限身份的企业比例(来源:VentureBeat)
- 5.66 倍:AgentCompile 在报道所述 CUDA 推理任务上的平均加速(来源:PaperWeekly)
- 36 个:Epic 为 Fortnite 创作者准备的 AI 语音 NPC 角色数量(来源:The Verge)
- 100 轮:AIDE² 在不改变模型权重下改写 Harness 的迭代次数(来源:PaperWeekly)
🔍 今日值得深读
Kimi 发布 2.8 万亿参数 K3,计划 7 月 27 日开放模型权重
月之暗面发布 Kimi K3,称其为 2.8 万亿参数模型,并计划在 7 月 27 日开放权重。官方介绍显示,模型采用 Kimi Delta Attention 与 Attention Residuals 架构,面向长上下文与推理任务。
第三方报道还提到,K3 在 Frontend Code Arena 位列第一,在 Terminal Bench 2.1 获得 88.3 分;这些是外部基准结果,仍需结合权重开放后的复现情况判断。
- 关键事实:Kimi K3 标称 2.8 万亿参数,权重计划于 7 月 27 日发布。
- 为什么值得深读:大参数开放权重模型是否能在推理成本、上下文长度与代码任务之间维持可复现表现,将直接影响企业的本地部署选择。
- 后续看点:7 月 27 日权重、许可证、推理硬件要求及官方评测细节是否同步公布。
来源:Techmeme
欧盟要求 Google 开放 Android AI 入口与搜索数据
欧盟委员会的 DMA 具体措施要求 Google 在 Android 上支持竞争性 AI 平台,并调整搜索相关数据的开放安排。Ars Technica 报道称,现有 Gemini 具备预装、唤醒词、屏幕内容访问及系统/应用自动化等系统级优势。
该决定具有法律约束力。报道同时指出,Google 认为这些要求会增加隐私和安全风险,但作为 DMA 所认定的“守门人”,仍须落实相应措施。
- 关键事实:措施覆盖 Android 的竞争 AI 访问与搜索数据开放两部分。
- 为什么值得深读:系统级助手权限决定了第三方 AI 能否进入语音唤醒、屏幕理解和跨应用操作等移动端工作流。
- 后续看点:欧盟公布的实施时间表,以及 Google 为第三方助手提供的具体接口和权限范围。
来源:Ars Technica
Visa 将稳定币铸造、转移与管理整合至 VSP 测试平台
Visa 发布 Visa Stablecoin Platform(VSP),称该企业平台面向金融机构、金融科技公司和支付服务商,统一处理稳定币的铸造、转移和管理。平台首先以 Open USD 进入测试阶段。
该产品将稳定币运营能力放在机构侧的单一环境中,而不是只提供面向零售用户的钱包或支付入口。具体支持的链、结算规则与接入机构名单尚未在该公告中披露。
- 关键事实:VSP 已以 Open USD 进入 beta。
- 为什么值得深读:稳定币基础设施正在从单一转账场景扩展到机构发行、资金调度和运营管理的系统接口。
- 后续看点:Visa 后续公布的支持网络、合规控制和首批金融机构接入情况。
来源:X · Visa
企业智能体安全调查显示 54% 受访者出现过事件或险情
VentureBeat 对 107 家员工数超过 100 人的企业调查显示,54% 的受访企业称已发生确认的智能体安全事件或险情;其中确认事件占 18%。调查还称,只有约 32% 的企业为每个智能体配置独立且受限的身份。
在最高风险智能体的隔离方面,受访企业中仅约三成使用沙箱。调查所描述的问题集中在共享凭据、身份边界和隔离控制,而不是单纯的模型内容过滤。
- 关键事实:调查样本为 107 家企业;54% 报告事件或险情,32% 为每个智能体配置受限身份。
- 为什么值得深读:当智能体获得业务系统和数据访问权时,身份与权限设计会决定一次错误调用的影响范围。
- 后续看点:企业是否开始把独立身份、最小权限和高风险任务沙箱化列为上线前条件。
来源:VentureBeat
Google DeepMind 与 Isomorphic Labs 公布生物安全协作方法
Google DeepMind 与 Isomorphic Labs 发布联合说明,介绍两家机构在生物韧性与 AI 模型上的协作方向。DeepMind 表示,目标是把前沿 AI 用于更主动的全球健康防御。
公告未公布新的模型基准或具体部署规模,但将生物安全放入模型研发与应用协作的公开议题中,并与药物研发机构 Isomorphic Labs 联动。
- 关键事实:DeepMind 和 Isomorphic Labs 以联合公告形式披露生物韧性合作方法。
- 为什么值得深读:生物领域模型的能力建设与风险管理正被放在同一合作框架内讨论。
- 后续看点:双方后续是否披露具体评估流程、外部专家机制或可验证的生物安全项目。
来源:DeepMind
📰 独立报道
🤖 AGI 前沿
NVIDIA 发布 Nemotron 3 Embed 8B,称其在 RTEB 总榜第一
NVIDIA AI 宣布发布 Nemotron 3 Embed 8B,并称该嵌入模型在 RTEB 检索基准总榜排名第一。公告将其定位为提升智能体检索上下文相关性的组件。
- 关键事实:NVIDIA 称 Nemotron 3 Embed 8B 位列 RTEB 总榜第一。
- 后续看点:模型权重、许可证和各检索子任务分数是否公开,以及在企业私有语料上的效果。
OpenAI 介绍面向青少年的 ChatGPT 安全措施
OpenAI 发布说明,称 ChatGPT 将为青少年提供与年龄相符的保护、学习工具、家长控制和专家合作机制。公告强调的是产品安全配置,而非单一模型更新。
- 关键事实:措施涵盖年龄适配保护、学习工具和家长控制。
- 后续看点:相关功能的适用地区、年龄识别方式和家长控制的实际配置项。
来源:OpenAI 新闻
Google 将 NotebookLM 更名为 Gemini Notebook
Google 将 AI 笔记工具 NotebookLM 更名为 Gemini Notebook,并保留其独立应用形态。报道称,该产品会更深地接入 Gemini 和 Google Search,用户不久后可从 Search 的 AI Mode 访问自己的笔记本。
- 关键事实:NotebookLM 更名为 Gemini Notebook,仍为独立应用。
- 后续看点:笔记本内容通过 AI Mode 调用时的权限边界和企业数据管理选项。
来源:The Verge
Google 称 Gemini 3.5 Pro 为改进编程能力而延后发布
Google 表示正在与合作伙伴测试 Gemini 3.5 Pro、升级版 Flash 模型及其他模型,并在与美国政府讨论安全标准。报道称,Gemini 3.5 Pro 的发布被延后,以继续改善代码能力。
- 关键事实:Google 正在对 Gemini 3.5 Pro 与升级 Flash 模型进行合作伙伴测试。
- 后续看点:Google 公布正式发布日期时是否同步给出编程评测、安全说明和可用区域。
来源:Tech in Asia
MIT 与 Amazon Robotics 的 NeuralActuator 获 RSS 2026 系统论文奖
MIT CSAIL 介绍 NeuralActuator:该系统由 MIT CDFG Lab 与 Amazon Robotics 合作开发,用于让低成本机械臂更好地建模真实环境中的复杂执行器行为。其目标包括无传感器力感知和具备力约束的真实机器人控制。
- 关键事实:NeuralActuator 获 RSS 2026 Outstanding Systems Paper Award。
- 后续看点:该系统在不同机械臂、负载与接触任务上的公开代码或硬件复现实验。
Stanford HAI 介绍生物医学科研智能体 Biomni
Stanford HAI 介绍 Biomni,这是一种与研究人员协作的通用型 AI 智能体,面向生物医学研究数据量超出人工分析能力的场景。该项目部分由 Stanford HAI 资助。
- 关键事实:Biomni 被定位为辅助研究人员处理生物医学研究数据的通用智能体。
- 后续看点:项目披露的可调用工具范围、实验验证任务和研究机构开放方式。
LM Studio 推出本地开放模型智能体 Bionic
LM Studio 发布 Bionic,将其定位为面向开放模型的 AI 智能体。公开链接指向 LM Studio 的官方产品说明,候选材料未提供更详细的能力清单。
- 关键事实:LM Studio 发布名为 Bionic 的开放模型智能体。
- 后续看点:官方文档是否说明本地工具调用、模型兼容范围和数据保存方式。
来源:Hacker News
PUMA 用语义冗余识别推理模型的停止时机
研究者提出 PUMA 早停框架,监测推理步骤之间的语义冗余来判断何时收敛,并配合答案复核与循环打破器。报道称,该方法可在保持准确率的同时减少 token,并可零样本迁移到代码生成和多模态推理。
- 关键事实:PUMA 由冗余探测器、答案复核和循环打破器构成。
- 后续看点:论文代码开放后,在不同推理模型和长任务上的 token 节省比例是否可复现。
来源:机器之心
🏢 AI 战略与组织变革
腾讯云 SkillHub 推出面向智能体技能的 SkillPay
腾讯云表示,SkillPay 将技能提供者与调用这些技能的 AI 智能体连接起来,并将使用量与支付关联。候选材料未披露支持的结算方式或开发者准入规则。
- 关键事实:SkillPay 以技能使用量关联供给方和智能体调用方的支付。
- 后续看点:平台是否披露计费单位、技能审核和跨平台调用接口。
来源:Tech in Asia
GitLab 19.2 增加修复易受攻击依赖项的 AI 工具
GitLab 19.2 增加用于修复易受攻击依赖项的 AI 功能。GitLab 同时宣布 Duo CLI 已在 GitLab.com、自托管版和 Dedicated 部署中全面可用。
- 关键事实:Duo CLI 已覆盖 GitLab.com、自托管和 Dedicated 三种部署方式。
- 后续看点:依赖项修复功能如何呈现修改建议、测试结果和人工审批记录。
来源:Tech in Asia
DoorDash 面向 macOS 开发者测试可由智能体下单的 CLI
DoorDash 推出 DoorDash CLI 限量测试,允许 AI 智能体通过命令行发起下单。该测试目前面向美国和加拿大的 macOS 开发者,以候补名单方式开放。
- 关键事实:DoorDash CLI 为美国和加拿大 macOS 开发者提供限量 beta。
- 后续看点:下单权限、支付确认和对外部智能体的身份验证机制。
来源:Techmeme
Google Vids 加入 Gemini Omni 与自拍数字形象功能
Google 更新 AI 视频编辑工具 Vids,加入 Gemini Omni,并允许用户用自拍和录音创建自定义数字形象。候选材料将其描述为面向视频制作的功能更新。
- 关键事实:用户可用自拍与声音录制创建 Vids 的数字形象。
- 后续看点:数字形象的授权、删除机制和可用地区是否随更新一并说明。
来源:Techmeme
Google AI Mode 开始连接并操作部分应用
Google 扩展 AI Mode,使其不只回答问题,还可连接并与用户日常使用的部分应用交互。公告没有在候选材料中列出完整支持应用清单。
- 关键事实:AI Mode 的功能范围从问答延伸到跨应用完成任务。
- 后续看点:首批可连接的应用、授权提示和任务执行记录何时公开。
来源:TechCrunch
Epic 将允许 Fortnite 创作者发布带 AI 语音角色的体验
Epic Games 计划从 7 月 30 日起允许 Fortnite 创作者发布包含 AI 语音角色的体验。The Verge 报道称,Epic 已先创建 36 个具有一致声音和人设的 NPC 角色供创作者使用。
- 关键事实:Epic 准备提供 36 个预制 AI 语音角色,并计划于 7 月 30 日开放创作发布。
- 后续看点:创作者对角色台词、内容审核和玩家举报的控制工具。
来源:The Verge
💰 金融科技前沿
Marex 使用 Coinbase 基础设施支持 USDC 作为初始保证金
Coinbase 表示,Marex 正通过 Coinbase 基础设施让客户使用 USDC 作为美国监管期货和期权的初始保证金。公告称,这一安排使抵押品可在 24 小时内转移。
- 关键事实:Marex 的客户可使用 USDC 作为受监管期货和期权的初始保证金。
- 后续看点:适用的交易场所、抵押品托管安排及风险折扣规则。
来源:X · Coinbase
🎓 学术前沿
AgentCompile 将语言模型建议与编译器验证结合用于 CUDA 优化
香港城市大学团队提出 AgentCompile:语言模型负责给出语义层面的搜索建议,编译器以确定性模板生成内核并执行数值验证。报道称,该方法在 CUDA 推理任务上平均加速 5.66 倍,并在长上下文场景优于官方编译工具及 vLLM。
- 关键事实:报道给出的 CUDA 推理平均加速为 5.66 倍。
- 后续看点:论文是否公开基准脚本,以及不同 GPU 架构和模型规模上的加速分布。
来源:PaperWeekly
AIDE² 以 100 轮迭代改写智能体运行框架
Weco AI 发布 AIDE² 系统,称其在不改变模型权重的情况下,通过 100 轮迭代改写智能体运行框架 Harness。报道还称,AIDE₈₅ 将奖励作弊比例从 63% 降到 34%。
- 关键事实:系统通过 100 轮迭代更新 Harness;报道给出的奖励作弊比例从 63% 降至 34%。
- 后续看点:外部任务、评价器设置和完整迭代日志能否公开,以验证未参与筛选任务上的结果。
来源:PaperWeekly
Lychee-FD 提出端到端全双工语音大模型架构
哈工大等机构开源原生端到端全双工语音大模型 Lychee-FD,相关研究获得 ACL 2026 杰出论文奖。报道称,团队以层次化语义—声学架构处理多模态干扰,并用并行多流推理实现近三倍推理提速。
- 关键事实:Lychee-FD 相关研究获 ACL 2026 杰出论文奖,报道称并行多流推理接近三倍提速。
- 后续看点:模型、数据集与实时对话延迟的公开基准是否完整发布。
来源:AI提效手册