前沿科技日报 · 2026-05-24
NVIDIA 发布扩散语言模型取得突破,DeepSeek 同时打价格战和推 Agent Harness,AI 安全进入新的攻防阶段
2026-05-24 前沿科技洞见 · 日报
📊 今日关键数据
- 10,000+:Anthropic Mythos Preview 在 30 天内发现的高危或严重漏洞数量(来源:新智元)
- 18.5 亿元:中国证监会拟对富途控股的罚没金额(来源:华尔街见闻)
- 97.0%:Bengio 团队 GRAM 模型(10M 参数)在 Sudoku-Extreme 上的准确率(来源:PaperWeekly)
- 8,000 人:Meta 在创纪录财报后宣布的裁员规模,约占总员工 10%(来源:钛媒体)
🔍 今日值得深读
NVIDIA Nemotron-Labs 扩散语言模型:文本生成不再自回归,迈向"光速"
Hugging Face 与 NVIDIA Nemotron-Labs 联合发布了一篇技术博客,展示了基于扩散模型(Diffusion Models)的文本生成方法。与传统的自回归(autoregressive)逐 token 生成不同,扩散语言模型可以并行生成整段文本,将生成速度从"步步推进"变为"批量输出"。这篇博客详细介绍了 Nemotron 扩散语言模型的训练原理、推理机制及性能表现。
扩散模型在图像生成领域已经充分证明了并行采样的效率优势——Stable Diffusion、DALL·E 均基于此。现在这项技术被迁移到语言模型,意味着文本生成的延迟可以被数量级压缩,对实时对话、代码补全、批量文本生成等场景的响应速度有根本性影响。
- 关键事实:NVIDIA 发布扩散语言模型技术博客,展示从自回归到并行生成的方法跃迁
- 为什么值得深读:如果扩散范式在文本生成领域被工程化验证,当前所有大模型 API 的延迟-成本等式将被重写。这不只是"更快",而是交互模式可能从"打字式等待"变为"瞬间涌现"
- 后续看点:Nemotron 扩散模型是否会在 NVIDIA NIM 平台发布可调用的 API 或开源权重
来源:Hugging Face
DeepSeek V4 Pro 永久降价 + 组建 Harness 团队:开源模型进入"价格+工具"双线战
同一天,DeepSeek 宣布了两件大事。第一,DeepSeek V4 Pro API 从 6 月 1 日起永久降价,巩固其"API 市场最便宜头部模型"的价格地位。第二,DeepSeek 正式组建 Harness 团队,从零打造对标 Claude Code 的 AI 编程智能体产品,由 DeepSeek 模型驱动的 Harness 层将承担"模型之外的关键能力"——文件系统操作、终端执行、项目上下文管理。
这两步合在一起揭示了一个清晰的竞争逻辑:模型价格是入口,Harness 是护城河。DeepSeek 创始人梁文锋明确表示"目标是 AGI",而 Harness 产品将收集开发者反馈反哺模型训练,形成"模型-工具-数据"飞轮。
- 关键事实:V4 Pro 永久降价至 API 市场最低;Harness 团队对标 Claude Code,填补中国市场空白
- 为什么值得深读:Anthropic 用 Claude Code 证明编码智能体可以锁定开发者生态,DeepSeek 正在复制这一策略但叠加了不可忽视的价格优势——两者叠加的竞争力远超单纯的模型降价或工具发布
- 后续看点:DeepSeek Harness 何时发布内测版;降价后 OpenAI/Anthropic 是否被迫跟进
Anthropic Mythos 首月战报:10,000+ 高危漏洞,AI 让安全攻防进入不对称时代
Anthropic 公布了"玻璃翼计划"(Project Glasswing)的首月运行报告。其大模型 Claude Mythos Preview 在 30 天内挖掘出超过 10,000 个高危或严重级别软件漏洞,并成功拦截了一起 150 万美元的电信诈骗。具体成果包括:在 Cloudflare 核心系统中挖出 2,000 个 Bug(误报率优于人类测试者)、在 OpenBSD 代码库中发现隐藏 27 年的老 Bug 并构建利用链。
最让人不安的数字是:人类修复漏洞的速度远远跟不上 AI 发现漏洞的速度。Mythos Preview 让安全攻防从"双方拉锯"变成了"攻击面瞬间暴露"——生态系统的修复能力正在被超载。
- 关键事实:30 天 10,000+ 高危漏洞,150 万美元电诈被拦截;27 年老 Bug 被发现
- 为什么值得深读:安全问题过去的瓶颈在"发现困难",现在转移到"消化速度"——组织是否能在漏洞被恶意利用前完成修复?修复速度跟不上发现速度的安全模式不可持续
- 后续看点:Anthropic 何时发布 Mythos 的正式版本及可访问策略;漏洞激增是否催生 AI 自动修复工具的需求爆发
来源:Anthropic 新闻
Google Gemini 进军科学界:一日双登 Nature,AI 加速科研范式迁移
Google 发布"Gemini for Science"工具集,并在同日发表两篇 Nature 论文。其中,ERA 系统能自动生成专家级科学软件,已发现 40 种新的单细胞数据分析方法;Co-Scientist 多智能体系统通过"点子锦标赛"机制持续提升科研假设质量。Google 还同步推出三个 Labs 原型和 Science Skills,覆盖科学方法的三个核心环节:假设生成、实验设计和结果分析。
但值得注意的是,获得诺贝尔奖的 AlphaFold 核心科学家 John Jumper 已被调至 AI 编码组。这一人事变动暗示了一个更深的信号:当通用 AI 系统开始能"自己做科研",为每个特定科学问题开发专用工具的经济逻辑正在被动摇。
- 关键事实:Nature 双篇论文;ERA 发现 40 种新方法;Co-Scientist 采用多智能体竞赛生成科研假设
- 为什么值得深读:AI 科学从"人类指挥、AI 执行"正在向"AI 主导流程"过渡。科研资源分配的逻辑需要重新审视:是投向专用 AI 工具,还是投向通用科研智能体?
- 后续看点:Co-Scientist 在更广泛的科学领域能否复现突破;John Jumper 的编码团队将产出什么
来源:新智元
🔥 今日聚合动态
OpenAI Codex 从编程工具到全能工作系统:Jason Liu 公开高级玩法
OpenAI 工程师 Jason Liu 首次公开分享 Codex 的高级使用指南,将 Codex 从"代码助手"重新定义为"持续运行的 AI 工作系统"。多篇来源从不同角度记录了这次分享。
| 视角 | 来源 | 核心信息 |
|---|---|---|
| 长期线程 | Datawhale | 建立跨月巨型线程,使 Agent 具备连续性决策能力 |
| Heartbeats 定时任务 | 量子位 | Heartbeats + @computer 组合实现定时任务调度和文件上传 |
| Goal 模式 | 大模型智能 | Goal 模式已转正,支持设定目标和验收标准让 Codex 自主推进 |
- 关键事实:Jason Liu 公开 Codex 高级工作流三件套:长期线程、Heartbeats、Goal 模式
- 互补信息:不同来源分别侧重线程持久性(Datawhale)、自动化调度(量子位)和目标驱动架构(大模型智能),三类能力组合成完整的工作系统
- 后续看点:Jason Liu 是否公开更多 Codex 内部架构细节;Goal 模式的企业采纳情况
DeepSeek 资本+技术双线出击:宁德时代 105 亿入场,京东网易竞相投资
DeepSeek 持续成为资本与技术两条线上的焦点。不同来源提供了互补视角。
| 视角 | 来源 | 核心信息 |
|---|---|---|
| 曾毓群 105 亿 | 智东西 | 宁德时代创始人曾毓群豪掷 105 亿元投向 AI 算力龙头,并与 DeepSeek 建立投资关联 |
| 京东网易参投 | Z Finance | 外媒报道京东、网易考虑参投 DeepSeek,梁文锋称目标是 AGI |
- 关键事实:宁德时代 105 亿投向 AI 算力;京东网易参投 DeepSeek
- 互补信息:产业资本(宁德)、互联网巨头(京东网易)共同指向 DeepSeek 的大规模资金部署
- 后续看点:DeepSeek 实际融资规模及主要投资方名单公布时间
谷歌 AI 困境:搜索翻车 + CEO 承认编程落后,双重压力
多条信源共同揭示 Google 在 AI 产品化和技术竞争上面临的双重压力。
| 视角 | 来源 | 核心信息 |
|---|---|---|
| AI 搜索"罢工" | 机器之心 | Google AI Overviews 出现"提示注入"问题,将常用词误判为指令导致搜索结果异常 |
| CEO 承认编程落后 | 多来源综合 | Google CEO Pichai 承认 Gemini 在编程能力上落后于竞争对手 |
| AI"吞金"困局 | 多来源综合 | AI 基础设施投入持续高企,科技巨头也面临成本压力 |
- 关键事实:AI Overviews 提示注入漏洞已修复;CEO 公开承认编程落后;AI 基础设施成本持续攀升
- 互补信息:产品可靠性问题(搜索翻车)与技术竞争力问题(编程落后)同时爆发,Google 需要在两个维度同时回应
- 后续看点:Gemini 编程能力是否有明确追赶路线图;AI Overviews 是否会调整默认启用策略
AI 吞噬垂类企业 + 开源社区危机:生态的两面挤压
多篇报道从不同侧面揭示了 AI 生态正在发生的结构性挤压。
| 视角 | 来源 | 核心信息 |
|---|---|---|
| 通用模型吞噬 | 极客公园 | Yupp、NeuroPixel 等 AI 初创相继关停,FlashLabs 改名转向 AI 原生、放弃多 Agent 协作 |
| AI 当老板试验 | 多来源综合 | 活宝团队试验让 AI 自主决策商业项目,结果"做什么赔什么" |
| AI"刷"PR | 多来源综合 | AI 批量生成低质量 PR 涌入开源社区,维护者不堪重负 |
- 关键事实:多家垂类 AI 公司关停;AI 自主商业决策试验失败;AI 生成的低质量 PR 泛滥开源社区
- 互补信息:三个问题指向同一核心矛盾——当 AI 的"量"超过生态的"消化能力"(垂类公司被替代、AI 决策质量不足以替代人、AI 代码贡献量超人工审查能力)
- 后续看点:开源社区是否出台 AI 生成 PR 的准入规则;垂类 AI 企业转型方向是否收敛
📰 独立报道
🤖 AGI 前沿
星动纪元登顶 RoboChallenge 全球挑战赛
具身智能公司星动纪元(Star Era)在 RoboChallenge 全球挑战赛中获得第一名。该赛事是具身智能领域的权威评测,星动纪元凭借自研基础模型在多任务操作和复杂环境适应能力上取得突破,进一步验证了具身智能从实验室走向真实场景的技术可行性。
- 关键事实:星动纪元获 RoboChallenge 全球第一
- 后续看点:星动纪元的百台家庭机器人部署计划进展
来源:多来源综合
Bengio 团队 GRAM:10M 参数小模型在数独和 ARC-AGI 上超越大模型
Yoshua Bengio 团队提出 GRAM 模型,仅用 10M 参数在数独极端难度达到 97.0% 准确率,并在 ARC-AGI 基准上超越参数量更大的模型。核心创新在于将确定性递归推理转变为概率多轨迹计算——模型并行采样多条隐空间推理轨迹,通过概率选优得到最终答案。
- 关键事实:10M 参数达数独 97.0% 准确率;ARC-AGI 超越大模型
- 后续看点:GRAM 方法能否迁移至数学、编程等更复杂的推理任务
来源:多来源综合
视觉语言模型"并行思考":新架构打破串行推理瓶颈
新的视觉语言模型架构实现了并行多路径推理,打破了传统 VLM 串行思考的效率瓶颈。该技术让模型在处理视觉问题时可以同时探索多条推理路径,相比串行方法显著提升了推理速度和准确率。
- 关键事实:并行多路径推理打破视觉语言模型效率瓶颈
- 后续看点:该架构在实际产品(如图像问答、自动驾驶)中的性能增益
来源:多来源综合
极佳视界发布物理 AGI"双金字塔"体系,计划 12 个月内推三代基础模型
极佳视界发布物理 AGI"双金字塔"体系,通过五层数据金字塔和三层算法金字塔的耦合,解决具身智能 Scaling 瓶颈。该公司在多项权威评测中均获全球第一,并宣布家庭机器人百台部署计划,目标是在未来 12 个月发布三代基础模型,冲击物理 AGI 的"GPT-3 时刻"。
- 关键事实:五层数据 + 三层算法金字塔;多项全球评测第一;百台家庭部署计划
- 后续看点:三代基础模型的发布时间点和性能里程碑
来源:多来源综合
🏢 AI 战略与组织变革
腾讯 AI 管家"马维斯"亮相:让电脑自己干活
腾讯推出 AI 个人助理"马维斯",能像真人一样理解指令、拆解任务,调动多个 AI Agent 在电脑上自动执行操作。产品支持 Windows、MacOS 和 Android 平台,提供效率和隐私两种模式,由应用宝团队开发。马维斯能深入系统排查电脑问题,还可实现电脑与云手机协同操作。
- 关键事实:腾讯发布电脑端 AI Agent 产品,应用宝团队开发
- 后续看点:产品正式上线时间和用户规模
来源:多来源综合
Meta 刚赚了创纪录的钱,转头就裁 8000 人:小扎要用 AI 重写 Meta
Meta 在刚交出创纪录财报后,直接宣布裁员 8,000 人(约 10% 员工),全面转向 AI 架构。扎克伯格的逻辑是:既然 AI 系统越来越能完成传统由人完成的工作,企业就不需要维持现有的员工规模。Meta 同时在大规模投资自研 AI 芯片和基础设施。
- 关键事实:Meta 创纪录财报后裁员 8,000 人;全面转向 AI 架构
- 后续看点:Meta 自研芯片在内部工作负载中的实际占比提升速度
来源:新智元
AI 产品经理岗位暴增 12 倍,但优质供给极度稀缺
新发 AI 岗位占到全部技术岗位的 26.23%,比上一年增长 12 倍。但人才供需比仅 0.97:虽然总量看似平衡,80% 的简历来自转行不到半年的人。企业真正需要的是"能跟算法聊 MoE 怎么选,回头在业务会上把单次调用成本压到一毛钱以内"的人。
- 关键事实:AI 产品经理岗位 12 倍增长,有效供给极度稀缺
- 后续看点:市场何时出现 AI 产品经理的系统化培训体系
来源:人人都是产品经理
🚀 航天与硬件
马斯克星舰 V3 首飞成功:SpaceX 万亿 IPO 前关键一役
SpaceX 星舰 V3 完成首飞。Ars Technica 评价为"基本成功"——火箭完成了大部分飞行目标,但仍有部分技术指标未完全达标。此次飞行被视为 SpaceX 在万亿估值 IPO 前的"终极路演"。与此同时,美国银行分析师认为 SpaceX、OpenAI、Anthropic 的超级 IPO 扎堆可能重演泡沫。
- 关键事实:星舰 V3 首飞基本成功;美国银行预警超级 IPO 泡沫风险
- 后续看点:SpaceX 正式 IPO 时间和估值
北京理工大学:算力需求暴增,AI 大模型的电从哪来?
北京理工大学发布研究分析 AI 大模型带来的电力需求挑战。随着算力需求爆发式增长,数据中心的电力供应正成为 AI 产业发展的硬约束,需要对供电架构、能源结构和区域布局进行系统性重新规划。
- 关键事实:AI 算力电力需求暴增,传统供电架构面临瓶颈
- 后续看点:AI 数据中心是否会大规模转向核能和分布式能源
来源:IT有个圈儿
太空发电太贵了,中国送了一片光伏板上去试试
虎嗅报道了中国在太空太阳能发电领域的最新探索:通过在轨部署光伏板测试太空发电的可行性。文章指出,虽然太空发电的理论效率远超地面,但发射成本和维护难度仍是其商业化的主要障碍。
- 关键事实:中国在轨测试太空光伏发电
- 后续看点:太空发电的成本何时降至地面发电的 3 倍以内
来源:虎嗅
💰 金融科技前沿
跨境券商大洗牌:富途拟被罚 18.5 亿,老虎被罚约 4.1 亿
中国证监会对富途开出约 18.5 亿元的拟罚没金额,老虎证券合计被罚没约 4.1 亿元,两家合计超过 22 亿元。钛媒体指出,在罚单落地前,富途控股已被"精准"做空。这轮监管整治标志着跨境互联网券商野蛮生长时代的正式终结。
- 关键事实:富途拟被罚没约 18.5 亿,老虎约 4.1 亿,合计超 22 亿
- 后续看点:最终处罚金额与整改方案;其他跨境券商是否会受到波及
AI 融资潮中的三种故事
钛媒体将当前 AI 融资潮归纳为三种叙事:①技术信仰型——赌 AGI 终局,接受长期亏损;②场景务实型——在垂直行业找 AI 能立刻赚钱的角落;③资本套利型——利用 AI 标签获取估值溢价再退出。三种故事在资本市场上并存,但投资逻辑和风险承担完全不同。
- 关键事实:AI 融资分化为三种叙事:技术信仰、场景务实、资本套利
- 后续看点:哪种叙事在下一轮市场调整中能够存活
来源:钛媒体
⛓️ 区块链与数字资产
SEC 叫停美股上链:太大了,先停一下
美国证券交易委员会(SEC)对将美股交易记录上链的计划提出暂停要求。SEC 认为区块链技术在证券结算领域的应用范围扩大速度过快,需要先建立完善的治理框架和风控机制,防止系统性风险。
- 关键事实:SEC 暂停美股上链计划,要求先建治理框架
- 后续看点:SEC 将在多长时间内出台链上证券监管指南
来源:C Labs 加密观察
🎓 学术前沿
首份音视频智能(AVI)综述发布:"听-看-说-动"一体化与新评测体系
新加坡国立大学联合牛津大学、微软等 9 机构发布首份音视频智能(AVI)综述,系统梳理从单模态到跨模态的演进路径,提出"听-看-说-动"一体化框架。综述将 AVI 发展分为四个时代,并提出六大未来研究主轴:因果事件 grounding、AV 世界模型、长程上下文记忆等。
- 关键事实:首份 AVI 综述发布,覆盖十年研究全景;提出六大未来研究主轴
- 后续看点:AVI 框架能否成为多模态智能的标准化评测体系
来源:学术头条