前沿科技日报 · 2026-10-05
谷歌对 Gemini 免费/订阅权限大幅收紧,为 Gemini 4 Argon 腾算力,同时 Agent 工具链(DeepSeek Harness 兼容 Claude Mods、南洋理工 Harness 选型研究)持续暴露"模型-工具链"组合的可迁移性问题
2026-10-05 前沿科技洞见 · 日报
📊 今日关键数据
- 29.4 万字符:GPT-6 Sol Codex 完整系统提示词及工具定义遭外泄,长达 1902 行指令模板(来源:新智元)
- 740 亿美元:美国五角大楼提议为无人机及反无人机技术投入的预算规模(来源:huxiu.com)
- 66 项:南洋理工安波团队 Harness 选型研究中 4 套可配置 Harness×5 个模型×3 个任务集交叉实验形成的有效对比记录数(来源:机器之心)
- 40 分钟:GPT-6 Astra 在不接收游戏画面、仅靠网络数据包推理的条件下完成《魔兽世界》新手村全部任务的耗时,零死亡(来源:量子位)
- 不到 24 小时:DeepSeek Harness 从 Claude Code Mods 发布到上线对应兼容层的响应时间(来源:机器之心)
🔍 今日值得深读
谷歌 10 月 9 日起全面收紧 Gemini 访问权限,免费用户仅剩 Flash-Lite
谷歌在官方支持页面宣布,自 10 月 9 日起调整 Gemini 应用的个人账号模型访问权限:无订阅的免费用户只能使用最基础的 Flash-Lite 模型,原本可偶尔使用的 Flash、Pro 全部收回;AI Plus 订阅用户(月费约 5 美元)失去 Pro 模型使用权,仅保留 Flash-Lite 和 Flash;只有 AI Pro、AI Ultra 高阶订阅者才能继续使用 Pro 模型及"Deep Think"最大并行推理能力。同时上线基于算力消耗而非调用次数的动态限额系统,5 小时刷新一次并叠加每周硬性上限,还新增"Effort"低/中/高三级推理力度滑块。此次调整仅限 Gemini App/Web 个人账号,暂不影响 API、AI Studio、Workspace。谷歌同期还更新了 Antigravity 平台,对所有付费用户开放 Claude Opus 5.5 与 Sonnet 5.5,旧版 Opus/Sonnet 4.6 将于 11 月 2 日下架。
- 发生了什么:谷歌把 Gemini 个人账号的模型访问权限按订阅档位重新分层,免费和 Plus 档位被大幅降级,同时上线按算力计费的动态限额。
- 为什么值得深读:这是继 5 月限流后谷歌第二次收紧免费/低价套餐,时间点与业内猜测的 Gemini 4 Argon 发布前夜重合——用收紧旧模型配额为新模型腾算力,是大厂在算力紧张周期下的典型信号,直接影响依赖谷歌低价套餐搭建工作流的企业成本结构。
- 后续看点:Gemini 4 Argon 是否如期发布、API/Workspace 是否跟进调价、企业客户是否转向 Claude/GPT 等替代模型。
来源:新智元
Google Research 负责人 Yossi Matias:暴力堆卡已到尽头,投机解码等算法仍有数倍效率空间
Google Research 负责人、哥德尔奖得主 Yossi Matias 在 The Google Research Podcast 中判断,Scaling law 描述的是沿既有路线堆算力和数据的收益,但这条路线本身存在收益边界,下一轮更大幅度的效率提升要靠投机解码等算法和新架构,而非单纯预训练阶段的堆卡。他同时提到 AI Co-Scientist 三天产出的科研假设速度快于人工数年、开源医疗模型 MedGemma 下载量已超过 500 万次,并提出"环境智能"(ambient intelligence)概念:AI 最终会像电力一样被使用者视为理所当然。
- 发生了什么:Google Research 一把手公开表态,预训练期堆卡的边际收益在下降,推理效率算法(投机解码等)和新架构是下一阶段的关键变量。
- 为什么值得深读:这与红杉美国"认知革命"、Databricks CEO"真正的 RSI 没有发生"等近期判断形成呼应,指向业界对"单纯加算力"路线的集体降温——对正在评估 AI 基础设施投入节奏的机构是重要的路线信号。
- 后续看点:谷歌下一代架构细节是否随 Gemini 4 Argon 披露、MedGemma 等开源医疗模型的商业化路径。
来源:Z Finance
南洋理工大学安波团队:Agent Harness 没有通用最优解,效果取决于模型-任务-Harness 三者组合
新加坡南洋理工大学安波教授团队发布报告《Finding the Right Fit: Model–Harness Interactions across Agent Tasks》,在 OpenHands、DeepSeek Harness(DSH)、PI、openJiuwen 四套可配置 Harness 上分别接入 Claude Opus 5、GPT-6 Astra、GLM-5.3、Kimi K3、DeepSeek V4 Pro 五个模型,并以 Claude Code–Claude、Codex–GPT 两组原生搭配作为参照,在 TUA-Bench(通用终端操作)、ALE-CLI(专业工作流)、Terminal-Bench 4(高难度命令行)三个任务集上做 4×5×3 交叉测试,共形成 66 项有效记录。核心结论:Harness 的好坏不是固定属性,同一模型换 Harness 后表现可能大幅波动,模型厂商的原生 Harness 也不总是最优选择;Kimi K3 与 openJiuwen 组合在三类任务上表现相对稳定。
- 发生了什么:一项系统的模型×Harness×任务交叉实验证明,Agent 工具链选型不存在"放之四海而皆准"的方案。
- 为什么值得深读:对正在搭建或采购企业级 Agent 系统的机构,这意味着选型评估必须针对具体任务做联合测试,而不能只看模型榜单或厂商自带工具链的宣传分数。
- 后续看点:报告代码与数据集已开源(GitHub: liyix/finding-the-right-fit),是否会被纳入企业 Agent 采购的标准评测流程。
来源:机器之心
DeepSeek Harness 48 小时内上线 Claude Code Mods 兼容层,双方插件架构理念交锋
Anthropic 10 月 1 日为 Claude Code 推出 Mods 扩展机制——开发者可用 TypeScript/JavaScript 事件处理函数挂在工具调用、提示词提交、界面绘制等环节上进行观察、改写或接管。DeepSeek Harness 团队负责人崔添翼随即转发评论,称 Mods 本质是"在既定软件上开洞的局部插件",而 DSH 从立项起就是"一切皆插件"的微内核架构(基于开源框架 Cordis)。不到 24 小时后,DSH v0.2.1-alpha.1 上线,新增崔添翼本人署名的"实验性 Claude Code Mods 兼容层",更新日志明确写道该功能目的是验证 Claude Code Mods API 大致是 DSH 插件能力的一个子集,而非提供完整实用兼容。该事件在知乎引发"抄作业"争议,崔添翼随后发长文否认是被迫或模仿,强调开源与"一切皆插件"是立项初心,并提出未来要让插件承载"Agent 自进化"——Agent 运行中通过插件改变自身工作方式。
- 发生了什么:Claude Code Mods 发布后不到一天,DeepSeek Harness 就上线了技术上的兼容/对标实现,并公开阐述架构竞争逻辑。
- 为什么值得深读:这是中美 Agent 工具链(Harness)生态竞争首次在 48 小时内正面交火,反映 Agent 底层可扩展架构正在成为与模型能力并列的竞争维度;配合当日南洋理工的 Harness 选型研究,说明 Harness 层的差异化已是可衡量、可复现的工程问题,而非纯营销话术。
- 后续看点:DSH 兼容层能否实现完整 Mods 兼容、"Agent 自进化"插件修改权限的分配方案。
来源:机器之心
Google 暂停开源漏洞赏金计划,称 AI 生成的无效提交已不堪重负
2026-10-04(北京时间 2026-10-05 发布)
谷歌于 10 月 1 日暂停其开源软件漏洞赏金计划(Open Source Software Vulnerability Rewards Program),并在 X 和项目官网发布声明,承诺 2027 年第一季度再提供更新。谷歌表示"这一暂停是因为自动化提交显著增多,其中绝大多数并不有效",据 Tom's Hardware 报道,谷歌工程师和开源维护者已被大量无效或包含幻觉内容的报告淹没。该计划暂停期间,参与者可转向谷歌其他漏洞赏金项目。
- 发生了什么:谷歌因 AI 生成的大量无效漏洞报告冲垮审核能力,直接冻结一个运行多年的开源安全激励项目。
- 为什么值得深读:这是"AI slop 冲垮人工审核流程"从业内警示变成头部公司实际停摆案例的首个明确样本,对金融机构评估 AI 辅助安全测试、众测/众包审核类业务的可靠性是直接的风险信号。
- 后续看点:谷歌 2027 年一季度公布的"更新"是否包含 AI 提交的身份识别或质量门槛机制,其他厂商的漏洞赏金计划是否跟进调整规则。
📰 独立报道
AGI 前沿
GPT-6 Sol Codex 系统提示词遭完整泄露,长达 29.4 万字符
爆料者 @elder_plinius 在继此前 Opus 5.5 190 万字提示词泄露后,又提取出 OpenAI 代码模型 GPT-6 Sol Codex 共 29.4 万字符、1902 行的完整系统提示词及工具定义,涵盖指令模板、临时指令文件和内部协作逻辑,已公开在 GitHub 的 CL4R1T4S 仓库。这是前沿代码模型系统提示词连续第二次大规模外泄,反映当前主流模型厂商对系统提示词的保护机制仍存在被规避的空间。
来源:新智元
诺奖得主 Eric Betzig:用 AlphaFold 开发新药必然失败,生物学教科书是"幻觉"
2014 年诺贝尔化学奖得主、加州大学伯克利分校教授 Eric Betzig 在播客访谈中表示,生物学教科书中几乎所有内容都是"幻觉",用 AlphaFold 开发新药一定会失败,相关药企是在"无谓烧钱";他还称若明天砍掉学术界 95%,世界也不会有任何感觉。这一表态直接针对当前资本市场对 AI+药物设计叙事的乐观预期提出反面证据。
来源:DeepTech深科技
GPT-6 Astra 不看画面、靠读取网络数据包完整打通《魔兽世界》新手村
开源项目 agent-wow 把 GPT-6 Astra 接入魔兽私服,模型完全不接收游戏画面,直接解析底层网络数据包还原世界状态,自行造工具、查攻略、规划路线,40 分钟零死亡完成兽人新手村"试炼谷"全部任务并抵达森金村。这类不依赖视觉输入、纯靠结构化状态推理完成长链条任务的案例,为评估 Agent 在缺乏感知接口场景下的规划能力提供了一手测试样本。
来源:量子位
AI 战略与资本事件
民众抵制数据中心建设,AWS 宣布停止与政府机构签署保密协议
AWS CEO Matt Garman 在官方博客中表示,为争取新建数据中心项目审批,公司已停止与政府机构就数据中心能耗签署保密协议(NDA)。保密协议是民众抵制数据中心浪潮中的核心争议点之一,环保活动人士此前指出,这类项目往往先拿到许可再公开、开发方拒不回应居民问询。此举反映数据中心选址阻力正在从地方维权升级为倒逼大厂调整信息披露惯例的实际压力。
来源:ithome.com
孙正义罕见警示:超级智能一旦落入错误之手,可能"极其危险"
长期坚定支持 AI 的软银创始人孙正义,在京都"社会中的科学与技术"论坛边会上表示,AI 能力的指数级跃升使各国建立互信、协同治理变得刻不容缓,人类已"没有任何余地"再让国与国相互对抗,因为强大 AI 模型构成的威胁远超人类内部冲突。这一表态与孙正义一贯的乐观基调明显反差,是 AI 安全议题从边缘讨论走向头部投资人核心关切的又一信号。
来源:华尔街见闻全球
美国成立"自主作战司令部",AI 从辅助工具升级为作战单元
美国国防部长赫格塞思在匡蒂科海军陆战队基地宣布组建新的四星级联合作战司令部,管辖无人机、AI 与指挥控制系统,预计 2027 年 10 月前投入运作,并称这是"现代军事史上承平时期最快的转型"。五角大楼拟将自主作战领域支出增加两倍,提议为无人机及反无人机技术投入 740 亿美元;同日宣布由马斯克、安杜里尔创始人帕尔默·勒基与前众议院议长金里奇共同领导的"子午线计划",用 120 天研究未来战争形态。这是军用 AI 预算与组织架构层面的实质性扩张,而非概念表态。
来源:huxiu.com