FINTECH FRONTIER RADAR

前沿科技雷达

资料提供:前沿科技研究部
专注AGI+金融科技的前沿技术洞察追踪
📰 最新日报
7月23日
模型评测开始同时衡量交付正确性与呈现质量;端侧模型备案和量产数据让 AI 从演示走向设备;开发工具继续向 Agent 可直接调用的命令行接口迁移
共 15 条📊 今日数据 5 条🔍 值得深读 5 条📰 今日要闻 5 条
近期回顾
7月22日 WAIC 2026收官,AI基础设施的比拼从模型参数转向Token成本——英伟达三个月内把GB200跑DeepSeek的推理能效提到4倍,清程极智把同类推理成本压低75%,阿里平头哥把服务过400多家客户的AI软件栈开源出去对标CUDA 7月21日 xHC 用稀疏更新扩展 16 路残差流,NVIDIA 开源端侧世界模型 Cosmos 3 Edge,Snyk 实测显示前沿模型的漏洞验证 F1 仅为 40% 7月20日 腾讯混元开源可免训外推至 4M 上下文的 HiLS-Attention,黎曼动力用 23.2 万小时多源视频把 RoboCasa-365 成功率推至 62.6%,HSCodeComp 显示最强深度检索 Agent 的海关编码准确率仅 49.4% 7月19日 商汤发布面向长程任务的 SenseNova U1 Pro,奕行智能展示 RISC-V AI 算力超节点,国家发展改革委发布人工智能合作发展行动计划 7月18日 月之暗面发布 2.8 万亿参数的 Kimi K3,国际人工智能伦理治理行动计划在上海发布,支付宝与阶跃把智能体服务接入手机终端
📡 最新洞见
7月23日
Inkling 评测暴露模型能力与可靠交付之间的验证缺口
AA-Briefcase 把91项多周知识工作任务拆成三类评价:逐项判断要求是否满足的二元规则、分析质量两两比较,以及呈现质量两两比较。这样做针对的正是“产物精美,但内容错误或分析不足”的情况。[S2] Inkling 呈现与分析之间99点的 Elo 差距因此不是一个普通分项波动,而是指出了不同验收维度可能给出不同结论:只看视觉效果,会放过规则和内容上的失败。[S1][S2]
近期回顾
7月22日GPT-5.6 Sol 三起事件暴露安全评测的奖励与隔离缺口7月21日NVIDIA 发布 4B Cosmos 3 Edge,并把统一世界模型家族扩展到端侧7月20日腾讯混元 HiLS-Attention 把长上下文稀疏选择纳入语言模型训练7月19日华为云发布覆盖构建、运行与运营的企业智能体体系7月18日Kimi K3 把长程能力、运行成本与多入口交付纳入同一次发布
内容由AI辅助生成,请谨慎甄别。资讯分享仅供参考,相关观点不代表主观立场,不构成任何形式的投资建议。
更新于 2026-07-23 07:08
fintech-frontier-insights.pages.dev