6 个主题、12 条经验证条目;按主题组织,不按“学术/产业”割裂。
关键数据: 该案例在 286,422 名 个体数据上复现已知高血压位点,并在肝损伤预测演示中报告 0.842 AUC;真正要看的是不同医院的外部复现。
关键数据: 基准包含 527 个真实数据实例与 6,000 个合成实例;它的价值在于测出何时该把 Agent 的结论交回给领域专家。
关键数据: 论文报告生成 24K+ 可验证任务、训练速度提升 2.83 倍,并在 OSWorld 达到 68.7%;应继续观察跨应用与高权限环境的稳健性。
关键信号: 物理 AI 的开源竞争正在从单个模型权重延伸到硬件文档、仿真环境和可冻结发布包,复现实验会比单一 Demo 更有价值。
关键数据: 报道称该芯片使用 14nm 工艺、BF16 520 TFLOPS 与 6.4TB/s 访存带宽;后续最需第三方验证实际工作负载效率。
关键判断: 编码 Agent 的竞争已经进入软件供应链控制层;能否把执行环境和责任主体标明,决定其是否能从个人试用走向组织部署。
关键节点: 规则自 7 月 15 日 起施行;注册用户 100 万以上或月活 10 万以上等情形将触发安全评估,产品团队须尽快核对服务边界。
关键数据: 韩国政府将全年增长预期调至 3.0%、五年高位;这把 AI 芯片从单一公司业绩推到了宏观政策与供应链风险的观察窗口。
关键数据: 在 OSWorld-Verified 上,论文将 Qwen3.5-27B 从 31.6% 提升到 62.2%;其更重要的贡献是让进度可审计、失败可定位。
关键信号: AI 治理正在从规则文本走向国家级执行机构和测试环境;合规能力将成为欧洲市场进入与持续运营的基础设施。
关键趋势: 智能体正在从 App 内功能走向设备级控制层;下一阶段应看公开 API、权限提示、第三方应用协同与可验证用户收益。
关键节点: 7 月 14 日 的听证将检验美国政策讨论是否从“领先地位”转向中小企业可获得性、责任与实际生产率。
本期为精编版:在严格时效、深链实抓和近 7 天精确事件去重后保留 12 条。科研 Agent 开始把证据、权限与复核写入系统;Computer Use、开源机器人与编码 Agent 则把可验证执行、安全沙箱和恢复能力推到部署前台。与此同时,芯片供给、终端入口与中欧监管执行把模型竞争延展到成本、权限与责任边界。