6 个主题、18 条标准版内容;事实主体聚焦 8 月 3–4 日,另含一条 8 月 4 日团队访谈后续和三个未来 7–30 天官方节点。
关键数据:22 份协议、910 个子任务、962 次动作调用;下一步应看跨实验室器具迁移、失败恢复以及与电子实验记录系统的闭环审计。
关键判断:科研软件的价值不只在新增算法,而在把领域特征接入成熟工程生态;后续应关注论文版接口能否稳定演化,并用公开基准说明速度、内存与预测质量的权衡。
关键数据:1.3 mm 直线误差、10.4 mm 复杂路径误差;真正的门槛是把低成本通用硬件变成可验证、可消毒、可追责的医疗系统。
关键数据:1.2B 参数、RMBench 62.8%、LIBERO 98.8%;后续应看层次化推理是否在更长任务和开放环境中持续降低误差累积。
关键信号:900 条示范、7 项任务、最高 +23.8 个百分点;评价重点应从“是否抓到”转向接触稳定性、材料泛化与长期磨损后的可靠性。
关键数据:AUROC 0.872、约 200 μs/步、成功率 52%→73%;后续应检验跨模型、跨工具链以及真实企业任务上的校准稳定性。
关键判断:数据中心 Agent 的可用路线是“意图生成—形式约束—仿真验证—受控执行”,而不是端到端自治;后续看真实负载上的节能收益与违规率。
关键信号:120+ 组织、成立一周即开放 RFC;下一步不是成员名单继续变长,而是是否出现可验证的跨厂商事件通报与修复闭环。
关键数据:约 100 亿美元、六年、133MW;后续关注正式公告、首批 Vera Rubin 交付、挪威电力与并网约束,以及算力是否按期转化为可用模型容量。
关键数据:474GW 接入队列、约 90% 数据中心;审计能否剔除纸面项目并建立可复用的大负荷接入规则,将影响全美算力选址。
关键判断:公开材料把争议从单方指控推进到可核对证据,但最终事实仍由司法程序确认;产业更应关注跨公司招聘的合规流程,而非围观口水战。
关键数据:790 万美元种子轮、530 万用户、约 6,000 万美元 ARR;下一步看收入留存、客户集中度和评测方法的独立审计。
关键数据:能力差约 2–4 个月、CyberGym 36.6%→76.2%;核心不是“开源是否危险”,而是同等级能力是否配套可审计的风险管理。
关键判断:训练数据治理正从“企业自我声明”走向第三方可重复探测;决定其产业影响的变量,是跨模型、蒸馏链和语料变换后的证据强度与误报控制。
关键数据:26 名学生、206 份报告、23.1% 失效、多轮风险约 2.5×;后续应看不同学校与语言环境能否复现。
关键节点:8 月 13–14 日;重点跟踪 Anthropic、Naver Cloud 与 Google 的生产案例是否给出吞吐、token 成本、故障与权限边界的可量化数据。
关键节点:8 月 25–28 日;后续重点是详细议程与论文材料是否给出结构化抽取、可追溯引用和隐私部署的可比较基准。
关键节点:8 月 9–14 日;重点跟踪 Agent 工作流、遥感基础模型与物理模型耦合是否报告跨区域泛化和可校准不确定性。