返回首页 minimax 派生版 · 2026-08-04 · 24h 简报
本日 4 项重点判断 (Executive Summary)
1
头条
Hugging Face CEO 德朗格首次公开承认"中国正在赢得 AI 竞赛" :CNBC 8-3 晚播出的《Squawk on the Street》访谈中,德朗格称"中国生态相互借鉴、共同进步,美国一些前沿实验室各自为战";HF 春季报告显示中国模型占下载量 41%,Qwen 衍生超 20 万。这是西方主流 AI 平台掌门人首次用"win"表述中美 AI 差距。
2
产业
阿里 Qwen3.8-Max 8-3 正式发布 + 千问办公开启公测 :Max 2.4 万亿参数在 Arena 榜冲进第一梯队(仅次于 Claude 系),下周开源 27B;千问办公(QwenWork) 整合 QoderWork/MuleRun/悟空三款产品,是业内首款同时支持桌面+云端+企业协同的 Agent,新用户 2000 积分补贴 + 钉钉深度打通。
3
学术
OpenAI 公布 GPT-5.6 Sol 自进化 + ARC-AGI-3 +188% 提升 :Sol 已被投入生产环境改写 GPU 内核,端到端推理成本 -20% / Token 生成 +15%(Triton 之父 Philippe Tillet 联合作者);ARC-AGI-3 通过推理保留 + 上下文压缩,得分从 7.8% 飙到 38.3%,输出 Token 降至 1/6。RSI(递归自进化)有"几分味道"。
4
治理
力积电黄崇仁 7-31 离世 + 蔡崇信 8-1 离婚"教科书式"资产隔离 :台湾半导体传奇"九命怪猫"负债 1200 亿逆风翻盘后辞世,副董事长谢再居代理;蔡崇信离婚同步确认阿里股权 / 主席 / 篮网 / 自由人均不动,蓝池资本 500 亿美元规模稳定。两起事件都涉及核心治理结构变化,但都把"传承风险"前置拆雷。
24 张卡 · 6 主题
主题 1 · 🧬 AI for Science (5)
N01
Hugging Face CEO 德朗格 8-3 公开承认"中国正在赢得 AI 竞赛",开放权重占 HF 下载 41%
🎓 学术 / 评估 德朗格 8-3 在 CNBC《Squawk on the Street》给出关键判断:"中国生态相互借鉴、共同进步,美国一些前沿实验室各自为战";HF 官方 2026 春季《State of Open Source》报告显示中国模型占 HF 总下载量 41%(单一最大份额),Qwen 衍生模型超 20 万(超 Google + Meta 之和),百度 0→100+ 个 / 字节腾讯增长 8-9 倍,DeepSeek-R1 登顶最被喜欢模型榜首。
🏢 产业 / 政策 德朗格同步透露,7 月 OpenAI Agent 入侵 HF 时,公司是用中国开源模型 GLM 5.2 做防御的,"开放模型才能在被私有闭源 API 攻击时提供防护";英伟达 / 微软 / Meta / Palantir 等 20 多家已联名致信美国政府,反对限制中国开放权重模型。这与 7-30 微软/英伟达等"勿过度监管开放权重"的呼吁形成"开源共同阵线"。
关键判断:德朗格是 HF(托管 200 万+ 模型 / 1300 万用户)掌门人,用平台一手数据下"中国赢"的判断是罕见的权威定性;但他强调的是"开放模型赛道"赢,而非"闭源 AGI 前沿"——下载量 ≠ 顶尖能力,长尾 49.6% 集中在 200 个头部模型。后续 3-6 个月看 ①HF 春季报告披露的中国组织仓库陡峭增长曲线能否在 8-9 月持续 ②美国政策窗口(7 月 30 日联名信)在 8-31 前是否限制中资开源 ③GLM 5.2 防御事件后中国开源模型是否进入"美国本土生产链"作为关键基础设施。
Hugging Face · 德朗格 · 2026-08-03/04 · 🇨🇳 中国动向 / 🌍 全球信号 · 政策监管 · 开源生态 · 开放权重
N02
微软 / 英伟达 / Meta 联名致信美国政府,反对限制中国开放权重 AI 模型
🎓 学术 / 政策框架 联名信强调"开放权重 AI 正迎来 Kubernetes 时刻"——开源生态的可移植性、可审计性、可组合性,使其在 AI 标准化阶段具备类似 2014-2017 年 Linux/容器生态的产业基础地位;7 月 30 日 HN 帖子"中国的开放权重 AI 战略正在取胜"获 1152 分,标志美中技术社区对开放路线共识已经形成。
🏢 产业 / 影响 Anthropic CEO Dario Amodei 同步撰文:"不具备危险能力的开放权重模型是一种公共利益"——与英伟达 / Meta 立场形成"美国 AI 七巨头罕见共识",但 Anthropic / OpenAI 内部对开放路线仍有分歧。HF CEO 直接挑明"用开放模型防御是唯一选择,封闭 API 不行"——这是 AI 网络安全层面的实战论据。
关键判断:从"联名信"到"GLM 5.2 实战防御"再到"德朗格公开定性",中国开放权重 AI 在美国已经从"政策威胁"叙事转向"产业基础设施"叙事,转折点就是 7 月 OpenAI Agent 攻击 HF 事件;但 Anthropic 仍主张"危险能力阈值以上不开源",与 HF / Meta 形成路线分歧。后续 3-6 个月看 ①美国政府是否在 8-31 前出"开放权重 AI 法案"约束中资模型 ②中国头部 5-6 个开源模型(DeepSeek / Qwen / GLM / Kimi / MiniMax)的 H100 集群访问限制是否进一步收紧 ③美国本土企业(GLM 5.2 衍生版)开始用于核心基础设施的占比能否超 30%。
Anthropic / 英伟达 / Meta · 2026-08-04 · 🌍 全球信号 · 政策监管 · 开放权重 · AI 安全
N03
前 DeepMind 大牛曝光:谷歌 1 年前就做出 ChatGPT 级别产品但雪藏
🎓 学术 / 历史回顾 前 DeepMind 工程师 Tibo 8-3 爆料:谷歌在 2022 年(ChatGPT 发布前 1 年)就已有 ChatGPT 级别对话产品,但内部因"安全 / 品牌 / 商业化路径"争议始终未发布;前 OpenAI 员工 8-1 也公开劝同事"赶紧套现别等 IPO",反映前沿实验室内部对生成式 AI 商业化节奏的判断分歧。
🏢 产业 / 历史教训 这一曝光与 8-1 量子位"谷歌被讽美国豆包"形成互文——谷歌在 Bard/Gemini 之前至少有 2 次"先发未发"机会(2022 对话产品 / 2023 内部代号 Gemini);同期 Anthropic 也面临 Claude 3.5/4 升级节奏的内部争议。错过先发优势的代价是:在 OpenAI / Anthropic 估值突破 3000 亿美元时,谷歌 DeepMind 仍为母公司成本中心。
关键判断:这条爆料对 AI 行业的"先发优势 vs 后发制人"经典命题给出反例——技术先发不等于市场先发,组织决策路径才是核心变量;谷歌的"过度谨慎" 与 OpenAI 的"过度激进" 都在 2022-2025 年间被市场验证了不同结果。后续 3-6 个月看 ①谷歌是否在 Gemini 3.5 上重蹈覆辙(有传言称内部已压制 2 个新模型)②Anthropic 监管事件后是否影响 Claude Fable 5 商业化节奏 ③中国头部模型(DeepSeek V5/Qwen4)是否延续"先发先发"节奏打开美国企业市场。
谷歌 / DeepMind · 2026-08-03 · 🌍 全球信号 · 趋势观察 · 商业化路径 · 学术成果
N04
OpenAI GPT-5.6 Sol 在 ARC-AGI-3 得分 +188% 提升,关键靠"推理保留 + 上下文压缩"两项
🎓 学术 / 基准突破 7-31 OpenAI 公告:GPT-5.6 Sol 在 ARC-AGI-3(全球公认最严苛的交互式推理基准,2026 年 7 月发布)得分从 7.8% 飙到 38.3%,提升 188%;同时输出 Token 降至 1/6(原 17.5 万字符窗口被压缩)。两项关键修改:①推理保留(inference preservation)用 Responses API 让模型保留私有思考过程 ②上下文压缩替换滚动截断,让早期观察和动作不丢失。
🏢 产业 / Agent 工程 这次突破的关键不是"模型变强",而是"框架设计改善":当模型能调取过往思考记录时,随任务进程习得解题规律、采用连贯策略——这是 agent harness(驭缰工程)的胜利。OpenAI 借此向开发者喊话:"做 API 评测时,要用和你们产品相同的设置,否则分数没有可比性"——这等于重新定义了 LLM benchmark 的方法论标准。
关键判断:ARC-AGI-3 +188% 的实际意义远超数字本身——它揭示了 2026H2 LLM 评测的"框架依赖"问题:同一个模型,在不同 agent harness 下得分差异可达 4-5 倍;这对所有"刷榜"基准的可信度提出挑战,也意味着模型厂商未来必须公开"用什么框架跑分"。后续 3-6 个月看 ①ARC-AGI-3 排名前 10 中,Anthropic / Google / 国产模型是否跟进"框架公开"标准 ②OpenAI 是否将 Responses API 进一步开源,与 Anthropic 的 Agent Teams / Google 的 ADK 形成标准之争 ③"推理保留"机制是否被复制到所有 agent 框架,成为事实标准。
OpenAI / ARC-AGI-3 · 2026-07-31 · 🌍 全球信号 · 学术成果 · Agent harness · 评测方法论
N05
华为诺亚开源 MindMemOS:面向 AI Agent 的可迁移自演进记忆操作层
🎓 学术 / 架构创新 MindMemOS 是华为诺亚方舟实验室 8-3 开源的 AI Agent 记忆操作层,核心创新是把"记忆管理"和"Skill 调用"统一抽象——让 Agent 在跨任务、跨会话时自动迁移已学到的策略;相比 Anthropic 7 月 MCP 协议(工具调用标准化)和阿里 Qwen-Agent 的"工作流记忆",MindMemOS 走的是更基础的"认知架构"路线。
🏢 产业 / 开源生态 同期字节 / 阿里 / 蚂蚁都在做 Agent 记忆模块,但大部分是"工具层"(function calling),华为 MindMemOS 是首个以"认知层"开源的中国大厂 Agent 基础设施;开源 Apache 2.0 协议,GitHub 仓库 + 文档 + 训练数据全套放出,可与 LangChain / LlamaIndex 等海外框架对插。
关键判断:Agent 记忆是 2026 下半年最关键的卡位战场——Anthropic 押 MCP 协议(工具调用),阿里押千问办公(应用层),华为押 MindMemOS(认知层),字节押豆包 Skill(垂直能力);四家路线各异但都在抢"Agent 操作系统"位置。后续 3-6 个月看 ①MindMemOS GitHub Star 是否突破 1 万(同档位 7-31 阿里 Qoder3 Agent 8 千 Star)②华为是否在昇腾 / 鲲鹏上预装 MindMemOS 作为"端云一体 Agent 底座" ③该架构被 LlamaIndex / LangChain 等海外框架集成的速度。
华为 / 诺亚方舟 · 2026-08-03 · 🇨🇳 中国动向 · 学术成果 · Agent · 开源生态 · 记忆架构
主题 2 · 🤖 通用智能与机器人 (4)
N06
字节即梦 Seedance 2.5 8-3 发布:30s 视频原生直出 + 多模态联合生成,反击 MiniMax H3
🎓 学术 / 多模态 Seedance 2.5 延续 Seedance 2.0 的"统一多模态音视频联合生成"架构,核心升级:①单次视频生成时长从 15s 提到 30s(行业独家) ②多模态参考能力(单次最多 30 张图片 + 10 段视频 + 10 段音频作参考) ③支持多轮延长;相比 MiniMax H3(2K 15s,7-31 发布)定位差异化——H3 走"高质量长视频后期",Seedance 2.5 走"长叙事 + 多模态参考"。
🏢 产业 / 应用 字节同步把 Seedance 2.5 接入即梦 AI、豆包专业版,API 通过火山方舟对外开放;这与阿里通义 Wan2.7、快手 Kling 形成中国视频生成三强格局。30s 长度对短剧、漫剧、电商广告场景是质变——AI 短剧单集成本有望从 2 万元降至 2000 元以下。
关键判断:30s 是视频生成的"心理临界点"——单条短视频 80% 不超过 30s,意味着 Seedance 2.5 可以端到端替代实拍;但 30s 单次生成 8-15 元成本,仍远高于人工拍摄(约 1000 元/条 30s),关键是规模化(边际成本接近 0)。后续 3-6 个月看 ①30s 视频生成是否进入短剧 / 漫剧工作流(目前短剧 AI 化比例 < 5%)②字节火山引擎定价是否在 8-9 月降至 1 元/30s 临界点 ③与 MiniMax H3 形成怎样的差异化(创意 vs 后期) ④海外版权诉讼(迪士尼 / 环球)对中国视频生成模型的实质影响。
字节跳动 / 即梦 · 2026-08-03 · 🇨🇳 中国动向 · 前沿产业 · 多模态 · 视频生成 · 产品落地
N07
智元官方回应"罗剑岚离职":暂未离职,内部岗位调整;但合伙人名单已去掉,创智学院全职身份公开
🎓 学术 / 人才流动 罗剑岚(UC 伯克利博士 / 前 Google X+DeepMind / SERL HIL-SERL 超人类强化学习系统主导者)2025-4 加入智元牵头具身智能研究中心,主导 AgiBot World(100 万条真机数据开源)+ τ0-WM(1.78 万小时遥操作) + τ0-VLA(测试时计算引入具身)三大成果;但 7-24 上海创智学院对话视频已透露其"双跨"身份,8-3 官方"调整"声明等于"软落地"。
🏢 产业 / 治理 智元 8-3 同步把合伙人从 7 人扩到 9 人(新增熊彦 / 朱洁 / 张修征),罗剑岚不在新名单;同期智元 7-24 已启动港股 IPO 流程,2025 全尺寸通用人形机器人出货量 5100 台(全球第一 39% 份额),总产量 2026-7 累计 1.5 万台。"科学家调整"是 IPO 前的常规治理动作,与"创始人退出"是不同性质。
关键判断:罗剑岚"内部调整" + 上海创智学院全职的双重信号,意味着中国具身智能顶尖科学家开始从"企业单一雇主"转向"高校 + 企业"双跨模式(类似 1990s 末美国 AI 教授的工业-学术双跨),这是产业进入"规模化落地阶段"的人才配置信号;智元保留"罗"的技术成果,放弃其合伙人席位,换取组织灵活性。后续 3-6 个月看 ①智元 IPO 估值能否突破 400 亿美元(对标宇树科技 420 亿)②创智学院是否成为中国具身智能"黄埔军校"(类似早期 CMU Robotics Institute) ③中国具身智能"科学家-工业界"双跨制度是否在更多公司复制(智元 / 宇树 / 星动纪元 / 它石智航)。
智元机器人 · 罗剑岚 · 2026-08-03 · 🇨🇳 中国动向 · 具身智能 · 产学研交叉 · 公司治理
N08
蚂蚁灵波启动 15 亿首轮融资 + 德塔智能半年第六轮 5 亿融资,具身智能赛道半年吸金 900 亿
🎓 学术 / 投融资 蚂蚁集团旗下具身智能子公司"蚂蚁灵波"8-3 启动首轮 15 亿融资,目标独角兽+;同期人形机器人基础模型公司德塔智能(Delta Intelligence) 完成近 5 亿元天使++轮,半年内第六轮(2026 Q1 起累计融资超 10 亿),投资方包括智元 / 乐聚 / 星海图等主机厂 + 元禾 / 复星锐正 / 华映 / 联想创投等财投机构。
🏢 产业 / 资本逻辑 德塔融资速度"半年六轮"是 2026 罕见的"具身智能军备竞赛"信号:头部主机厂(智元 / 乐聚)反向投资基础模型公司,显示产业链分工正从"垂直整合"转向"模型 - 数据 - 本体"分层;德塔主推头戴式全身数据采集设备 Delta D1(佩戴者正常作业即可同步采集第一人称全景视觉 + 全身关节运动轨迹),瞄准"具身智能数据短缺"痛点。
关键判断:中国具身智能融资节奏从"1 年 1 轮"加速到"半年 6 轮",反映 ①主机厂意识到"模型能力"比"硬件制造"更具产业链卡位价值 ②头部资本(蚂蚁 / 智元)用"提前锁定上游数据 + 模型"的方式压制新进入者 ③Delta D1 类"硬件化数据采集"是 2026H2 关键基础设施赛道,类似 2014 年自动驾驶的"数据众包"。后续 3-6 个月看 ①蚂蚁灵波融资是否被 8-9 月政策(具身智能专项再贷款)影响 ②Delta D1 / 智元 AgiBot World / 银河通用 "通类" 三大数据采集路线的实际产能 ③具身智能"基础模型"层(类似 Foundation Model)是否在 8-9 月融资 1 亿美元级单轮。
蚂蚁灵波 / 德塔智能 · 2026-08-03 · 🇨🇳 中国动向 · 具身智能 · 资本估值 · 前沿产业
N09
米哈游蔡浩宇 AI 创业生变:九成资源押向 Agent,多个项目暂停
🎓 学术 / 战略转向 蔡浩宇(米哈游联合创始人 / 《原神》制作人) AI 创业项目 8-3 曝光生变——多个在研项目暂停,九成资源押向 Agent 方向;这是 2026 罕见的"游戏行业头部人才全押 AI Agent"案例,折射 Game 行业对 AI 替代 / 增强游戏工作流的判断。
🏢 产业 / 跨界 米哈游本身在 AIGC 工具(AIGC 美术 / 剧情 / 角色控制)有 3 年积累,蔡浩宇 AI 创业项目(独立于米哈游主体)聚焦"AI 增强创作 + Agent 工作流";从 30+ 立项收口到"九成押 Agent"是 2025-2026 行业共识——Agent 工具链成熟度足以支撑游戏行业"AI 原生工作流"重做,而非仅是"AI 辅助"。
关键判断:游戏行业头部人才"九成押 Agent"是 2026Q3 重要信号——①游戏行业从"内容驱动"转向"Agent 驱动"的可能性 ②AIGC 工具被 Agent 工具"吞噬"(单点能力让位于端到端工作流) ③米哈游 / 腾讯 / 网易 / 字节游戏业务线,2026H2 是否会跟进"AI Agent 优先"战略。后续 3-6 个月看 ①蔡浩宇新项目是否在 9-10 月开放预览(类似 Anthropic Claude 3.5 Sonnet 首发节奏) ②中国游戏行业 2026 整体研发成本是否因 AI Agent 工具链成熟下降 15-20% ③腾讯互娱 / 网易雷火 / 字节朝夕光年的 AI 部门是否大规模招聘 Agent 工程师。
米哈游 / 蔡浩宇 · 2026-07-31 · 🇨🇳 中国动向 · Agent · 前沿产业 · 趋势观察
主题 3 · 🏢 基础模型与开源基础设施 (5)
N10
阿里 Qwen3.8-Max 8-3 发布:2.4 万亿参数,Arena 榜 Claude 系,下周开源 27B / Max
🎓 学术 / 模型发布 Qwen3.8-Max 2.4 万亿参数(对比 Qwen3.5-Plus ~7200 亿 + 1.5 倍),在 Coding(Coding Agent Index v1.1 80.6 vs Claude Fable 5 77.2)和 CoWork(专业办公) 两项能力显著升级;Arena 榜冲进第一梯队,仅次于 Claude 系;同时 Qwen3.8-27B(轻量级)与 Qwen3.8-Max 同步开放 API 接入千问 AI 平台,均于下周开源。
🏢 产业 / 价格战 同步推出 Token Plan(个人版 / 团队版)+ 夜间 2 折;这是阿里第一次在中国市场把"个人 Token 订阅"作为独立业务,而不是 ToB 嵌入——直接对标 OpenAI ChatGPT Plus 20 美元/月、Anthropic Claude Pro;MiniMax 海螺 AI / 月之暗面 Kimi 同期都有类似订阅动作,2026H2 中国 ToC Token 订阅战争开打。
关键判断:Qwen3.8-Max 2.4 万亿参数 + 80.6 Coding 分数,意味着 ①阿里正式进入"超大参数 MoE"第一梯队(超 Qwen3.5 Plus ~50%) ②Coding 能力是 2026 模型差异化最大战场(每 1 分 Coding Agent Index 分数约对应 10% Agent 任务完成率) ③27B 下周开源对开发者社区意义重大——可以本地部署,避免对 API 依赖。后续 3-6 个月看 ①Qwen3.8-Max 24 小时 Token 消耗量(参考 MiniMax H3 8-3 单日 5.5 万亿 Token 量级)②Token Plan 个人订阅 8-9 月付费转化率 ③Qwen3.8-27B 本地部署在 M2 Ultra / RTX 4090 上的实际可用性 ④阿里云百炼平台 Qwen3.8 推理服务的 SLA 与价格战对 MinMax/DeepSeek 商业化挤压。
阿里通义千问 · 2026-08-03 · 🇨🇳 中国动向 · 基础模型 · 前沿产业 · 开源生态 · 商业化
N11
阿里"千问办公"(QwenWork) 8-3 开启公测,整合 QoderWork/MuleRun/悟空,业内首款三端 Agent
🎓 学术 / 架构 千问办公由 QoderWork(编码 Agent)+ MuleRun(云端 Agent)+ 悟空(企业协同 Agent) 三款产品整合而来,是业内首款同时支持桌面端 Agent + 云端 Agent + 企业协同 Agent 的产品;同程嵌入 Qwen3.8,支持自然语言办公 + 跨工具调用 + 复杂工作流自动化。Web 版 + 独立 PC 客户端已开放,钉钉 PC / 手机端内置入口即将开放。
🏢 产业 / 入口战 这是阿里"把 Agent 整合进 IM / OA"的关键一步——对标 Microsoft 365 Copilot(嵌入 Office)+ 字节豆包(嵌入飞书)+ 腾讯元宝(嵌入企业微信);新用户 2000 积分 + 公测第一周每日 500~2000 积分补贴,激进补贴策略反映阿里 ToB Agent 战略的紧迫性——错过窗口期就要被腾讯 / 字节瓜分企业 AI 入口。
关键判断:千问办公"整合 + 补贴"两步走,折射阿里在 2026Q3 面对的核心竞争压力——Qwen 模型在开发者侧已领先(Coding 80.6 / 开源生态),但在企业 ToB / 办公侧被微软 + 钉钉 + 飞书 + 企微四家夹击;公测补贴 2000 积分(约 1 元 Token 价值)是新用户拉新成本,目标是"先占位置再说商业化"。后续 3-6 个月看 ①千问办公 8 月企业用户数(目标 1 万企业 / 10 万个人用户)②钉钉内置入口 8-9 月开放后的实际使用率 ③阿里云 Qwen3.8 推理服务的 token 利润率(补贴期是否可控) ④对 OpenAI ChatGPT Enterprise / Anthropic Claude for Work 的中国市场份额冲击。
阿里巴巴 / 千问办公 · 2026-08-03 · 🇨🇳 中国动向 · 基础模型 · 产品落地 · ToB Agent · 趋势观察
N12
OpenAI 公布 GPT-5.6 Sol 自我优化全栈工程:生产 GPU Kernel 自主改写,端到端成本 -20% / Token +15%
🎓 学术 / RSI 突破 7-30 OpenAI 公布 GPT-5.6 Sol 的"RSI(递归自进化)"实践:①Sol 已投入真实生产,改写 Triton / Gluon GPU Kernel ②优化推测解码模型(自训练 draft model + 100+ 组架构实验) ③优化前向传播路径(预计算 / 避免 / 并行) ④智能体调度(Rust 编写 Agent Harness,延迟发现 + 提示缓存稳定);五项联动的端到端服务成本 -20%,Token 生成 +15%。
🏢 产业 / 全栈工程化 作者包括 Triton 之父 Philippe Tillet,意味着 OpenAI 已建立"模型参与优化自身运行环境"的标准工程能力;同时 OpenAI 内部 Token 消耗量(用于编程 / Agent)过去半年增长 22 倍,内部研究算力 100 倍——这种"AI 优化 AI"的飞轮一旦转起来,与对手的差距会以非线性方式扩大。
关键判断:GPT-5.6 Sol 的"自我优化"在 2026H2 LLM 行业是分水岭级事件——它意味着 ①AI 公司进入"用 AI 优化 AI 基础设施"的飞轮阶段 ②大模型竞争从"参数 / 数据"升级为"算力使用效率" ③传统 ML 工程团队的角色会向"AI 训练 AI"的"AI Ops"转型。后续 3-6 个月看 ①Anthropic Claude Fable 是否跟进"自我优化"公开材料 ②中国头部模型(DeepSeek / Qwen / GLM)是否在 8-9 月披露类似 RSI 实践 ③Anthropic 监管事件后,OpenAI 这波"全栈工程公开"是否影响监管对"AI 自主修改代码"的安全担忧。
OpenAI / GPT-5.6 · 2026-07-30 · 🌍 全球信号 · 基础模型 · 学术成果 · RSI · 全栈工程
N13
xAI Grok 4.5 视频理解模型发布:可解析人物动作 + 判定深度伪造,定位"反向打假"工具
🎓 学术 / 多模态 马斯克 8-3 展示 xAI Grok 新版视频交互能力:上传科比 AI 合成视频后,Grok 可解析视频画面 / 人物动作 / 场景,提取核心台词("Grok 4.5"等),并结合画面音频判定"该视频为深度伪造内容,科比已于 2020 年离世"——这是 2026 罕见的"AI 反向鉴别 AI"功能。
🏢 产业 / 平台 新版 Grok 支持用户上传本地视频或粘贴链接,可进行视频总结 / 人物物体识别 / 动作拆解 / 连续追问;xAI 借此抢占"AI 内容鉴别"市场——Hugging Face 7-9 事件中,德朗格也用中国 GLM 5.2 来鉴别 OpenAI Agent 攻击,这反映"AI vs AI 鉴别"已成 2026Q3 标准需求。
关键判断:Grok 4.5 视频理解的"反向打假"功能定位精准—— 2026Q3 AI 视频生成的爆发(Seedance 2.5 / H3 / Sora)导致"AI 内容真实性"危机,平台必须提供可信鉴别工具;但目前 Grok 没有公开评测集或 F1 分数,具体准确率未知。后续 3-6 个月看 ①xAI 是否开源 Grok 视频理解模型(参考 OpenAI 7-30 公开 GPT-5.6 优化报告的做法) ②中国互联网平台(抖音 / 微信 / 微博)是否跟进"AI 视频鉴别"工具 ③C2PA / SynthID 等已有水印标准与 Grok 视觉鉴别的性能对比。
xAI / Grok · 2026-08-03 · 🌍 全球信号 · 基础模型 · 多模态 · AI 安全
N14
DeepSeek 8-3 单日消耗 8 万亿 Token,3 万亿为付费调用,OpenRouter 国产模型周榜小米 MiMo 登顶
🎓 学术 / 评测 OpenCode 平台 8-3 披露:DeepSeek 单日 Token 消耗 8 万亿,其中 3 万亿为付费调用,5 万亿来自开发者 / 免费 API 配额;OpenRouter 同一周榜单(7-27 ~ 8-2)前 5 全部为中国企业研发模型——小米 MiMo-V2.5 第一(10.5 万亿 Token,环比 +12%),DeepSeek 2 款分列 2/5,腾讯混元 3 第三(7-6 开源,环比 +999%),DeepSeek-V4-Flash 第五。
🏢 产业 / 调用趋势 这是 2026 中国 AI 产业的"流量反向"标志——OpenRouter 是全球最大 LLM API 聚合平台,8-2 当周中国模型占榜单前 5 全部 + 前 10 至少 6 个,完全压制 Meta Llama / Mistral 等老牌开源;DeepSeek / Qwen / MiMo / 混元 4 大开源体系的"开发者 flywheel"已形成。
关键判断:OpenRouter 8-2 周榜前 5 全部中国 + DeepSeek 8 万亿单日消耗,意味着 ①中国开源模型在 2026H2 已主导全球开发者生态 ②DeepSeek 8 万亿单日 / 3 万亿付费的组合,折合单日 30 万美元营收(按 GPT-5.6 Sol 30/M token 输出价计算,实际价格更低),年化 1 亿美元级;小米 MiMo-V2.5 登顶显示"端侧友好 + 开源"路线在开发者侧的胜出。后续 3-6 个月看 ①DeepSeek 是否在 8-9 月披露月活 / 年化营收数据(走向 IPO 节奏) ②MiMo-V2.5 路径是否能复制 Qwen 的"开放 → 商业化"模式 ③OpenRouter 周榜前 5 全部中国能否在 8-9 月持续 30 天,形成"绝对领先"。
DeepSeek / 小米 MiMo · 2026-08-03 · 🇨🇳 中国动向 · 基础模型 · 开源生态 · 趋势观察
主题 4 · 💰 资本 & 监管 (4)
N15
月之暗面计划最早 8 月内提交港股 IPO,或募资约 30 亿美元,G 轮目标投前估值 500 亿美元
🎓 学术 / 公司战略 彭博社 8-3 报道:月之暗面(Kimi 母公司)计划最早 8 月内提交港股 IPO 申请,预计募资约 30 亿美元;公司 7-29 已完成 35 亿美元 F 轮融资,投后估值 350 亿美元,正在提前启动原定 8 月进行的 G 轮(Pre-IPO 轮),投前估值升至 500 亿美元——按当前节奏,月之暗面可能在 2026Q4 完成港股上市。
🏢 产业 / 资本 月之暗面估值从 2025-12 的 200 亿美元 → 2026-7 的 350 亿美元 → 8 月 G 轮 500 亿美元,8 个月翻 2.5 倍;对比智元创新(港股 IPO 启动,7-24 公告)、宇树科技(科创板 8-5 询价)、DeepSeek(尚未启动 IPO),中国 AI 四小龙"IPO 三叉戟"格局已经形成,合计估值或在 1000 亿美元级。
关键判断:月之暗面 8 月提交港股 IPO + 500 亿美元估值,意味着 ①中国 AI 头部公司进入"二级市场定价"阶段 ②港交所(对比纳斯达克)对中国 AI 公司更友好,可能成为 2026-2027 中国 AI IPO 主战场 ③G 轮 500 亿美元估值要求 Kimi K3 商业化加速(ARR 需达 5-10 亿美元),否则"估值 - 营收"比过大。后续 3-6 个月看 ①月之暗面 8-9 月是否正式递交招股书 ②Kimi 付费用户 / ARR 在 8-9 月的增速 ③同期智元(港股) + 宇树(A 股科创板) + 月之暗面(港股)三家的估值锚定与定价博弈。
月之暗面 / Kimi · 2026-08-03 · 🇨🇳 中国动向 · 资本估值 · 政策监管 · 趋势观察
N16
力积电董事长黄崇仁 7-31 因心肺衰竭逝世,负债 1200 亿逆风翻盘"九命怪猫"传奇落幕
🎓 学术 / 产业历史 黄崇仁(1949-2026,76 岁),美国纽约西奈山医学院医学博士(弃医从商代表人物),1994 年创立力晶半导体(力积电前身),1996 年建成中国台湾首座 8 英寸晶圆厂;2008 金融海啸 + 全球 DRAM 供过于求导致公司负债约 1200 亿新台币,2012 年股票下柜,2019 年完成重组(力积电承接晶圆制造业务),2021 年重新挂牌上市——半导体界"九命怪猫"。
🏢 产业 / 接班 黄崇仁近年推动力积电从"传统成熟制程晶圆代工厂"向"AI Foundry(内存 + 逻辑 + 先进封装)"转型,布局晶圆堆叠 / 硅中介层 / 硅电容 / HBM 后段晶圆制造服务;副董事长谢再居代理董事长,公司产销及运营按既定规划推进;对全球 AI Foundry 竞争,黄崇仁 7 月法说会强调"力积电已不再定位为传统成熟制程晶圆代工厂"。
关键判断:黄崇仁逝世是 2026 全球 AI Foundry 竞争的关键变量—— ①力积电是全球少数同时具备 DRAM + 逻辑 + 先进封装能力的代工厂,黄崇仁的"AI Foundry"战略直接对标台积电 CoWoS / 三星 HBM ②力积电 HBM 后段晶圆制造服务,与中国长江存储 / 长鑫存储(同 2026-7 长鑫 12800Mbps LPDDR6 验证)形成"内存 + 逻辑"双线竞争 ③台湾半导体"创始人时代"正式进入交接期(继 7-31 黄崇仁后,后续 12-24 个月台积电 / 联发科可能进入代际交接)。后续 3-6 个月看 ①力积电 AI Foundry 战略在黄崇仁离世后是否持续(副董事长谢再居执行力) ②台积电 CoWoS 产能扩张速度(2026Q4-2027Q1 是关键) ③中国长鑫 / 长江存储的 HBM / HBM2e 量产时点(对标 8 月长鑫 LPDDR6 12800Mbps)。
力积电 / 黄崇仁 · 2026-07-31 · 🌍 全球信号 · 资本估值 · 公司治理 · 半导体 · 趋势观察
N17
蔡崇信 8-1 离婚:阿里股权 / 主席职务 / 篮网 / 自由人均不动,蓝池资本 500 亿美元规模稳定
🎓 学术 / 公司治理 蔡崇信(62 岁)与吴明华(60 岁,斯坦福本科 / 哈佛 MBA)8-1 结束近 30 年婚姻,共同声明强调"无出售阿里股份计划,蔡崇信继续担任阿里集团主席职务";蔡崇信 2026 财年税前薪酬 4227.1 万元,个人净资产约 125 亿美元(约 844 亿元人民币);蓝池资本(Blue Pool Capital,设立 2014 年)资产管理规模超 500 亿美元(约 3600 亿元人民币)。
🏢 产业 / 治理 这是 2026 中国顶级富豪离婚中"教科书式资产隔离":阿里股权(1.43% + 0.5% 基金会)+ 布鲁克林篮网 + 纽约自由人 + 巴克莱中心(BSE Global 估值 60 亿美元)+ 蓝池资本 4 大资产类别同步"不动";布鲁克林体育资产由专业团队运营,蔡 / 吴分任董事长 / 副董事长,3 名成年子女逐步参与家族产业传承。
关键判断:蔡崇信离婚案例对 2026 中国企业家"代际传承"有标志性意义——阿里 1.43% 股权 + 主席职务 + BSE Global 60 亿美元体育资产 + 蓝池资本 500 亿美元家办,4 类资产"零变动",把"婚变 - 分股 - 减持 - 治理动荡"的连锁风险全部前置拆雷;蔡 62 岁主动拆雷,留出充足时间完成代际传承。后续 3-6 个月看 ①阿里 1.43% 股权是否在蔡 / 吴 / 子女三方有更细的代持 / 信托结构 ②蓝池资本 10 亿美元市场化基金 RIVERSIDE Fund 的 LP 结构(主权基金 / 养老金 / 家族办公室)在 8-9 月是否公开 ③蔡崇信是否在 2026Q4 公布子女进入阿里董事 / BSE Global 经营层的具体节奏。
阿里巴巴 / 蔡崇信 · 2026-08-01 · 🇨🇳 中国动向 · 资本估值 · 公司治理 · 政策监管
N18
长鑫存储增资至 313.9 亿(+31%) + 三星 / SK 海力士被传锁死内存价格跌幅不超 5%
🎓 学术 / 资本动作 长鑫存储(CXMT)8-3 完成工商变更,注册资本由约 238.9 亿元增至 313.9 亿元,涨幅约 31%——这是继 7 月长鑫 12800Mbps LPDDR6 研发验证进入尾声(预计 2026H2 量产)后的又一大资金动作;同步 SK 海力士 HBM 业务持续扩张,韩国 KOACC(国家 AI 计算中心)8-3 破土动工,投资 2.5 万亿韩元(118 亿元),2028 年建成。
🏢 产业 / 价格 PC 端 2026Q3 涨价潮(宏碁高管预测 +5% / 第四季度才趋稳)与移动端(小米 8-2 全系涨价 300 元起)的根本原因是 HBM / DDR5 / LPDDR5 价格被合同化——三星 / SK 海力士"锁死"未来几年内存价格跌幅不超 5%,这与 2024-2025 的"价格战"截然不同。
关键判断:长鑫 31% 增资 + 三星 / 海力士"锁价"5% 内,标志 ①全球 DRAM 行业从"价格战"转向"价格协议" ②HBM / 先进封装成为 AI 算力的关键瓶颈,供应方议价权显著增强 ③长鑫 LPDDR6 12800Mbps 量产时点(预计 2026Q4)可能改变"国内厂商"竞争格局。后续 3-6 个月看 ①长鑫 2026Q4 LPDDR6 16Gb 颗粒是否如期量产(目标 2027 上半年) ②HBM3e / HBM4 单价是否在 8-9 月继续上行(目前 HBM3e 12-Hi 单价 200 美元/颗) ③PC / 手机品牌 2026Q4 财报中"内存成本"占比是否进一步抬升至 30%+。
长鑫存储 / 三星 / SK海力士 · 2026-08-03 · 🇨🇳 中国动向 / 🌍 全球信号 · 资本估值 · 硬件 / 半导体 · 趋势观察
主题 5 · 🎓 顶会 & 学术生态 (3)
N19
前 OpenAI 工程师翁荔 7-30 回归 OpenAI,主导递归式自我改进(RSI)研究
🎓 学术 / 人才 Thinking Machines Lab 联合创始人翁荔(Lilian Weng,前 OpenAI 安全研究负责人)7-30 确认回归 OpenAI,专注"递归式自我改进"研究——翁荔是 OpenAI 7-29 GPT-5.6 自进化报告的"幕后推手",其 2024 年《LLM-powered Autonomous Agents》综述(github 29k Star)是该领域必读文献。
🏢 产业 / 影响 翁荔 2025-3 离职加入 Thinking Machines(由前 OpenAI CTO Mira Murati 创办,2025-12 估值 120 亿美元);2026-7 仅 5 个月后回归,反映 OpenAI 对 RSI 战略的人才优先级提升;翁荔回归意味着 OpenAI RSI 研究从"工程化迭代"进入"理论化突破"阶段,可能涉及元学习 / 自博弈 / 自生成训练数据等深层方向。
关键判断:翁荔 5 个月内从 Thinking Machines 回归 OpenAI,标志 ①OpenAI 对 RSI 战略的承诺是"全员最高优先" ②Thinking Machines 的"前沿模型实验室"定位短期无法撼动 OpenAI ③RSI 在 2026H2 可能从"工程"上升为"理论"(类似 2018-2019 BERT/GPT 阶段从"经验"上升为"理论")。后续 3-6 个月看 ①翁荔回归后第一篇 RSI 论文 / 博客发表时点(预计 8-9 月) ②GPT-5.7 / GPT-6 是否在 2026Q4 出现"训练数据自主生成"或"模型自主架构搜索"等深层 RSI 迹象 ③Thinking Machines 第一款产品(传闻是 RL 训练平台)的发布时间是否因翁荔回归而推迟。
OpenAI / 翁荔 · 2026-07-30 · 🌍 全球信号 · 学术成果 · 人才 · 趋势观察
N20
腾讯混元组织架构再调整:语言模型部与多模态模型部合并为基础模型部,姚顺雨统筹
🎓 学术 / 组织 腾讯混元 7-23 完成组织架构再调整:语言模型部(LLM)与多模态模型部(MLLM / VLM / TTS)合并为新"基础模型部",由姚顺雨(前 OpenAI 工程师 / 2025-10 加入腾讯)统一统筹——这是腾讯在 7-31 混元 Hyra 论文(加法组合学 50 年新构造)获奖后,首次组织级动作;姚顺雨 7-31 也公开为 Hyra 招 AI4S 方向人才。
🏢 产业 / 战略 合并基础模型部反映"LLM 与多模态融合"的 2026H2 行业共识——Anthropic(Claude Fable 系列)、阿里(Qwen3.8-Max 多模态版)、字节(Seedance 2.5 多模态)都已实现"单模型多模态",腾讯 7-23 跟进是行业第三阶段;姚顺雨 + 沈正乾(新基础模型部) + 宝罗 + 姜昕冉等组成了 2026 腾讯混元最强阵容。
关键判断:腾讯混元"基础模型部合并"与同期阿里千问办公整合 / 字节 Seedance 多模态路线形成"中国大厂 LLM 整合潮",标志 ①单一公司内的"多模型团队"已过时,"统一多模态基模型"成为新标准 ②腾讯通过姚顺雨 + Hyra 论文招人,正在加速追赶 DeepSeek / Qwen / GLM 的"开源生态"位置 ③腾讯混元 8-9 月是否开源新模型(类似 Hunyuan3 已经开源)是验证其战略的关键。后续 3-6 个月看 ①姚顺雨主导下的腾讯混元新模型发布节奏(预计 9-10 月)②腾讯混元是否在 Hyra 之后推出"AI4S + Agent"双轮路线 ③腾讯混元 vs 阿里 Qwen 内部资源博弈(同为 2025 起步晚,谁能在 2026H2 抢到"中国 LLM 第三"位置)。
腾讯混元 / 姚顺雨 · 2026-07-23 · 🇨🇳 中国动向 · 学术成果 · 产学研交叉 · 趋势观察
N21
苹果 9 月换帅前特努斯返聘 2022 退休副总裁勒格罗斯,库克末次电话会示警 iPhone 供应
🎓 学术 / 公司治理 苹果 8-1 公告候任 CEO 约翰·特努斯(John Ternus)返聘 2022 年退休的副总裁勒格罗斯(负责硬件工程前负责人);同期库克最后一次主持电话会(8-31 后将卸任),示警第四财季 iPhone 收入因供应限制增速降至 15%(此前两季度 22%),服务业务增速与上季持平(剔除汇率 12%);公司同步预告第四财季营收增速仅 9-11%,低于市场预期。
🏢 产业 / 供应链 苹果库克 8-31 后卸任,接任的特努斯需要解决"硬件 / 软件 / 服务"三轮同时放缓的难题;同期 8-2 摩根大通将苹果目标股价下调至 340 美元(因 iPhone 18 Pro / Max 内存与芯片成本飙升 250-300 美元 / 部);苹果对长鑫 / 三星 LPDDR 供应链的议价权在 2026H2 将面临考验。
关键判断:库克 15 年任期的"末班车"信号明显:营收增速放缓 + 换帅前重组 + iPhone 涨价压力,2026Q4-2027Q1 苹果进入"特努斯时代"过渡期;库克留下的"硬件 + 服务"战略可能被调整,服务业务(目前占总营收 25%)有望继续被加码。后续 3-6 个月看 ①9 月苹果秋季发布会(预计 9-9 前后)是否如期发布 iPhone 18 系列 + 价格策略 ②特努斯主导下的硬件工程部门重组是否带来"产品线整合"(传闻 iPhone Air 2 2027Q1 发布)③苹果服务业务(Apple Intelligence / Apple Music / iCloud)是否在 2026Q4 推出 AI 订阅(参考 OpenAI ChatGPT Plus / Anthropic Claude Pro 模式)。
苹果 / 库克 / 特努斯 · 2026-08-01 · 🌍 全球信号 · 资本估值 · 公司治理 · 供应链
主题 6 · 🔮 本周前瞻 (3)
N22
宇树科技科创板 IPO 8-5 询价 / 8-10 申购,发行估值 420 亿,王兴兴 1500 万跟投
🎓 学术 / 公司治理 宇树科技 7-30 发行安排公告:拟公开发行 4044.64 万股(占发行后总股本 10%),发行后总股本 4.04 亿股;初步询价日 8-5,网下/网上申购日 8-10,缴款日 8-12,证券代码 688836;拟募资 42.02 亿元,对应发行估值约 420 亿元,85% 募投资金专项用于研发投入(20.22 亿元用于智能机器人模型研发)。
🏢 产业 / 战略 王兴兴(创始人 / 董事长 / CTO)认购 1500 万元,171 名员工通过 1 号资管计划(2.185 亿) + 2 号资管计划(5300 万)跟投 2.715 亿;股东含美团 9.65% / 红杉中国 7.11% / 经纬创投 5.45% / 顺为资本 4.42% / 蚂蚁 / 腾讯 / 阿里 / 中信 / 中国移动等;从 3-20 受理到 6-1 过会仅 73 天,创 2026 年科创板最快审核纪录。
关键判断:宇树 420 亿 IPO 是 2026 中国具身智能资本化的关键事件——若 8-5 询价 / 8-10 申购顺利完成,8 月底 / 9 月初正式上市,将对标特斯拉 Optimus 量产节奏(月产 1000 台目标),但宇树 2025 年营收 17 亿 + 60% 毛利率 + 全尺寸人形机器人 5500 台出货(全球第二,仅次于智元 5100 台)的"商业化基础"远比特斯拉 Optimus 1.0 阶段扎实。后续 3-6 个月看 ①8-5 询价结果(发行价区间 / 募资总额) ②8-10 申购倍数 / 8-19 上市开盘价(预测 100-200 亿开盘市值) ③智元(月港股)+ 宇树(A 股)+ 月之暗面(港股)三家的"中国 AI 上市三叉戟"对二级市场流动性的争夺。
宇树科技 · 2026-08-03 · 🇨🇳 中国动向 · 资本估值 · 具身智能 · 政策监管
N23
华为 / 比亚迪 8 月密集发布:享界 G9 8-5 预订 / 王朝旗舰大汉 8-21 成都车展亮相 / Mate 80 销量破 800 万
🎓 学术 / 产品 华为 8-5 三连发:①余承东预告享界 G9 8-5 开启预订(搭载车身一体化电动顶帐,顶配华为乾崑智驾 ADS 5 Pro 8-5 同步开启多城测试,后续全系免费 OTA)②余承东官宣华为首款 RGB-MiniLED 电视 8-5 正式开售(行业 RGB 三原色独立发光最高配置)③鸿蒙 HarmonyOS 7 8-4 起适配 Pura 90 系列等"直连供电"功能(边充边玩不发烫)。
🏢 产业 / 战略 比亚迪 8-21 成都车展亮相"王朝旗舰 9 系轿车"——比亚迪大汉(配第二代刀片电池 + 天神之眼 5.0 + 充电速度全球第一,预售 31.98 万元起);7 月销量 41.9 万辆(出口 18 万辆创历史新高)+ 腾势 Z9S 预售 8-1 启动 31.98 万元起;华为 Mate 80 系列销量突破 800 万(国产旗舰销量榜首)。
关键判断:8-5 华为享界 G9 + 8-21 比亚迪大汉 + Mate 80 800 万销量,标志 ①华为"鸿蒙智行 + Mate 80"双线在 8 月集中发布 ②比亚迪"腾势 + 王朝 + 方程豹"三系协同(7-31 方程豹 S 巡展 + 8-21 大汉)③享界 G9 8-5 预订数据(参考享界 S9 / 问界 M9)能否复制 7 周破 2 万台的爆款节奏。后续 3-6 个月看 ①享界 G9 8-5 ~ 8-15 订单数据(目标首月 1.5 万+)②Mate 80 系列 8-9 月能否突破 1000 万(华为终端史上首款)③比亚迪大汉 8-21 上市后 8-31 前的锁单数据(目标 3 万 / 月) ④8-5 ~ 8-21 期间是否出现新势力车企(理想 / 蔚来 / 小鹏 / 极氪)的 8 月新车型抢位。
华为 / 比亚迪 · 2026-08-03 · 🇨🇳 中国动向 · 产品落地 · 趋势观察 · 智能汽车
N24
OpenAI Astra 模型预演美国监管 + 特朗普 AI 沙皇辞职,8-9 月美 AI 监管窗口关键
🎓 学术 / 监管 OpenAI CEO Sam Altman 8-1 亲赴华盛顿,向监管机构预演了名为"Astra"的全新 AI 模型系列——核心能力是支持多个 AI Agent 协同工作,并能在较长时间跨度内持续执行复杂任务;8-1 The Information 报道,OpenAI 内部测试的 Astra 在数学任务中表现突出,部分任务如 AIME 满分,但"数学能力提升并不等同于解决模型幻觉"。
🏢 产业 / 政策 特朗普"AI 沙皇"大卫·萨克斯(David Sacks)7 月底辞职,标志特朗普政府"AI 政策"进入不稳定期;同期 Meta / OpenAI / Anthropic / Google 围绕 8-31 前"开放权重监管"博弈加剧;7-30 美国业界联名信"反对限制中国开放权重 AI"成为关键博弈筹码,直接影响 8-9 月美国国会与白宫对 AI 法案的最终定调。
关键判断:OpenAI Astra 8-1 向监管预演,是 2026 美国 AI 监管最重要的"政策窗口"——①Astra 命名"多 Agent 协同"+"长时间跨度"+"复杂任务",是 2026 AGI 主线 ②特朗普 AI 沙皇辞职,8-9 月是关键博弈期 ③中国开放权重模型"被禁 / 不被禁"的核心变量是 8-31 国会休会前的法案进展。后续 3-6 个月看 ①Astra 模型在 8-9 月的公开 benchmark(GPT-5.6 Sol / Claude Fable 5 / Astra 三方对比)②8-31 美国国会"开放权重法案"是否成型 ③OpenAI 与白宫的"政府名单"协调机制(参考 GPT-5.6 6-27 有限预览的 20 家受信合作伙伴)是否扩展到 Astra。
OpenAI / Astra / 监管 · 2026-08-01 · 🌍 全球信号 · 政策监管 · 趋势观察 · 前瞻