跳到主内容
AI INSIGHT · WEEKLY REPORT · 33

AI 周报 2026年第33周

OpenAI重启底座预训练·DeepSeek V4 Pro+Grok 4.6同日对决·混元Hy3登顶·GLM-5.3开源·宇树A股上市·大模型集体「长出双手」

08/10-08/16 覆盖7天日报 · 5板块 海外+国内

概览

本周概览

维度周度信号
大模型/底座OpenAI代号Doug重启大规模底座预训练;DeepSeek V4 Pro+Grok 4.6同日发布;GLM-5.3开源刷新编程&安全基准;阿里Qwen3.8-Max正式开放
多模态/音频腾讯混元Hy3多榜登顶;字节Seed Audio发布高质量音频生成模型;多模态统一时代全面加速
AI Agent/工具Claude Code Auto Mode默认开启;大模型集体「长出双手」进入Agent化;2026年CPU战略地位回升,AI推理算力格局重构
具身智能/机器人宇树科技成A股首家人形机器人上市公司;物理AI从展台奔赴真实产业战场
中美AI竞争中国大模型掀翻硅谷定价逻辑;DeepSeek V4 Pro性价比再次颠覆市场预期;中美顶尖AI同日发布新模型全球关注
Top 5

本周 Top 5 事件

TOP 1 OpenAI重启底座预训练
OpenAI代号Doug:重启大规模底座预训练——承认现有模型架构已触天花板
OpenAI被曝启动代号Doug的新底座预训练项目,规模远超现有GPT系列,由前OpenAI核心研究员Doug引领,目标是突破当前模型能力瓶颈。消息源指出,OpenAI判断GPT-4o系列的能力上限已接近,单纯依靠后训练优化(RLHF/RLHF+等)的收益递减,必须用下一代预训练重新建立底座能力。项目优先级被提至最高,与o系列推理模型并行推进。
关键判断
OpenAI主动承认「当前模型触天花板」是信号强度极高的战略转向。过去18个月OpenAI重心在后训练和推理链优化(o1/o3系列),如今重启大规模预训练,说明他们认为能力跃升的下一个关键节点不在推理,而在底座数据+架构。这对整个行业的信号:「预训练缩放」之路可能还没走完,只是需要下一代范式。
TOP 2 DeepSeek V4 Pro+Grok 4.6同日对决
DeepSeek V4 Pro与Grok 4.6同日发布——中美顶尖AI正面交锋,性价比vs性能的全球关注
DeepSeek V4 Pro(满血版)与马斯克旗下xAI的Grok 4.6在同一天发布,引发全球AI社区密集对比。DeepSeek V4 Pro在多项推理、数学和代码基准上与Grok 4.6持平甚至领先,而API价格仅为Grok 4.6的十分之一量级。同期,中国大模型在硅谷定价逻辑上持续施压,阿里Qwen3.8-Max正式开放,2.4T参数面向所有用户开放调用。
关键判断
同日发布不是巧合,是DeepSeek有意选择最高热度窗口正面竞争的策略。DeepSeek已连续多代用「效率颠覆」改写市场预期,V4 Pro再次用数据说话:性能不输美国顶级闭源模型,价格击穿行业地板。这对企业用户是明确的采购信号,对AI行业的意义是:中国模型已进入「定价权」争夺阶段。
TOP 3 混元Hy3登顶+Seed Audio
腾讯混元Hy3多榜登顶,字节Seed Audio发布——多模态统一时代全面加速
腾讯混元Hy3本周在多项综合评测榜单登顶,多模态推理能力获第三方认可;字节跳动同期发布Seed Audio,面向高质量音频生成与音乐创作场景,延续字节在多模态领域的密集布局。两大国内顶级AI厂商在同一周密集发力,标志着中国AI竞争已从文本走向全模态统一。
关键判断
混元Hy3登顶的意义在于:腾讯在追赶阿里Qwen、DeepSeek之后,用Hy3完成了一次能力基准上的超越性验证。字节Seed Audio则填补了国内高质量音频AI的空白。两件事合力说明:中国AI头部玩家在文本之外的战场已全面打开,多模态统一模型的竞争格局正在形成。
TOP 4 GLM-5.3开源刷新双榜
Z.ai发布GLM-5.3开源大模型——编程与网络安全基准双线刷新,开源安全AI新里程碑
Z.ai(智谱AI更名)正式发布开源大模型GLM-5.3,在多项编程基准(HumanEval、SWE-bench等)和网络安全基准(CyberSecEval)上刷新开源模型纪录。GLM-5.3面向开发者和安全研究人员开放权重,是国内首个在安全AI领域有明确基准突破的开源模型。
关键判断
GLM-5.3的双基准突破释放两个信号:①开源模型能力已进入「专项超越闭源」阶段,不只是通用能力追赶;②网络安全AI是国内开源社区下一个高价值战场。智谱以「Z.ai」新品牌重新定位,意在走差异化路线——不打价格战,打专业深度。开源安全模型在合规审计、渗透测试、漏洞分析场景有巨大企业落地空间。
TOP 5 宇树科技A股上市
宇树科技成A股首家人形机器人上市公司——具身智能商业化进入资本验证期
宇树科技(Unitree)本周正式登陆A股,成为中国A股首家人形机器人上市公司。宇树以四足机器狗起家,近年快速拓展人形机器人产品线(H1/G1系列),在全球机器人竞赛中与Boston Dynamics、Figure AI等形成正面竞争。上市时机与物理AI(Physical AI)概念全球升温高度吻合。
关键判断
宇树上市是具身智能从「展台」走向「资本验证」的里程碑事件。A股上市意味着国内资本市场正式给具身智能赛道定价,这将加速整个赛道的融资速度和商业化节奏。宇树的差异化是「高性价比+开放生态」:机器狗最低款已在京东公开售卖,这是任何美国同类公司都没走通的路径。
洞察

周度洞察

洞察一:OpenAI重启预训练——AI能力跃升的「第一推动力」回归底座
两年后训练优化走到极限,OpenAI用Doug项目宣告:下一个智能跃升必须重回数据与架构

过去两年,整个AI行业的竞争重心在「后训练」:RLHF、RLAIF、推理链优化、工具调用。GPT-4到GPT-4o到o1/o3,每一代都是同一底座上的精调迭代。 OpenAI代号Doug项目的曝光说明:这条路的边际收益正在下降。当推理链优化和RLHF已无法产生下一代能力跃升,只有重新训练底座才能突破天花板。 这是一个行业信号:**「后训练时代」的红利期可能正在过去,「预训练规模跃迁」的新一轮军备竞赛即将开启**。 对中国AI的影响:DeepSeek、阿里、字节等在后训练和效率优化上积累了大量优势,但底座预训练规模与OpenAI/Google差距依然存在。Doug项目若成功,中国AI的追赶周期可能重新拉长。

洞察二:中国大模型进入「定价权」博弈——不只是性价比,是话语权
DeepSeek V4 Pro同日对抗Grok 4.6:价格战胜利之后,下一步是定义行业价格基准

DeepSeek用V4 Flash打赢了「效率战」,V4 Pro打的是「定价权战」。 当DeepSeek V4 Pro在性能接近Grok 4.6的同时价格低一个量级,这不只是竞争优势,而是在向全球企业客户传递一个信号:**「以OpenAI/xAI定价为参考系」的时代正在过去,中国模型将成为新的价格锚点**。 这对整个SaaS/AI应用层的影响是巨大的:基于GPT定价构建的商业模型需要重新核算成本结构,基于高API价格设计的差异化护城河正在被侵蚀。 Unsupervised Learning播客本周的「Lab Wars, Why APIs Might Vanish」讨论了同一逻辑:当底座模型API价格趋近于零,垂直应用层的价值创造必须来自数据飞轮和场景深度,而非API包装。

洞察三:大模型「长出双手」——Agent化是2026年下半年最确定的主线
Claude Code Auto Mode默认开启+CPU战略地位回升:Agent时代的基础设施正在重写

本周多个信号共同指向同一趋势:大模型正在从「语言能力」全面转向「行动能力」。 Claude Code Auto Mode默认开启:Anthropic把最高风险但最高价值的自主执行模式设为默认,是对用户信任度和模型能力双重提升的认可。 「AI集体长出双手」的报道本周密集出现,不是媒体热词,而是从DeepSeek代码执行、GLM-5.3安全渗透测试、混元Hy3多模态理解到宇树机器人物理执行——AI在各层次获得了「执行能力」。 CPU战略地位回升(「2030年CPU与GPU平分秋色」)的逻辑在于:Agent执行需要低延迟推理+复杂控制流+安全边界,CPU在这些场景的效率优于GPU。这是算力架构跟随应用场景进化的自然结果。 Builder Signal: Training Data播客「The Coming Dark Factory Where Software Builds Itself」描述的场景——软件自主构建软件——正在从概念走向现实。

深度洞察

深度洞察

本周最值得玩味的对称:**OpenAI承认现有模型触天花板(重启预训练),DeepSeek用同等性能模型把价格打穿(V4 Pro),宇树用消费级价格把人形机器人推上A股**——三件事在同一周发生,都指向同一个更大趋势:AI产业正在经历从「技术突破期」到「商业重写期」的历史性转折。
本周的结构性转折点是OpenAI代号Doug项目。如果说过去两年是「后训练优化的黄金时代」,Doug的启动意味着这个时代的终结已被AI头部玩家内部确认。下一场预训练军备竞赛一旦开启,算力需求、数据版权、架构创新的优先级将全面重排——对整个AI产业链的影响将在未来12-18个月逐步显现。
本周最深的矛盾:大模型正在「长出双手」(Agent化、代码执行、自主决策),但安全和对齐研究的速度远未跟上。GLM-5.3专项突破网络安全基准,这是中性技术能力,但同样的能力在攻击性场景同样有效。Claude Code Auto Mode默认开启是便利性和风险的同步提升。AI行业在赋予模型「执行能力」的路上跑得比安全基础设施快了一个身位。
本周最值得行动的洞察:**现在是评估Claude Code Auto Mode和DeepSeek V4 Pro在企业Coding Agent场景组合使用的最佳时机**。Claude Code的自主执行能力+DeepSeek V4 Pro的高性价比底座,可以搭建成本降低50-70%、能力不降的企业AI Coding工作流。如果你的团队正在评估AI研发提效方案,这周的两个发布是明确的技术选型信号。
大模型

大模型本周动态

OpenAI重启底座预训练(代号Doug);DeepSeek V4 Pro+Grok 4.6同日正面对决;混元Hy3多榜登顶;GLM-5.3开源刷新编程&安全双基准——国产AI「定价权」博弈进入新阶段。
事件来源
OpenAI代号Doug项目曝光:重启大规模底座预训练,突破GPT-4o系列能力上限,优先级提至最高ITBear
DeepSeek V4 Pro(满血版)与xAI Grok 4.6同日发布,性能接近但价格差距10x量级,中美AI正面交锋ITBear
腾讯混元Hy3在多项综合评测榜单登顶,多模态推理能力获第三方验证lpnh.cn
Z.ai发布GLM-5.3开源大模型,编程和网络安全基准双线刷新,开源安全AI新里程碑腾讯新闻
阿里Qwen3.8-Max正式全量开放,2.4T参数面向所有用户百家号
字节Seed Audio发布高质量音频生成模型,多模态统一时代加速lpnh.cn
AI Coding

AI Coding本周动态

Claude Code Auto Mode默认开启;GLM-5.3安全代码基准刷新;大模型「执行力」全面释放——AI Coding从辅助走向自主。
事件来源
Anthropic将Claude Code Auto Mode设为默认开启,最高自主执行模式正式成为标准工作流CSDN
GLM-5.3刷新HumanEval/SWE-bench等编程基准,开源代码AI能力进入「专项超越闭源」阶段腾讯新闻
「AI集体长出双手」:大模型从语言能力全面转向代码执行、工具调用与Agent自主运行头条
CPU战略地位回升:AI推理算力格局重构,2030年CPU与GPU「平分秋色」预测发布ITBear
AI应用

AI应用本周动态

AI音乐「OMG你吓到我了」火遍全网;2026年AI竞争真正底牌是「电与光」;大模型多模态与具身智能全面演进。
事件来源
AI音乐「OMG你吓到我了」火遍全网,AI生成音乐商业化场景快速成型,用户接受度大幅提升新浪财经
分析:2026年AI真正的核心底牌是「电与光」——电力基础设施和光通信成AI算力核心瓶颈头条
大模型、多模态与具身智能:AI正在翻开全新序章——三大方向同步演进头条
字节Seed Audio发布高质量音频AI,AI音乐与音频内容创作进入专业级工具时代lpnh.cn
AI行业

AI行业本周动态

宇树科技成A股首家人形机器人上市公司;中国大模型掀翻硅谷定价逻辑;2026年AI竞争从效率内卷转向「规模重启+Agent化」双线并进。
事件来源
宇树科技正式登陆A股,成中国首家人形机器人上市公司,具身智能商业化里程碑落地新浪财经
中国大模型掀翻硅谷定价逻辑:国产模型在性能接近的情况下价格已成行业新基准新浪财经
物理AI正从展台奔赴真实产业「战场」,机器人在制造、物流、医疗场景快速渗透新浪科技
「8月AI大模型分水岭」:三家公司千亿融资,一场正在改写的全球AI竞赛头条
爱芯元智下一代大算力AI芯片完成流片,支持多芯级联实现边缘侧满血大模型推理新浪科技
企业转型

企业AI转型本周动态

国产大模型加速迭代,国内AI产品迎来集中突破期;AI推动数码配置升级,技术降本与配置升级博弈加剧。
事件来源
国产大模型加速迭代,国内AI产品迎来集中突破期——AI应用渗透率快速提升百家号
AI推动数码配置升级:技术降本与配置升级博弈,价格锚点重校正在进行中ITBear
可灵AI多名核心研发相继离职,千问推出付费服务——国产AI应用层竞争格局分化加剧搜狐
调查:全球科技巨头AI加速抢占韩国搜索市场,NAVER等本土服务面临显著差距——AI搜索替代加速新浪科技
日报索引

本周日报索引

2026-08-10
周一
字节5T超级AI·开源生态国际关注·国产大模型调用量领先·8月AI分水岭
字节5T超级AI·开源生态国际关注·国产大模型调用量领先·8月AI分水岭
2026-08-11
周二
OpenAI代号Doug重启底座预训练·8周连发5个大模型·中美AI差距判断·千亿融资
OpenAI代号Doug重启底座预训练·8周连发5个大模型·中美AI差距判断·千亿融资
2026-08-12
周三
OpenAI Doug新项目·AI音乐火遍全网·大模型日报8月11日
OpenAI Doug新项目·AI音乐火遍全网·大模型日报8月11日
2026-08-13
周四
大模型多模态具身智能新序章·大模型新品密集爆料·开源工具集中释放
大模型多模态具身智能新序章·大模型新品密集爆料·开源工具集中释放
2026-08-14
周五
Claude Code Auto Mode默认开启·宇树A股首家机器人上市·AI集体长出双手·CPU战略地位回升
Claude Code Auto Mode默认开启·宇树A股首家机器人上市·AI集体长出双手·CPU战略地位回升
2026-08-15
周六
混元Hy3登顶·字节Seed Audio·DeepSeek V4 Pro+Grok 4.6同日发布·GLM-5.3开源·可灵AI离职潮
混元Hy3登顶·字节Seed Audio·DeepSeek V4 Pro+Grok 4.6同日发布·GLM-5.3开源·可灵AI离职潮
2026-08-16
周日
中国大模型掀翻硅谷定价逻辑·物理AI产业战场·GLM-5.3详解·正面硬碰硬中美AI新模型
中国大模型掀翻硅谷定价逻辑·物理AI产业战场·GLM-5.3详解·正面硬碰硬中美AI新模型
技术词汇

技术词汇表

术语定义
代号DougOpenAI内部新底座预训练项目的代号,由前OpenAI核心研究员Doug主导,目标是突破GPT-4o系列的能力天花板,重新建立更强的底座模型。
物理AI (Physical AI)指在物理世界中执行实际动作的AI系统,区别于纯语言/图像AI。以机器人、自动驾驶为代表,需要感知-推理-执行三层能力集成,宇树科技是典型代表。
CyberSecEvalMeta开发的AI安全能力评估基准,测试模型在网络安全场景(漏洞分析、渗透测试、安全代码生成等)的综合能力。GLM-5.3本周刷新开源模型纪录。
Dark Factory软件工程领域概念,指无需人工干预、完全由AI Agent自主构建和迭代的「黑暗工厂」。Training Data播客本周详细讨论这一趋势正在从概念变为现实。
宏观叙事

宏观叙事:「行动力」觉醒:AI从语言到执行的历史性转折

如果说2025年是大模型「说得更好」的一年,2026年W33标志着一个新的拐点:AI正在集体「长出双手」。
三条线索同时发生。第一条:OpenAI承认现有模型触及天花板,重启底座预训练——这是业界最强玩家主动宣告「当前范式已到极限」。第二条:DeepSeek V4 Pro用十分之一的价格正面对抗Grok 4.6,中国AI的「定价权博弈」从效率竞争升级为市场话语权争夺。第三条:宇树科技A股上市、Claude Code Auto Mode默认开启、物理AI奔向产业战场——AI的「执行力」在同一周从代码层、产品层、硬件层同时爆发。

W33的核心信号是:AI产业正在经历从「技术突破期」到「商业重写期」的转折。下一个12-18个月,预训练军备竞赛重启+Agent化全面落地+具身智能商业化加速,将同步展开。这不是线性增长,是多维度的非线性跃迁。