跳到主内容
AI INSIGHT · DAILY REPORT

AI 日报 · 2026年7月4日

周六 海外 9条 · 国内 8条 五大板块
覆盖均衡
海外 9条 🇨🇳 国内 8条
全文概览
🧠大模型
美团LongCat-2.0:全链路零英伟达万亿模型+DeepSeek V4-Pro SWE-bench 80.6%开源最强+OpenRouter中国模型连续6周称霸
⌨️AI Coding
Cursor年收入飙至20亿美元估值500亿+Claude Code vs Cursor 2026开发者最新使用报告+AI编程三巨头合计月活超1500万
📱AI应用
阿里整合三大企业Agent由92后CEO统一操盘+天工3.2 Skywork Tags让Agent入驻群聊工作环境+可灵AI戛纳创意节斩获1银2铜
🏭AI行业
Meta筹建云算力业务直怼三大云巨头+全球GenAI年入1100亿美元勉强跨过折旧线+Palantir CEO炮轰OpenAI收费模式是「财富税」
🏢企业转型
72%企业完成智能体试点并投入使用+企业挑战从「缺算力」转向「效果不达预期+ROI不明确」+上海AI Lab 35B Agents-A1逼近万亿模型
热度趋势
7月4日最大变量:①美团LongCat-2.0横空出世——1.6万亿参数MoE,全链路跑在5万张国产卡上,零英伟达含量,其匿名版本Owl Alpha已在OpenRouter月调用登顶,这不是PPT,是已被全球开发者真实流量验证的万亿模型;②Meta筹建「Meta Compute」云算力业务,消息一出CoreWeave暴跌14%,市场在用脚投票——AI下半场赢家或是算力最多的人,不是模型最强的人;③阿里三大企业Agent合并由92年CEO统一操盘,QoderWork日活居首是整合基础,这是中国桌面Agent竞争进入洗牌期的信号;④Palantir CEO公开炮轰OpenAI、Anthropic按token收费是「财富税」——几乎每位企业高管私下都很愤怒,一旦集体不再相信这套逻辑,AI高估值体系可能松动。信号:国产算力路线今天迎来里程碑时刻,LongCat-2.0证明「去英伟达」不是口号而是工程现实;同时AI变现逻辑正遭遇来自企业客户的根本性质疑。
排名话题热度天数趋势核心信号
🥇 国产算力主权化
1天 📈 攀升 今日新热点
🥈 AI商业模式质疑
1天 📈 攀升 今日新热点
🥉 企业Agent整合洗牌
1天 📈 攀升 今日新热点
4️⃣ AI Coding三巨头竞争
3天 ➡️ 持平 持续关注中
5️⃣ GenAI收入变现
3天 ➡️ 持平 持续关注中

大模型
1 最近动态
海外
DeepSeek V4-Pro(1.6T总参数/49B激活)在SWE-bench Verified达80.6%,并列开源权重最高分,与Gemini 3.1 Pro并列。每百万output token仅$0.87,比Claude Opus 4.8便宜28.7倍,比GPT-5.5便宜34.5倍。V4-Flash(284B/13B激活)$0.28/M output,两者均默认1M上下文,384K最大输出。
Greg Brockman表示AGI最理想界面是对话,未来用户只需与持久存在的智能体交流。2023年插件功能彻底失败(上下文仅2K-4K),如今能力才足以将海量工具放到「指尖」。他判断算力将长期供不应求,今天的顶级智能一年后会沦为廉价品,逼厂商持续研发前沿模型。
NEW 全球生成式AI年入1100亿美元,勉强跨过折旧线 腾讯研究院AI速递(微信)
Exponential View综合超千家公司数据:过去12个月全球GenAI真实收入1100亿美元,年化运行率超1750亿美元。Q1 2026季度收入250亿,连续两季超芯片+数据中心折旧(210亿),但仅「勉强跨过」。价格两年降数百倍收入仍增200%(杰文斯悖论);电力短缺与折旧年限争议令此平衡极脆弱。
🇨🇳 国内
美团发布LongCat-2.0,总参数1.6万亿、激活~48B,原生1M上下文,首个从训练到推理全链路跑在国产算力上的万亿模型(5万张国产卡)。匿名版Owl Alpha此前在OpenRouter月调用多场景登顶,已通过真实流量验证。LSA稀疏注意力+N-gram Embedding,训推成本显著低于英伟达路线。
上海AI Lab推出35B MoE模型Agents-A1,靠扩展Agent Horizon而非堆参数,在多步搜索、科学研究、长指令遵循等长程任务上逼近万亿级模型。三阶段训练:全领域SFT→领域级教师训练→多教师on-policy蒸馏。实测12小时内将鲸鱼叫声检测AUC从0.58提升至0.9935。
昆仑万维旗下天工AI业务年化经营收入(ARR)突破8亿美元,向中国首个非BAT系10亿美元ARR的AI公司目标迈进。天工3.2同期推出Skywork Tags群聊Agent功能,持续在Agent产品形态上差异化突围,ARR高增长背后是天工在对话+Agent+工具链多维度的持续投入。
深度聚焦
LongCat-2.0:国产算力路线的万亿模型里程碑

美团LongCat-2.0的出现不是技术发布,而是一个工程存在证明:全链路跑在5万张国产卡上的1.6万亿参数MoE模型,从训练到推理零英伟达含量。过去国产算力路线更多是战略备份,今天它成了生产事实。这对中国AI产业的含义:去英伟达不再是「如果能做到」,而是「已经做到了」。

Owl Alpha提前验证是关键变量。LongCat-2.0并非凭空发布,其匿名版本已在OpenRouter多场景月调用登顶,全球开发者在不知道它是国产卡训出来的情况下,用真实任务投了票。这种验证路径比任何基准分数更有说服力——它绕开了「benchmark goodheart」陷阱。

DeepSeek V4-Pro同期以SWE-bench 80.6%并列开源最强,$0.87/M output比Claude Opus 4.8便宜28.7倍。两个中国模型同日拿下不同维度的最强开源权重,这不是巧合——是中国大模型技术积累在2026年中密集兑现的缩影。

TAKEAWAY
对某公司AI生产力中心的直接意义:国产算力主路线评估应该提上议程。不是「是否考虑」,而是「何时做真实成本测算」。LongCat-2.0的训推成本数据一旦公开,将成为采购决策的重要参考基准。
📊 模式洞察
中国大模型竞争格局正在分化:性价比战场(DeepSeek/MiniMax)已基本确立优势,算力主权战场(LongCat-2.0)今天迎来里程碑。下一个分化点:谁能在真实Agent长程任务中稳定工作?这是价格战之外的第二赛道。
AI Coding
2 最近动态
海外
Cursor(Anysphere)融资:Thrive Capital+a16z+英伟达领投,估值500亿美元,年收入飙至20亿美元,预计年底冲60亿。三巨头月活合计超1500万。Claude Code赢在自主多文件工作与代码质量;Cursor赢在AI-native IDE体验;Copilot 2026年6月1日全面切换AI Credits按量计费。
UC San Diego+Cornell调研99名专业开发者,29人同时使用Claude Code+Copilot+Cursor。最热门组合:Cursor Pro+Claude Code Pro($40/月)。Claude Code赢在自主多文件工作与代码质量;Copilot赢在有免费tier;Cursor赢在完整AI-native IDE体验。
开源AI编程框架OpenSquilla发布0.4.0版本,实现AI写代码后自我验证的完整闭环,是AI Coding从「生成」到「验证」的关键能力跃迁。上线数周内GitHub star增至数千量级,开发者社区高度关注。这一能力对减少人工review负担、提升代码质量有直接价值。
🇨🇳 国内
CSDN实测Trae综合评分9.8,代码生成准确率98%,中文适配9.8,性价比9.9(基础版永久免费,Pro约$10/月,仅Cursor一半),Agent能力9.6。突破600万注册用户。支持Claude 3.5/GPT-4o/豆包多模型切换,VS Code一键迁移,CUE智能预测Tab键即用。
深度聚焦
AI Coding进入资本验证阶段:Cursor 500亿美元,这是终局还是开始?

Cursor 2026年4月融资:Thrive Capital+a16z+英伟达领投,估值500亿美元,年收入从0飙至20亿美元(预计年底60亿)。这个数字告诉我们:市场已经对「AI-native IDE」的商业模式投了置信票。但500亿估值意味着什么?它意味着投资人在押注Cursor能占据开发工具市场相当大份额,而微软(Copilot)和Anthropic(Claude Code)会让出这个空间。这个假设有多可靠,值得打问号。

三巨头分层已经清晰:Claude Code主打复杂推理和多文件重构(能力上限最高,性价比最低,无IDE界面);Cursor主打完整AI-native IDE体验(能力强+体验好,价格居中);Copilot主打零迁移成本(装插件即用,能力上限低,2026年6月切换AI Credits按量计费)。调研显示最热门组合是Cursor+Claude Code Pro($40/月),29名开发者同时用三款工具——这说明它们在满足不同层次需求,而非直接竞争。

Trae是中国维度的变量:600万注册用户,基础版永久免费,Pro约$10/月(是Cursor的一半),中文适配9.8,综合评分9.8。对国内开发者而言,Trae已经是可以认真考虑的选项,尤其在「国内网络访问稳定性」和「中文语境适配」上有系统性优势。

TAKEAWAY
Cursor 500亿估值的核心赌注是:开发工具市场的价值分配会向AI-native工具转移。如果这个方向成立,Agent平台的研发Agent能力需要认真思考「是做工具层还是做工作流层」——前者与Cursor竞争,后者与Cursor互补。
📊 模式洞察
AI Coding工具格局:能力(Claude Code)× 体验(Cursor)× 价格(Copilot/Trae)三个维度分别有领导者。市场不收敛到一个赢家,而是形成组合使用生态——这对Agent平台研发Agent定位的启示:找到「组合中缺失的那一环」。
AI 应用
3 最近动态
海外
戛纳国际创意节首设AI Craft子赛道,可灵AI助力两部广告获奖。《L'Ultimo Uomo Reale》银奖+铜奖(几乎全程AI生成,仅手提包实拍),《Lorem Ipsum》铜奖(三段迥异风格角色只说占位词,靠表情张力叙事)。标志AI影像已被顶级评奖体系当作创作工艺审视而非技术噱头。
据量子位报道,新一代AI眼镜产品已实现不依赖手机独立运行,标志端侧AI硬件从「手机附属」进入「独立计算」形态。结合低功耗推理芯片进步,AI眼镜有望成为继手机之后的下一个AI交互主入口。这一趋势对某公司短视频和直播生态的内容创作工具方向有长期布局价值。
🇨🇳 国内
阿里确认合并QoderWork+悟空+MuleRun三款企业Agent,QoderWork(日活和Token用量居首)为基础,由6月新任钉钉及悟空事业部CEO的92年陈宇森全面负责。定位「OS级」桌面智能体,未来形成桌面+云端+组织三层融合。背景:集中内部资源应对桌面Agent竞争加剧。
昆仑万维天工3.2推出Skywork Tags,支持在Slack、飞书、钉钉、Discord、Telegram中@互动,让团队共享同一Agent。官方实验:百人群组共享Agent两三周后反超精调个人版(上下文更丰富=变强最短路径)。主打进度透明+异步接力+越用越强三大差异点。
深度聚焦
阿里Agent整合:QoderWork胜出背后的产品逻辑

阿里把三款企业Agent(QoderWork+悟空+MuleRun)合并,选择以QoderWork为基础,原因只有一个:日活和Token用量居阿里AI工具之首。这是一个典型的「以数据说话」的产品决策——不是哪个最符合战略定位,而是哪个用户已经在用。

92年CEO陈宇森直接负责整合,这个人事安排本身是信号:阿里在桌面Agent竞争上的紧迫感已经到了需要「创业者心态」的程度。QoderWork被定位「OS级」桌面智能体,未来形成桌面+云端+组织三层融合——这个框架和微软Copilot的战略几乎重叠。

天工3.2 Skywork Tags走了完全不同的路:不做独立Agent,而是让Agent进驻用户已有的工作环境(Slack/飞书/钉钉/Discord/Telegram)。官方实验显示百人群组共享Agent两三周后反超个人精调版——因为上下文更丰富。这是「环境适应」策略vs「创造新环境」策略的典型对比。

TAKEAWAY
可灵AI戛纳拿奖是一个文化信号:AI影像从「技术展示」进入「创作工艺」评估体系。这对某公司主站的AI创作工具而言是需要关注的方向——顶级评奖体系认可AI影像,意味着专业创作者的接受度在加速。
📊 模式洞察
企业Agent整合趋势加速:阿里合并3个,桌面Agent竞争从「谁能做」进入「谁能活」。胜出标准不是功能最全,是日活和Token用量。AI洞察的产品策略启示:日活比功能列表更重要,用量是护城河。
AI 行业
4 最近动态
海外
Meta正筹建「Meta Compute」,对外出售AI算力与模型访问权限,效仿xAI算力出租模式。消息出:Meta股价涨超10%、市值增近千亿;CoreWeave暴跌14%、Nebius跌17%。被视为信号:AI下半场最终赢家或是攥有最多数据中心者,而非做出最强模型者。
Alex Karp公开质疑:按token收费=卖算力,非卖智能。客户把工作流和机密数据喂给模型,反而在训练取代自己的系统。他称「财富税」:几乎每位企业高管私下都很愤怒却不敢公开发声,一旦集体不再相信这套逻辑,整个AI行业高估值体系可能松动。
开源项目AReaL 2.0发布,专注打造面向自演进智能体的强化学习(RL)基础设施,目标是让Agent在实际使用中持续优化自身能力(越用越强)。这是AI Agent从「静态部署」到「动态自进化」的重要基础设施方向,对某公司AgentOS自进化能力建设有直接参考价值。
🇨🇳 国内
艾瑞咨询2026年6月报告:中国AI Agent应用市场H1规模突破320亿元,同比增长68%,端侧AI营销和AI互动营销成增长最快赛道。沙利文发布2026年中国AI Agent最佳实践榜单,研究重心从「技术概念」转向任务完成率、业务ROI、系统稳定性、数据安全和权限边界。
深度聚焦
Meta Compute + Palantir炮轰:AI商业模式的两个裂缝

Meta筹建「Meta Compute」的冲击不在于又多了一家云厂商,而在于它让CoreWeave暴跌14%、Nebius跌17%。市场的判断是:如果AI巨头们开始自建算力并对外销售,独立算力租赁商的护城河就只剩「比巨头早几年建好」。Meta此举是在告诉市场:AI下半场最重要的资产不是模型算法,而是物理算力和电力基础设施。

Palantir CEO Alex Karp的「财富税」论断直接攻击了OpenAI/Anthropic的定价逻辑:按token收费=卖算力,不是卖智能;客户把工作流和机密数据喂给模型,是在训练取代自己的系统。他说「几乎每位企业高管私下都很愤怒」——这个表述值得认真对待。B端客户的愤怒一旦变成集体行动(自建/采用开源/切换供应商),整个AI高估值体系的支柱会动摇。

全球GenAI年入1100亿美元「勉强跨过」折旧线是另一个裂缝:价格降了数百倍,收入仍增200%,说明需求是真实的;但「勉强跨过」说明当前收入规模是脆弱的盈利平衡,电力短缺或折旧政策变化都可能让这条线重新掉到水下。

TAKEAWAY
三个信号叠加(Meta建云、Palantir炮轰、GenAI收入勉强回本)指向同一个结论:AI商业化的「顺风期」可能正在结束,进入「成本与收益真实较量」的新阶段。这对某公司AI生产力中心的价值展示要求更高——模糊的「提升效率」说法将越来越难说服決策者,需要硬数字的ROI。
📊 模式洞察
AI行业正在经历「信仰测试」:全球GenAI收入勉强回本,企业客户开始质疑按token收费的正当性。下半年的核心命题:谁能用真实ROI数据说话,谁就能在质疑声中活下来。
企业AI转型
5 最近动态
海外
Gartner最新预测:2028年33%企业软件内嵌Agentic AI,15%日常工作由AI自主决策,每家500强平均部署150,000个AI Agent。Google Cloud覆盖3466名决策者:52%企业已有活跃Agent部署,88%报告正向投资回报。麦肯锡估计Agentic AI每年可创造2.6-4.4万亿美元价值。
WorldClaw与百度智能云达成战略合作,文心5.0系列模型登陆WorldRouter平台。WorldRouter作为新兴的多模型路由层,此次合作标志着文心系列在开放生态渠道的重要布局。对企业客户而言,多模型路由器的成熟意味着采购决策从「绑定单一厂商」转向「按任务择优路由」。
🇨🇳 国内
《企业CIO行动指南2026》调研620名决策者:72%完成试点并正式使用,平均在3.5个场景部署Agent,计划2026年扩展至6.7个场景。核心转变:动因从「降本提效」(59%)转向「驱动主营增长」(67%);挑战从「缺乏算力数据」转向「应用效果不达预期+ROI不明确」。63%计划招募AI+行业跨界复合型专家。
深度聚焦
72%企业完成试点但主挑战转向「效果不达预期」:企业AI进入深水区

联想IDC调研620家国内企业的核心发现:AI落地挑战已从2024年的「缺算力缺数据」转变为「应用效果不达预期+ROI不明确+缺少成熟流程方法论」。这个转变是一个成熟度信号——从「能不能做」到「值不值」。当前72%企业已完成试点并正式使用,企业平均在3.5个场景部署Agent,计划2026年扩展至6.7个场景。

动因变化更值得关注:「驱动主营增长」(67%)首次超过「降本提效」(59%)成为首要动因。这说明企业对AI的期望已经从「工具」升级为「增长引擎」。但同时,「效果不达预期」成为最大挑战——期望越高,落差越大的风险也越大。

Gartner 2026年预测更激进:2028年每家500强将平均部署150,000个AI Agent,33%企业软件将内嵌Agentic AI,15%日常工作由AI自主决策。Google Cloud调研显示88%已部署Agent的企业报告正向ROI。但「已部署」与「规模化且ROI可量化」之间仍有巨大鸿沟。

TAKEAWAY
对某公司AI生产力中心的直接启示:企业客户已经越过了「愿不愿意用AI」的阶段,进入「用AI的ROI是否可量化」的阶段。这意味着我们对外展示的不能只是「案例成功」,而必须是「可量化、可复制的ROI数据」。这是下半年影响力扩展的核心命题。
📊 模式洞察
企业AI落地进入「深水区」:挑战从「技术能不能做」转向「ROI怎么证明」。63%企业计划招「AI+行业」复合型专家——这是市场在用人才需求投票,告诉我们AI生产力工作的核心不是技术,而是「如何让AI在真实业务中产生可量化价值」。
深度洞察

AI洞察视角:今天最值得深思的是两条看似矛盾的信号同时出现。

第一条:美团LongCat-2.0证明国产算力路线在万亿模型规模已经走通。5万张国产卡,LSA稀疏注意力+N-gram Embedding,成本显著低于英伟达路线。对某公司AI生产力中心而言,这意味着未来采购决策中,国产算力不再是「备胎」,而是可以认真评估的主路线。

第二条:Palantir CEO的「财富税」论断,直接挑战了AI商业模式的正当性。按token收费 = 卖算力,客户把工作流和数据喂给模型 = 在训练取代自己的东西。这个逻辑如果被企业客户广泛接受,对所有按调用量收费的AI产品(包括AI洞察积分制)都是需要认真对待的信号。反制逻辑只有一个:用真实ROI说话,而不是模糊的「提升效率」。

阿里三大Agent合并值得作为案例研究。QoderWork+悟空+MuleRun的整合,和某公司AI生产力中心的产品整合思路高度相似——分散的Agent很难形成用户心智,统一入口才能建立护城河。6月底的选择是QoderWork而非悟空,核心逻辑是日活和Token用量。这个决策标准值得参考。