机构:多模态落地与Agent规模化带动训练、推理算力需求长期刚性扩张
KimiK3与千问Qwen3.8等国产模型的接连突破,不仅是参数和榜单数字的跃升,标志着中国AI产业进入新阶段。
8月3日,开源证券发布了一篇科技行业的研究报告,报告指出,模型收敛趋势加剧,高端卡紧缺,成熟卡价格重估。
模型:Claude4.6/4.8级别区间竞争愈加拥挤,中美模型差距持续收窄
2026年7月全球AI产业进入“前沿模型密集迭代+Token经济加速放量+资本市场高波动再定价”三线并行阶段。模型层面,7月上半月先后出现腾讯Hy3正式版、SpaceXAIGrok4.5、OpenAIGPT-5.6、MetaMuseSpark1.1、月之暗面KimiK3等关键节点,模型竞争焦点已从早期参数规模竞赛进一步转向Agent能力、长上下文、单位Token智能密度、推理效率与成本结构的综合竞争。
ARR&Agent跟踪:头部大模型ARR增长斜率短期有所波动,codex突破千万周活用户,腾讯WorkBuddy初露锋芒
ARR:7月份因为OpenAI发布GPT-5.6并为了获取codex用户量,多次重置套餐、加大价格战竞争,ARR一阶导或有所回落,造成短期数据波动,但月度增长基本维持10+B美元的增长水平。我们认为,模型收敛是当前的竞争趋势,但scalinglaw仍然是大模型的成长主线,SOTA模型相继发布将扩大前沿AI应用场景,有望持续推动ARR的增长斜率上行。
Agent:GPT-5.6推出后,在其性价比优势及OpenAI官网多次重置的背景下,ChatGPTWork和Codex的每周活跃用户数达到1000万,比一周多前的600万增长了67%,比3月份增长了5倍。根据易观分析2026年6月中国桌面端AI原生办公智能体监测数据,腾讯WorkBuddy以2097万月度访问量位居行业首位,显著高于第二名TRAEIDE(国内版,1279万),拉开清晰的第一梯队优势。
算力:海外GPU租赁价格及Token消耗量显示需求仍强
2026年7月算力侧关注核心在于模型效率提升和价格战持续的情况下,Token需求是否仍然快于单位成本下降。短期需求弹性仍强,一方面,DeepSeek、MiniMax、GLM等模型通过MoE、SparseAttention、GQA、投机解码等方式持续压低单位推理成本;另一方面,编程、生产力、Agent、多模态任务正把总调用量推向更高数量级。中长期仍需关注Blackwell放量、H100代际下沉及模型效率提升从而带动部分通用推理场景的卡需求紧张缓解。
投资建议
KimiK3与千问Qwen3.8等国产模型的接连突破,不仅是参数和榜单数字的跃升,标志着中国AI产业进入新阶段,有力地证明了开源模型的天花板同样很高,在国际竞争力进一步提升,在性能和成本的平衡下有望打开全球AI需求天花板。
模型端:需求天花板提升,推荐标的智谱,受益标的minimax、德适-B。
算力端:多模态落地与Agent规模化带动训练、推理算力需求长期刚性扩张,推荐标的阿里巴巴、百度集团-SW、联想集团,受益标的腾讯控股、天数智芯、中芯国际。
风险提示:软件及产品推出不及预期,产能及供应链风险,监管政策变动,宏观经济增长放缓,地缘政治风险。

