老董的视界深处

· 浙商证券 · 公司/行业基本面

计算机行业周报:前沿模型密集迭代,国产模型量价齐升

摘要公开阅读;PDF 仅限有效会员阅读与下载,所有会员权限相同。 邮件登录

摘要

本周(2026.08.29—2026.09.04)前沿模型集体迭代,能力提升与单位成本下降同步进行:OpenAI 发布 GPT-6 Astra,ARC-AGI-3 得分 99.9%、Terminal-Bench 4.0 准确率 57.9%,定价每百万输入/输出 Token 10/50 美元;Anthropic Fable 5.1 缓存读取价格降低 75%,典型工作负载成本较 Fable 5 低约 25%;Gemini 3.8 Flash 能力改进而价格与上代持平;Qwen3.8-Max-0902 以 1691 分登顶 CodeArena 前端编程总榜。 但 Fable 5.1 发布后 48 小时 OpenRouter token 用量较 Fable 5 同期低 66.6%,版本更新对调用量的拉动作用减弱,且 OpenAI 和 Anthropic 企业收入中 80% 来自 1% 的客户。 智谱 26H1 总收入约 9.54 亿元、同比增长近 400%,API 收入占比由去年全年的 26.3% 升至 86.5%,Token 调用量较年初增长超 40 倍、API 平均售价提高约 101%,国产芯片实现 10 万级规模化低成本推理、单位 token 推理成本较年初下降 80%。 多模态开始承担完整内容生产:芒果 TV AIGC《后西游记》100% 由 Seedance 2.0、Seedance 2.5 提供技术支持并亮相湖南卫视黄金档,MiniMax H3 Max 生成 5 秒 768p 音视频用时不到 3 秒、跨过实时直播速度门槛。 端侧探索扩围至机器人本体与 AI 眼镜,计算机行业评级维持看好。

主要观点

  • 前沿模型集体迭代,能力升级不再以单价上调为对价,厂商转而通过缓存定价、架构优化与针对性后训练降低单位任务成本。
  • Anthropic 发布 Claude Fable 5.1 与 Mythos 5.1(同一模型、不同安全防护措施),缓存读取价格降低 75%(0.25 美元/1M Tokens),典型工作负载成本较 Fable 5 低约 25%,高度 Agentic 工作最高节省约 45%;并联合金融、医疗等行业的 100 多个客户开发 EFS,数据可存储在客户自有云。
  • Google 与阿里同步迭代:Gemini 3.8 Flash 在软件工程、代理任务及复杂多步推理显著改进而价格与 3.7 Flash 相同(每百万输入/输出 0.75/3.75 美元),3.8 Flash Cyber 在漏洞检测与自动化补丁安装领先并通过 Fairwind 计划受限提供;Qwen3.8-Max-0902 围绕 Coding 和 Cowork 后训练,CodeArena 前端编程总榜提升至 1691 分夺得冠军,并以 5 美元/1M Tokens 综合平均成本进入性价比帕累托前沿。
  • 智谱收入结构完成切换:26H1 总收入约 9.54 亿元、同比增长近 400%,开放平台及 API 业务收入约 8.25 亿元(+2,735.7%),收入占比由去年全年的 26.3% 升至 86.5%;本地化部署收入 1.29 亿元(−20.5%),占比由 73.7% 降至 13.5%;截至 8 月 31 日 MaaS 平台 ARR 达 16 亿美元,按周度收入年化计达 20 亿美元。
  • 国产芯片降本取得显著成效:智谱已将国产芯片纳入主力推理算力,实现 10 万级国产芯片的规模化低成本推理,单位 token 推理成本较年初下降 80%;净亏损 20.72 亿元,较去年同期收窄 12.1%。
  • 调用量与售价同时上行:截至 8 月末 Token 调用量较年初增长超 40 倍(其中 Coding Plan 增超 23 倍),同期 API 平均售价提高约 101% 且 Coding Plan 订阅价格上调;MaaS 用户由 6 月末超 580 万增至 8 月末超 740 万,付费日活较年初增长 603%,国产模型在 Coding 与 Agent 等高价值场景议价能力改善。
  • 分发渠道延伸至消费级入口:智谱 9 月 2 日在天猫开设官方旗舰店,上架 GLM Coding Plan 个人版 Lite、Pro、Max 和团队版标准席位;淘宝天猫随后上线集合阿里云、智谱、MiniMax、Kimi 和 DeepSeek 等订阅及充值产品的 AI 空间站。
  • 多模态开始承担可播出、可直播的完整内容生产:芒果 TV AIGC 神话长剧《后西游记》8 月 31 日登陆芒果 TV 并亮相湖南卫视黄金档,100% 由 Seedance 2.0、Seedance 2.5 提供技术支持;MiniMax H3 Max 生成 5 秒、768p 音视频用时不到 3 秒、跨过实时直播速度门槛,海外开发者已搭出 Twitch 直播与 24 小时 AI 电视台;千问创作上线 Agent Teams,首发接入 Wan 3.0 并同步上线 Wan3.0 Prime,由编剧、导演、美术等多角色 Agent 分工完成视频生产全流程。
  • 端侧探索扩围至机器人本体与 AI 眼镜:Sam Altman 首次确认 OpenAI 将开发自有的人形机器人本体;阿里 Qoder 上线眼镜版,首批接入千问 AI 眼镜和乐奇 AI 眼镜,用户无需打开手机即可通过语音让 Agent 执行任务;努比亚 NaviX Ultra 入网,搭载豆包手机助手的机型计划 9 月开售;端侧竞争重点由硬件形态展示转向 Agent 在端侧的任务执行入口。
  • 厂商其他动态与行业数据:字节跳动拟将银团贷款由 200 亿美元扩大至 296 亿美元(2026 年亚洲第二大美元计价银团贷款),正在评估将 2026 年资本支出预算提升至最高 700 亿美元,豆包大模型 2.2 或将推迟面世;千问办公上线 1 个月用户突破 3,000 万、企业用户占比超 50%;Kimi API 原生兼容 OpenAI Responses API 与 Anthropic Messages API;OpenAI 终止向 Cursor 提供模型并拟于 11 月 12 日关停,ChatGPT Ads 年化收入运行率达 10 亿美元(上线不足 200 天);行业整体 6 月中国日均词元调用量超 500 万亿、7 月底全国智算规模 245 万 PFLOPS(FP16)。

论述逻辑

  • 本周 GPT-6 Astra、Fable 5.1、Gemini 3.8 Flash、Qwen3.8-Max-0902 密集发布 → 评测能力大幅提升的同时定价未上调甚至下降 → 报告推断能力代际提升已不再以单价上调为对价,厂商转而依靠缓存定价、架构优化与针对性后训练降低单位任务成本。
  • 智谱半年报显示 API 收入占比由 26.3% 升至 86.5%、总收入同比增长近 400% → Token 调用量较年初增超 40 倍且 API 均价提高约 101% → 量价齐升 → 收入主体由项目制本地化部署转为平台化 API 与订阅,国产模型在 Coding 与 Agent 等高价值场景议价能力改善。
  • 国产芯片纳入主力推理算力并实现 10 万级规模化 → 单位 token 推理成本较年初下降 80% → 国产芯片降本成效显著,支撑模型商业化放量。
  • 多模态验证场景由评测推进到可播出、可直播内容:H3 Max 生成 5 秒 768p 音视频用时不到 3 秒、生成速度快于播放速度 → 跨过实时直播门槛 → 应用形态由生成素材扩展至持续供给内容流,商业化约束由生成质量转向生成速度、成本与流程完整度。
  • 端侧方面:OpenAI 确认自研人形机器人本体、Qoder 上线眼镜版、努比亚搭载豆包手机助手 → 端侧 AI 由硬件形态与参数展示转向 Agent 能否在端侧稳定获取任务、调用工具并完成执行。

关键展望

  • 后续验证点:字节跳动将于 9 月 15 日召开飞书未来无限大会暨豆包工作开工大会;豆包大模型 2.2 原计划 8 月推出、或将推迟面世以换取更明显的能力提升。
  • 后续验证点:Qoder 眼镜版已开启定向邀测,完整功能将于 2026 云栖大会正式发布;努比亚搭载豆包手机助手的机型计划 9 月开售。
  • 后续验证点:OpenAI 决定逐步终止向 Cursor 提供模型、拟于 11 月 12 日关停,并已按合同约定最长期限提前通知;Cursor 联合创始人回应称 OpenAI 模型仅占 Cursor 用户流量的约 5%,双方仍在沟通解决方案。
  • 趋势判断:头部厂商后续增长更多取决于新客群与新场景的拓展,而非单一版本迭代;多模态商业化约束转向生成速度、成本与流程完整度;端侧重点转向 Agent 任务执行入口。
  • 风险提示:技术迭代不及预期;Agent 商业化变现不及预期;多模态内容商业化不及预期;端侧硬件落地不及预期;算力供给及资本开支压力超预期;头部厂商竞争加剧。

推荐标的

  • 行业评级:维持计算机行业看好评级(评级标准为报告日后 6 个月内行业指数相对沪深 300 指数表现 +10% 以上)。
  • 报告未明确给出推荐标的:本篇为行业周报,仅维持计算机行业整体看好评级,未列出个股评级或目标价;报告提及的 OpenAI、Anthropic、Google、智谱、阿里、字节跳动、MiniMax、Kimi 等厂商均为事件与数据梳理,不构成覆盖评级。

查找相关研报 →