老董的视界深处

· 浙商证券 · 公司/行业基本面

浙商证券 计算机行业周报:DeepSeek再升级,OpenAI实现自动化研究实习生

摘要公开阅读;PDF 仅限有效会员阅读与下载,所有会员权限相同。 邮件登录

摘要

浙商证券发布2026.09.05—09.11计算机行业周报,维持行业“看好”评级。 本周DeepSeek发布552B参数MoE模型V4.1 Flash,采用输入/输出不对称的Causal-Encoder-Decoder结构(输入激活8B、输出16B),在基准测试中超越包括V4 Pro在内的多款旗舰模型,HBM、SSD需求分别降至上一代的1/4、1/8,并自9月10日12时起下调Flash API价格,空闲时段缓存命中输入由0.05元降至0.02元/百万Token(降幅60%)。 OpenAI宣布实现“自动化研究实习生”,8月中旬每个人类工作日对应约3.1个Agent工作日,GPT-6 Astra在BenchCAD三维重建几何重合度达95.9%、预估API成本较GPT-5.6 Sol低约43%。 Ramp 8月洞察显示Anthropic、OpenAI企业付费采用率分别为43.8%、39.8%,新增采用速度放缓;头部1%企业人均月AI支出由7,976美元降至7,205美元(环比-9.7%);综合Token有效价格降至每百万Token 0.68美元,较3月高点1.15美元下降约41%。 多模态方面,网易《倩影》AI短片上线3天播放过千万、TVC成本下降95%,MiniMax与NVIDIA在8张B300上约1.653秒生成5秒视频。 报告认为模型与执行系统联合优化、AI深入研发与专业设计、多模态进入生产流程是本周主线,商业化需进一步观察用量增长能否抵消价格与模型结构变化,并提示技术迭代、企业AI商业化、多模态落地、算力供给及资本开支、头部竞争五项风险。

主要观点

  • 行业评级维持“看好”,本周四条主线为DeepSeek架构升级降本、OpenAI实现自动化研究实习生、Ramp 8月企业AI支出洞察、多模态生产提效。
  • DeepSeek发布V4.1 Flash:552B参数MoE、Causal-Encoder-Decoder结构,输入激活8B、输出16B,基准测试超越包括V4 Pro在内的多款旗舰模型。
  • 新架构大幅压缩KV Cache,HBM需求降至上一代1/4、SSD降至1/8;Flash API自9月10日12时起降价并保留峰谷定价,空闲时段缓存命中输入/未命中输入/输出由0.05/1.5/4.5元调整为0.02/1/4元(缓存命中输入降幅60%),高峰时段由0.1/3/9元调整为0.04/2/8元。
  • DeepSeek发布Harness v0.1.5与V4.1 Flash联合优化并推出实验性Agent Teams,报告认为Agent的任务表现和资源效率越来越取决于基座模型与执行系统的共同优化。
  • OpenAI在RSI进展中披露已实现“自动化研究实习生”,可在人类指导下完成熟练研究员需数天完成的明确研究任务,下一阶段目标是在2028年3月实现“自动化研究员”。
  • Agent使用由有限尝试转向日常:8月中旬使用量居中的研究员日均推理消耗超600美元、前10%超7,000美元;每个人类工作日对应约3.1个Agent工作日;过去6个月超一半成功完成的4—8小时任务需至少一次人工干预。
  • 3D能力拓展至专业设计:GPT-6 Astra在BenchCAD几何重合度达95.9%(GPT-5.6 Sol为83.3%),预估API成本1.71美元较Sol低约43%,并可在Blender建模、生成虚幻引擎5可漫游场景。
  • Ramp 8月洞察:Anthropic付费采用率43.8%(环比+0.34个百分点)、OpenAI 39.8%(环比+0.09个百分点),企业采用率继续增长但新增采用速度放缓。
  • 头部1%企业人均月AI支出由7,976美元降至7,205美元、环比下降9.7%,但top10%和整体Median仍保持增长;Ramp认为暑期休假、价格下降和模型选择变化均是影响因素。
  • 截至报告发布当周,综合Token有效价格降至每百万Token 0.68美元、较3月高点1.15美元下降约41%;前沿模型Token份额约45%、低于8月53%峰值;开源模型仅覆盖AI付费企业的6.4%、全部企业的3.6%。
  • 多模态进入生产流程:完美世界部分游戏视频素材生成由天级缩短至分钟级;网易《倩影》上线3天播放过千万、TVC成本下降95%;MiniMax Sol-H3在8张B300上约1.653秒生成5秒1344×768立体声视频、较50步Base H3最高加速15.54倍;GPT-Live-1于9月10日开放API、前端语音层每分钟0.05美元。
  • 各厂商动态密集:DeepSeek筹备科创板IPO(聘中信证券,目标今年递交、明年挂牌)并拟在内蒙古部署至少16万颗华为昇腾950DT;Anthropic自2025年10月以来额外获得至少14.8吉瓦算力、合同最高5,170亿美元,最早10月中旬启动IPO路演;OpenAI暂停新增200美元档Pro订阅,ChatGPT移动端MAU达10.6亿,企业收入6—7月增长32%;通义QoderWake近三个月已有近10万数字员工。

论述逻辑

  • 本周模型侧事件(DeepSeek V4.1 Flash架构升级、OpenAI自动化研究实习生、Sol-H3推理加速)→ 表明模型能力提升与资源需求下降同时发生,架构与执行系统(Harness)的联合优化进一步转化为资源节省与API价格下降 → Ramp企业端数据(采用率43.8%/39.8%仍增但增速放缓、头部1%人均月支出环比-9.7%、综合Token有效价格较3月高点降约41%至0.68美元、前沿模型Token份额自53%回落至45%)→ 说明降价与模型结构变化正在影响AI支出结构,商业化需进一步观察用量增长能否抵消价格与模型结构变化 → 多模态案例(完美世界素材分钟级生成、《倩影》TVC成本-95%、Sol-H3约1.653秒生成5秒视频)显示生成效率与成本改善获得实际生产流程验证 → 报告结论:AI使用从工具深入前沿研发与专业设计本身,维持计算机行业“看好”评级,同时提示技术迭代、企业AI商业化、多模态落地、算力供给及资本开支、头部竞争五项风险。

关键展望

  • DeepSeek计划9月14日12时后有序下线V4 Pro,直至未来V4.1 Pro上线。
  • OpenAI下一阶段目标是在2028年3月实现“自动化研究员”。
  • 商业化验证点:需进一步观察用量增长能否抵消价格与模型结构变化。
  • DeepSeek科创板IPO目标今年递交、明年挂牌,募资额与估值尚未确定。
  • Anthropic IPO时间表:最早10月中旬启动路演,拟9月下旬公开招股书、11月美国中期选举前上市,并拟将循环信贷额度扩大至150亿美元。
  • 字节跳动Pico新头显可能为计划于今年第四季度推出的Pico Space Pro。
  • 风险提示五项:技术迭代及研究自动化进展、企业AI商业化、多模态应用落地、算力供给及资本开支压力、头部厂商竞争均存在不及预期或超预期压力的可能。

推荐标的

  • 报告未明确给出推荐标的,仅为行业周报;行业评级维持“看好”。

关键图表

图1. 表 1: 本周模型发布情况

**图1. 表 1: 本周模型发布情况**

图2. V4.1 Flash 在多项任务评测中表现较强

**图2. V4.1 Flash 在多项任务评测中表现较强**

图3. 使用量居中研究员的日均推理消耗明显提升

**图3. 使用量居中研究员的日均推理消耗明显提升**

图4. GPT-6 Astra 在 BenchCAD 取得 95.9%几何重合度

**图4. GPT-6 Astra 在 BenchCAD 取得 95.9%几何重合度**

图5. 8 月头部 1% 企业人均月 AI 支出下降,但 top10%和整体 Median 的人均 AI 支出金额

**图5. 8 月头部 1% 企业人均月 AI 支出下降,但 top10%和整体 Median 的人均 AI 支出金额**

图6. 报告发布当周前沿模型的 Token 份额约 45%

**图6. 报告发布当周前沿模型的 Token 份额约 45%**

图7. 目前已加入 Kimi 企业合作伙伴计划的合作伙伴

**图7. 目前已加入 Kimi 企业合作伙伴计划的合作伙伴**

图8. OpenAI 与 Morgan Stanley、Evercore 合作推出面向金融服务的 ChatGPT Work

**图8. OpenAI 与 Morgan Stanley、Evercore 合作推出面向金融服务的 ChatGPT Work**

查找相关研报 →