老董的视界深处

· 金元证券 · 公司/行业基本面

计算机行业点评:GPT 6 Astra发布,Agent能力迎来跃迁,AI应用落地有望加速

摘要公开阅读;PDF 仅限有效会员阅读与下载,所有会员权限相同。 邮件登录

摘要

金元证券于2026年9月4日发布计算机行业点评并维持行业“强于大市”评级,事件为OpenAI同日正式发布GPT-6系列首个模型GPT-6 Astra,定位“最智能、最对齐”旗舰模型,支持105万Token上下文及12.8万Token最大输出,短上下文输入$10/百万tokens、输出$50/百万tokens,为前代GPT-5.6 Sol的2.5倍,与Fable 5.1一致。 报告认为Computer Use实现代际飞跃,OSWorld 2.0延迟模拟中较GPT-5.6 Sol快约47%、每项任务耗时约40分钟、得分72.6%(前代65.7%),且可调用KiCad按电子原理图完成PCB布局。 Astra是OpenAI史上规模最大训练任务之一,在得州Stargate园区用超10万块GPU预训练;网络安全能力首次触及“关键”阈值,ExploitBench得分100%(前代78.5%)。 报告判断AI Agent正从“辅助工具”向“生产力平台”演进,AI应用有望加速规模化落地,推动算力基础设施、AI软件生态及智能化应用需求持续增长。

主要观点

  • 事件:2026年9月4日OpenAI正式发布GPT-6系列首个模型GPT-6 Astra,定位“最智能、最对齐”的旗舰模型
  • 规格与定价:Astra支持105万Token上下文及12.8万Token最大输出长度,提供Low至Max五档推理强度;短上下文输入$10/百万tokens、输出$50/百万tokens,为GPT-5.6 Sol的2.5倍,与Fable 5.1保持一致
  • 定价对比:图表2显示GPT-6 Astra输入$10、输出$50/1M tokens,与Claude Fable 5.1(10/50)持平,明显高于GPT-5.6 sol(4/20)、Grok-4.6(2/6)、GLM-5.3(1.4/4.4)、Kimi-K3(3/15)与Muse Spark 1.3(1.25/4.25)等旗舰模型
  • Computer Use实现代际飞跃:Astra可自主操作浏览器、更新CRM记录、编辑表格、做研究、生成演示文稿;OSWorld 2.0延迟模拟中比GPT-5.6 Sol快约47%,每项任务耗时约40分钟,得分72.6%(GPT-5.6 Sol为65.7%)
  • 专业软件操作能力:Astra可调用KiCad等专业软件,根据电子原理图完成PCB布局,Computer Use正逐步覆盖极度依赖人类经验的工作场景
  • 长周期任务可靠性显著提升:Astra采用跨窗口注释机制替代传统摘要压缩,100万Token上下文多针检索测试准确率达96.3%
  • 可控性改善:面对不可完成任务时,Astra越权执行比例由GPT-5.6 Sol时期的48%下降至0,为AI Agent从完成单点任务向承接完整业务流程演进提供基础
  • 训练规模持续扩大:Astra是OpenAI历史上规模最大的训练任务之一,在得州Stargate园区使用超10万块GPU完成预训练,也是OpenAI首款由前代模型深度参与训练监督的模型
  • 网络安全能力首次触及OpenAI“关键”阈值:ExploitBench得分100%(GPT-5.6 Sol为78.5%),ExploitGym成功率42.4%(前代30.3%);对近三个月公开新漏洞攻击成功率达39%(Sol仅5.5%),并发现并利用两个此前未知的V8零日漏洞
  • 核心判断:Astra在Computer Use、长周期任务可靠性及专业软件操作能力上的提升,标志着AI Agent正从“辅助工具”向“生产力平台”演进,应用范围由内容生成、知识问答拓展至CRM维护、工程设计、数据处理等复杂工作流
  • 评级:计算机行业维持“强于大市”评级
  • 报告另附当前全球模型智能排名与公司最新市场占比图表(数据来源:artificialanalysis,金元证券研究所整理)

关键展望

  • 报告展望:随着模型Agent能力持续增强,AI应用有望加速规模化落地,推动算力基础设施、AI软件生态及智能化应用需求持续增长
  • 评级与时间窗口:维持计算机行业“强于大市”评级,按金元证券行业评级标准即预期行业相关指数未来6个月内超越沪深300指数表现
  • 风险提示:大模型商业化落地不及预期风险、模型技术迭代不及预期风险、行业竞争加剧的风险等

推荐标的

  • 报告未明确给出个股推荐标的;仅对计算机行业维持“强于大市”评级,受益方向指向算力基础设施、AI软件生态及智能化应用需求

查找相关研报 →