计算机行业周报:GPT 6 Astra发布,大模型加速迭代
摘要公开阅读;PDF 仅限有效会员阅读与下载,所有会员权限相同。 邮件登录
摘要
报告维持计算机行业“领先大市-A”评级。 核心事件是OpenAI于2026年9月4日正式发布新一代旗舰模型GPT-6 Astra,其在计算机使用、浏览、软件工程、网络安全、科学和专业工作领域全面领先:ARC-AGI-3得分99.9%(平均人类测试员48%)、FrontierMath Tier4 v2得分97.6%(接近98%饱和分,Claude Fable 5为90.2%)、ExploitBench拿下100%满分、Terminal-Bench 4.0得分57.9%创新高(较GPT-5.6 Sol的37.3%和Claude Fable 5.1的55.8%每个任务预估API成本低约9%和63%)、DeepSWE v1.1得分74.1%、Agent's Last Exam得分59.3%。 行业观点同时回顾:Anthropic于6月9日发布Claude Fable 5与Mythos 5(后者仅对11家受信任机构开放),6月10日安全层被红队研究者宣布攻破,6月12日美国政府以国家安全为由发布出口管制指令要求暂停所有外国公民访问,Anthropic随即停止所有用户使用;智谱则于6月13日宣布GLM-5.2面向GLM Coding Plan全量用户开放,API下周上线、模型下周开源并遵循MIT协议、支持1M上下文,报告据此建议关注国产模型的投资价值。 风险提示为技术迭代不及预期、市场需求不及预期等。
主要观点
- OpenAI于2026年9月4日正式发布新一代旗舰模型GPT-6 Astra,在计算机使用、浏览、软件工程、网络安全、科学和专业工作领域处于最先进水平,多个测试集评分领先。
- 数理与逻辑推理方面,GPT-6 Astra在ARC-AGI-3测试得分99.9%(平均人类测试员48%),在FrontierMath Tier4 v2上达到97.6%、接近98%饱和分(Claude Fable 5为90.2%),并在ExploitBench漏洞利用测试中拿下100%满分。
- 编程能力方面,GPT-6 Astra在Terminal-Bench 4.0得分57.9%创新高(GPT-5.6 Sol为37.3%、Claude Fable 5.1为55.8%),每个任务预估API成本分别低约9%和63%;DeepSWE v1.1得分74.1%(GPT-5.6 Sol为72.7%、Claude Fable 5.1为67.4%)。
- Agent与计算机使用方面,GPT-6 Astra在Agent's Last Exam取得59.3%新高(Claude Opus 5为55.5%、GPT-5.6 Sol为53.6%);在OSWorld 2.0中输出token量远少于GPT-5.6 Sol的情况下任务评分更高,可处理填表、CRM更新、在线研究、网站创建与前端质检等任务。
- Anthropic于6月9日发布Claude Fable 5与Claude Mythos 5(Mythos 5保留完整能力、仅对11家受信任机构开放),6月10日红队研究者Pliny the Liberator宣布攻破Fable 5安全层,6月12日美国政府以国家安全为由发布出口管制指令、要求暂停所有外国公民访问,Anthropic当日声明停止所有用户使用。
- 报告指出Fable 5前端风险分类器(覆盖网络安全、生物、化学、模型蒸馏四领域,触发时静默降级至Claude Opus 4.8)存在三个结构性缺陷:依赖关键词和模式匹配而非语义理解、逐条检测无法追踪跨轮次意图链、多模型管线存在组合漏洞;美国政府对先进模型启动管制,模型正从消费级走向真正的生产力。
- 智谱6月13日宣布GLM-5.2面向GLM Coding Plan全量用户开放(覆盖Lite/Pro/Max/团队版),API将于下周上线、模型下周开源并遵循MIT协议;GLM-5.2是智谱迄今能力最强的开源模型,支持真正可用的1M上下文,据第三方测评“大模型观测员”,其Vibe Coding能力逐渐接近Claude Opus 4.8、领先其他国内模型。
- 报告认为在海外对先进模型管制的背景下,GLM-5.2开源有望进一步带动国产模型在产业中的话语权和使用度、体现中国模型的价值,建议关注国产模型的投资价值。
- 本周计算机行业指数在中信30个行业指数中排名第22、在TMT四大行业中排名第1;个股层面周涨幅前十由新炬网络(28.54%)领涨,周跌幅前十中魅视科技(-11.80%)居首,周换手率前十中华是科技达141.37%。
- 行业新闻:当地时间9月1日Anthropic发布Claude Fable 5.1与Mythos 5.1(Fable 5.1全面开放、Mythos 5.1仅通过受信任访问计划向部分网络安全和生命科学机构提供),主打性能翻倍、Agent成本降45%;OpenAI官宣GPT-6 Astra,定义为“世界上最智能、对齐程度最高”的模型,多领域全部刷新SOTA。
- 投资评级与风险:报告对计算机行业维持“领先大市-A”评级(未来6个月投资收益率领先沪深300指数10%及以上);风险提示为技术迭代不及预期、市场需求不及预期等。
关键展望
- 智谱GLM-5.2 API将于下周上线,模型将于下周正式开源并遵循MIT协议,为国产模型的后续跟踪验证点。
- 美国对先进模型的管制措施已经启动、要求暂停所有外国公民访问Fable 5与Mythos 5,报告认为模型已逐步从消费级走向真正的生产力,海外先进模型可获得性构成持续变量。
- 行业评级“领先大市-A”的含义是未来6个月投资收益率领先沪深300指数10%及以上,风险等级为A(正常风险)。
- 报告未给出盈利预测或目标价;明确风险提示为技术迭代不及预期、市场需求不及预期等。
推荐标的
- 报告未明确给出推荐标的:报告为行业周报,未列示个股评级或目标价(首页“首选股票/目标价/评级”栏无内容),仅在行业观点层面建议关注国产模型的投资价值。
关键图表
图1. 表 1: 本周 A 股市场指数涨跌幅统计

图2. 表 2: 本周海外市场指数涨跌幅统计

图3. 本周各行业涨跌幅统计

图4. 表 3: 本周计算机个股涨跌幅统计
