国际大模型动态日报(2026年9月1日)
总览
过去一周,国际大模型领域风起云涌。OpenAI 被曝已跑通 10 万亿参数预训练模型,GPT-6 灰测 Demo 刷屏全网;Anthropic 将 Claude Sonnet 5 的优惠价永久化,并推出基于 Mythos 5 的安全扫描服务;Google 发布 Gemini 3.7 Flash,以半价攻势抢占编码与 Agent 市场;xAI 的 Grok 4.6 在争议中前行,马斯克首次承认"第一次没建对"。以下是本期五大核心动态的详细解读。
一、OpenAI:GPT-6 灰测 Demo 曝光,10 万亿参数「Bel」模型浮出水面
发布方:OpenAI
时间:2026 年 8 月 31 日
核心亮点:
- 多条独立信源在 8 月 31 日几乎同时爆出:OpenAI 已跑通代号为「Bel」的 10 万亿参数预训练模型,代号为「Astra」的 GPT-6 灰测 Demo 也在全网刷屏。
- 此前,OpenAI 于 7 月 9 日发布了 GPT-5.6 系列(Sol / Terra / Luna 三档),7 月 30 日将 Luna 价格下调 80%、Terra 下调 20%。当前 GPT-5.6 Sol 定价为输入 $5.00/百万 tokens、输出 $30.00/百万 tokens。
- 8 月 13 日,OpenAI 推出 Ultrafast 模式预览,由 Cerebras 提供算力支持,GPT-5.6 Sol 速度最高提升 14 倍,每秒可生成 750 个输出 token。
- 8 月 31 日另据消息,OpenAI 狂扫数万台 Mac 用于训练 AI 智能体,推动 Mac 销售额增长近 29%。
影响与意义:GPT-6 的曝光标志着 OpenAI 在超大规模模型上的持续投入。如果 10 万亿参数属实,将是当前已知最大规模的大语言模型。结合 Ultrafast 模式的速度突破和持续性降价,OpenAI 正在构建从超大规模前沿模型到高性价比推理模型的完整矩阵。
二、Anthropic:Claude Sonnet 5 优惠价永久化,Claude Security 上线
发布方:Anthropic
时间:2026 年 8 月
核心亮点:
- 8 月 10 日,Anthropic 宣布 Claude Sonnet 5 的推广定价(输入 $2/百万 tokens、输出 $10/百万 tokens)永久生效,原定 9 月 1 日执行的标准定价($3/$15)不再适用。Sonnet 5 于 6 月 30 日发布,在 Agent 性能方面较 Sonnet 4.6 有显著提升。
- 8 月 23 日,Claude Enterprise 客户获得基于 Mythos 5 的漏洞扫描服务(Claude Security),以普通 token 用量计费,无需额外订阅。该服务以补丁和 CWE 标记的发现形式输出结果,而非直接暴露模型访问。
- 7 月 24 日发布的 Claude Opus 5 定位为更适合日常使用的旗舰档,在编码与知识工作评测上更强,定价与 Opus 4.8 同档。Opus 5 在长时运行 Agent 方面实现了阶跃式改进。
影响与意义:Sonnet 5 永久降价是 Anthropic 应对市场竞争的关键举措,直接对标 Google Gemini 3.7 Flash 的半价策略。Claude Security 的推出则表明 Anthropic 正在将最受限的模型能力(Mythos 5)包装为安全工具,开辟了差异化的企业服务路径。
三、Google:Gemini 3.7 Flash 发布,半价策略猛攻编码与 Agent
发布方:Google DeepMind
时间:2026 年 8 月 13 日
核心亮点:
- Gemini 3.7 Flash 是 Google 最新主力模型,距离 Gemini 3.6 Flash 发布仅隔三周。保留 1M token 上下文窗口和多模态输入能力,在编码和 Agent 基准测试中取得巨大进步。
- 推广价仅为 Gemini 3.6 Flash 的一半:输入 $0.75/百万 tokens、输出 $3.75/百万 tokens,锁定至 2026 年 12 月 31 日。到期后恢复为 $1.50/$7.50。
- 支持可配置思考等级(低/中/高),让开发者灵活控制质量、成本和延迟的平衡。
- 8 月 26 日,Google 发布 Gemini 3.5 Transcribe,号称"迄今最精确的语音转文字模型",已为 Gboard Rambler 和 Chrome 浏览器提供支持。
影响与意义:Gemini 3.7 Flash 以一半价格提供更强性能,直接挑战了 Claude Sonnet 5 和 GPT-5.6 Terra 的性价比定位。Google 在 Flash 系列上的快速迭代(三周一代)展示了其极强的工程能力,而"编码工作马"的定位则精准瞄准了当前最活跃的开发者市场。
四、xAI:Grok 4.6 发布,马斯克承认"第一次没建对"
发布方:xAI(Elon Musk)
时间:2026 年 8 月
核心亮点:
- Grok 4.6 于 8 月 12 日前后发布,定位为编码、Agent 任务和知识工作旗舰,拥有 50 万 token 上下文窗口和可配置推理级别,通过 xAI API 和 X 平台提供。
- 8 月 9 日,马斯克转发演示称 Grok Build(xAI 的终端编码 Agent)正"快速转变为全能创作环境",可在开发者工作流中直接生成图片和视频。
- 然而,马斯克同月在 X 平台公开承认"xAI 第一次没建对,正在从基础重建"。Grok 被曝出现严重输出异常,用户收到完全不相关的乱码回复。核心人才流失被认为是问题根源。
- 特斯拉方面,8 月底传出拟将 Grok Bot 集成至车载系统,FSD v14.3.8 与夏季更新中 Grok 语音控制增强。马斯克还承诺 Grok 若致用户亏损将全额赔付(责任上限 100 美元)。
影响与意义:Grok 正处于技术路线调整的关键期。马斯克的坦诚表态和人才流失问题暴露了 xAI 在组织层面的挑战,但 Grok Build 的多模态能力展示和特斯拉生态整合仍显示出差异化潜力。Grok 能否在重建中实现突破,将是下半年最值得关注的变量之一。
趋势总结与展望
- 价格战持续升级:Anthropic Sonnet 5 永久降价、Google Gemini 3.7 Flash 半价、OpenAI Luna 降价 80%——三大巨头在 API 定价上展开了激烈竞争,"优质低价"正成为行业新常态。
- Agent 能力成为核心战场:从 Claude Opus 5 的长时 Agent、Gemini 3.7 Flash 的 Agent 基准突破,到 Grok Build 的全能创作环境,Agent 化是当前所有厂商的共同方向。
- 超大规模模型竞赛重启:OpenAI 10 万亿参数「Bel」模型的消息若属实,意味着超大规模预训练路线并未被放弃,而是与 MoE 架构、高效推理等路线并行发展。
- 安全能力商业化:Anthropic 将 Mythos 5 包装为安全扫描服务,开创了"用最强模型做安全、而非直接开放"的新商业模式,值得关注。
数据来源:Anthropic 官方博客、OpenAI 发布说明、Google AI 开发者文档、X 平台(@elonmusk)、The Agent Times、新华网、多家科技媒体报道。信息采集时间:2026 年 8 月 25 日至 9 月 1 日。

评论(0)
暂无评论,来抢沙发~
请 登录 后发表评论