国际大模型动态:OpenAI连发GPT-6两款新品价格腰斩,xAI Grok 4.7携50万上下文登场
2026年9月23日 | 大模型行业动态
2026年9月,国际大模型竞争进入白热化阶段。OpenAI在9月3日发布旗舰GPT-6 Astra后仅三周,于9月22日再推GPT-6 Sol和GPT-6 Luna两款新模型,API定价直降50%;xAI紧随其后发布Grok 4.7,主打编程与知识处理;Anthropic的Claude Fable 5.1和Opus 5.5在编程和企业应用领域持续发力;Google则推出Gemini 3.8 Flash及其网络安全特化版。一场围绕"更高智能、更低成本、更广生态"的全方位较量正在上演。
一、OpenAI连发GPT-6 Sol与Luna:API价格腰斩,Luna比DeepSeek还低
9月22日,OpenAI正式发布GPT-6系列两款新模型——GPT-6 Sol和GPT-6 Luna,将GPT-6 Astra的部分能力下沉到更快、更便宜的模型中,API定价较上一代GPT-5.6促销价格直降50%。
定价详情:
| 模型 | 定位 | 输入价格(每百万Token) | 输出价格(每百万Token) |
|---|---|---|---|
| GPT-6 Sol | 中阶,复杂推理/编程 | $2.00(原$4.00) | $10.00(原$20.00) |
| GPT-6 Luna | 轻量,高频吞吐 | $0.10(原$0.20) | $0.50(原$1.20) |
值得注意的是,GPT-6 Luna的定价甚至低于DeepSeek-V4.1-Flash的空闲时段价格,这是OpenAI首次在价格上直接低于中国厂商的经济型模型。GPT-6 Luna支持105万Token上下文长度和12.8万Token最大输出,知识截止日期为2026年5月18日。
核心亮点: - GPT-6 Sol面向编程等复杂任务,承担中阶推理职能 - GPT-6 Luna面向轻量高频场景,以极低价格抢占开发者市场 - 两款模型均继承了GPT-6 Astra的部分能力,形成完整产品矩阵
影响与意义: OpenAI以GPT-6 Astra为旗舰、Sol为中阶、Luna为入门的三层产品线已清晰成型。Luna的定价策略标志着OpenAI从"高价高端"向"全价格段覆盖"的战略转型,直接向DeepSeek等中国厂商的低价腹地发起进攻。这一举措可能引发新一轮全球大模型价格战。
二、xAI发布Grok 4.7:50万上下文,主打编程与知识处理
北京时间9月21日,马斯克旗下xAI正式发布新模型Grok 4.7,官方称其为"旗下功能最强大的编程和知识处理模型"。
核心信息: - 定价:输入$2/百万Token,输出$6/百万Token(与Grok 4.6持平) - 上下文:50万Token - 亮点:更大的底模、重点强化Coding和Agent能力、可处理动辄数小时的复杂任务 - 性能:软件工程、电气工程、长时办公、终端和法律任务全面开花 - 速度:号称"两倍速、半价",即速度为同级别模型两倍,价格为同类一半
xAI同步推进企业端布局:9月3日,Grok Bot for Enterprise正式上线,面向Grok和Cursor企业客户提供两周免费使用,并支持全组织邀请。9月17-18日,Grok Bot语音功能扩展至桌面端和移动端。
影响与意义: Grok 4.7的发布填补了xAI在编程领域的短板,50万Token上下文使其在长文档处理和复杂代码任务中具备竞争力。但首批评测显示,Grok 4.7在编程能力上与OpenAI和Anthropic的旗舰模型仍有差距,xAI需要更多产品化能力来追赶。
三、Anthropic Claude Fable 5.1与Opus 5.5:编程与成本的双重突破
9月1日,Anthropic发布Claude Fable 5.1(代号claude-fable-5-1),作为Claude Fable 5的继任者,专注于长时间运行的编程代理、知识工作和研究任务,同时发布Claude Mythos 5.1。
与此同时,Anthropic还发布了Claude 5.5系列的首款产品Opus 5.5,官方称其性能与Fable 5.1相当,但运行成本比Opus 5降低40%。
Opus 5.5定价对比:
| 模型 | 输入价格(每百万Token) | 输出价格(每百万Token) |
|---|---|---|
| Claude Opus 5 | $5.00 | $25.00 |
| Claude Opus 5.5 | $4.00 | $20.00 |
核心亮点: - Fable 5.1在编程、知识工作和长时间任务上设定新基准 - Opus 5.5以更低成本提供与Fable 5.1相当的性能 - 支持零数据保留(Zero Data Retention)模式,满足企业安全合规需求 - Claude平台持续完善,形成Fable/Opus/Mythos多产品线布局
影响与意义: Anthropic通过Fable 5.1和Opus 5.5的组合,在编程能力和成本效率上同时发力。Opus 5.5降价40%的策略表明Anthropic也在积极应对价格竞争,同时以零数据保留功能差异化竞争企业级市场。
四、Google Gemini 3.8 Flash及Flash Cyber:智能翻倍,网络安全特化
9月2日,Google发布Gemini 3.8 Flash,距上一代3.7 Flash仅三周,这是六周内的第三个Flash版本。同时发布的还有Gemini 3.8 Flash Cyber——一个专门用于网络安全的特化版本。
Gemini 3.8 Flash核心信息: - 在软件工程、代理任务和多步推理方面较3.7 Flash有显著提升 - 介绍期定价与3.7 Flash相同 - 已在Gemini App、Google AI Studio、Gemini API、Google AI Mode等多个渠道上线
Gemini 3.8 Flash Cyber特殊之处: - 专为网络安全任务特化训练 - 不对公众开放,仅通过名为Fairwind的项目提供 - Google已在内部使用该模型保护全公司代码安全 - 标志着大模型从通用能力走向垂直领域特化
影响与意义: Gemini 3.8 Flash的快速迭代展示了Google的工程效率,而Flash Cyber的发布则开辟了"大模型+安全"的垂直应用新方向。将安全特化模型限定在Fairwind项目内、不对外销售,也反映出前沿AI能力管控的新范式。
五、OpenAI生态扩张:推理芯片+ChatGPT全面嵌入办公场景
除了模型发布,OpenAI在生态布局上同样动作频频:
- 自研推理芯片: OpenAI与Broadcom合作推出首款推理芯片,降低推理成本、减少对NVIDIA的依赖
- ChatGPT for Word(9月17日上线): 继Excel(5月)和PowerPoint(7月)后,ChatGPT全面嵌入微软Office三件套
- ChatGPT for金融服务(9月9日上线): 结合内置金融数据与GPT-6 Astra,助力研究、建模和面向客户的材料制作
影响与意义: OpenAI正在从"模型提供商"向"AI基础设施平台"转型。自研芯片是垂直整合的关键一步,而Office三件套的全面嵌入则意味着ChatGPT已深度融入全球最大规模的企业办公工作流。
趋势总结与展望
纵观2026年9月的国际大模型动态,三大趋势清晰可见:
-
价格战全球化: OpenAI的GPT-6 Luna以低于DeepSeek的定价标志着价格战从中国蔓延至全球。各厂商在旗舰模型比拼智能上限的同时,在经济型模型上展开残酷的价格竞争。
-
产品线分层化: OpenAI(Astra/Sol/Luna)、Anthropic(Fable/Opus/Mythos)、Google(Flash/Ultra/Cyber)均已形成清晰的三层或多层产品矩阵,覆盖从轻量到旗舰的全价格段。
-
生态垂直化: 从Google的网络安全特化模型到OpenAI的金融行业版,大模型正从通用能力走向垂直行业深耕。自研芯片、办公软件嵌入等基础设施布局,则标志着竞争已从模型层延伸至全栈。
展望未来,随着各厂商产品线日趋完善,下一阶段的竞争焦点将从"模型能力"转向"生态覆盖"和"行业渗透"。谁能在金融、医疗、法律等垂直领域建立更深的护城河,谁就能在AI 2.0时代占据有利位置。
数据来源: - OpenAI官方API页面(openai.com/api) - xAI Grok 4.7发布信息(36kr.com、traictory.com) - Anthropic Claude Fable 5.1文档(anthropic.com/claude/fable) - Google Gemini 3.8 Flash发布博客(blog.google) - 华尔街见闻、智东西、TechWeb等相关报道 - 搜索日期:2026年9月23日

评论(0)
暂无评论,来抢沙发~
请 登录 后发表评论