首页/新闻资讯/正文详情

OpenAI、Anthropic同日模型大战,“是兄弟就砍一刀”

发布时间:2026/9/24 3:33:21 来源:云帆数科 栏目:资讯中心
OpenAI、Anthropic同日模型大战,“是兄弟就砍一刀”
刀刀见骨AI巨头为自己画过的大饼“填窟窿”文魏琳华编刘俊宏9月23日凌晨OpenAI和Anthropic像约好了一样前后脚各自放出新模型OpenAI端出了GPT-6 Sol和GPT-6 Luna两款模型把旗舰GPT-6 Astra的能力蒸进更快更便宜的型号里Anthropic则亮出Claude Opus 5.5性能追平Fable 5.1的同时成本只有上代Opus 5的六成。三个新模型指向同一个判断当前大模型竞争的主战场已经从“谁最聪明”转到了“谁又强又便宜”。熟悉OpenAI的老朋友都知道无论是赶当天发布还是靠价格挤兑对手都是它的老本行了。今年下半年OpenAI释放的降价信号愈发强烈7月OpenAI先是把GPT-5.6 Luna断崖式降价80%到8月再把旗舰模型GPT-5.6 Sol促销再砍20%再到这次GPT-6 Sol和LunaOpenAI直接宣布API价格永久下降50%——OpenAI正在用一种“刀刀见骨”的节奏把模型调用成本打到行业新低。OpenAI正在用低价抢用户延续它“大力出奇迹”的营销策略挤兑自己的老对手Anthropic靠用户讲一个更漂亮的收入增长叙事。同一天的两种不同“刀法”同日发布的三个模型各有各的精彩OpenAI靠价格刀法让人直呼真香Anthropic则做到了又强又便宜让Opus 5.5重回大众“白月光”的地位。先看OpenAI这边它这次推出的GPT-6 Sol和Luna两款模型是在GPT-6 Astra的基座上得来的性价比模型——通过调整推理效率和缓存机制OpenAI把单位调用成本压了下去。具体分工上Sol定位面向编程等复杂工作负载Luna则面向更轻量、高频的推理场景。两款模型都支持105万token的上下文窗口、12.8万token的最大输出提供多档推理强度。“智能已经足够好”性价比当道的今天单次任务的成本花费比Benchmark的跑分更重要。在本次大模型发布的介绍中厂商开始秀起了自家模型完成任务的成本表现。在AutomationBench跨应用业务流程测试中GPT-6 Sol在xhigh强度下取得33.2%的任务完成率每项任务平均花费0.27美元同样的任务放到Claude Opus 5上是11倍的价格。新一代模型的计价单位也因此从“一次回答”变成了“一个任务的价格”。从定价来说OpenAI这次给到的诚意太大了甚至试图动摇DeepSeek的性价比地位。GPT-6 Sol的API输入、输出价格分别为每百万token2美元和10美元较GPT-5.6 Sol的促销价格均下降一半。Luna的输入价格从0.2美元降至0.1美元输出价格从1.2美元降至0.5美元。折算成人民币相当于DeepSeek V4.1 Flash的闲时价格每百万输入1元输出4元。当然DeepSeek还是技高一筹早早在DeepSeek V4.1 Flash上对缓存命中价格大展刀法这是用户必须花在上下文上的刚需成本。所以OpenAI新模型发布后不少用户自发对比两者跑任务的价格发现还是DeepSeek划算。此番网友口中的“梁圣”梁文锋依然笑傲春风。在能力上GPT-6 Luna也被用户质疑“开倒车”似乎无法赶上上一代GPT-5.6 Luna。但看在价格的份上好像又不是不能原谅。新模型的价格是上一代的一半人送外号“更便宜的GPT-5.6 Luna”。再看Anthropic的Opus 5.5。如果说OpenAI走的是“旗舰下沉”路线那Anthropic走的就是“够强且更便宜”的路线。这就不得不让人吐槽Anthropic不地道。嘴上一边喊着“放缓研究”一边端出来了Opus 5.5。到底哪里跑得慢了作为Claude 5.5系列的首款模型Anthropic称Opus 5.5在大多数工作中达到Fable 5.1的水平同时比Opus 5更快、更便宜。其上下文窗口为100万token最大输出为12.8万token输入和输出价格分别为每百万token4美元和20美元比Opus 5低20%。便宜还不止于单价。Opus 5.5完成任务时使用的token和工具调用也有所减少缓存读取价格从每百万token0.5美元降至0.2美元——降幅高达60%。Anthropic自己算了一笔账它把典型工作负载成本下降40%输出速度还提升超过30%。这次Opus 5.5性能提升集中在长时间运行的编码智能体和知识工作上。在更硬核的基准测试上Opus 5.5在Terminal-Bench 4.0上得分66.4%高于Fable 5.155.8%和GPT-6 Astra57.9%。在衡量代码修改能否真正合并进项目的FrontierCode 1.1上Opus 5.5得分54.4%高于GPT-6 Astra的53.3%。知识工作是Opus 5.5此次领先最明显的方向。在覆盖44种职业任务的GDPval-AA v2.1上Opus 5.5得到1846分高于Fable 5.1和Opus 5。Anthropic甚至还没把Fable系列的模型端出来已经能用Opus 5.5和GPT-6 Astra掰腕子了。下一代旗舰模型能打成什么样简直想都不敢想。OpenAI和Anthropic虽然撞档同一天但这场模型比赛没有“赢家通吃”的场景出现。实际上它开启的是一场错位竞争——OpenAI用轻量模型走量、抢调用规模Anthropic用Opus 5.5守住高价值的编码和知识工作。两者一个要规模一个要客单价。为了撑起增长预期OpenAI和Anthropic都急了把镜头拉远GPT-6 Sol和Luna的“永久半价”是OpenAI第N次向价格挥刀。在模型层OpenAI的打法越来越清晰它靠旗舰模型保住地位和利润、轻量模型则变成了抢市场的主力。7月30日OpenAI宣布GPT-5.6 Luna输入和输出成本同时降低80%中档Terra降价20%8月GPT-5.6 Sol的API和额度价格又被下调20%。订阅端OpenAI则靠套餐的调整实现变相降价。1月价格更低的Go套餐开始推向全球市场美国定价为8美元4月9日OpenAI推出每月100美元的Pro档8月面向企业用户的BusinessPremium seat方案上线年付100美元/月额度是标准席位的5倍。从使用量来看OpenAI降价的效果立竿见影。全球大模型聚合平台OpenRouter观察了7-8月OpenAI的流量变化其中Luna的日均token调用量涨到降价前的13.8倍Terra涨了5.6倍此前一直按原价销售的Sol只涨了1.1倍。同期被点名的竞争对手里只有Anthropic的调用量不升反降。OpenRouter还研究了一下模型后续的表现证明虽然价格恢复但一定程度上OpenAI的用户黏性变好了在促销期试用过Luna或Terra的十多万客户中约32%在促销结束后保留了部分用量。OpenAI为什么要这么急因为账本对面站着的是Anthropic而对手正在收入上完成反超。收入上Anthropic二季度营收超过115亿美元较去年同期增长约14倍同时首次录得5.59亿美元调整后营业利润OpenAI同期营收达到67亿美元环比增长18%二季度经营亏损却从一季度的93亿美元扩大到123亿美元。与此同时OpenAI本身的收入却并不理想。The Information报道称OpenAI今年前几个月多次未能完成月度销售目标在编程和企业市场上把份额输给了Anthropic。OpenAI CFO Sarah Friar曾向其他高管坦言担心收入增长不够快、无力支付未来的算力合约承诺。因为OpenAI“欠的账”实在是太多了。对甲骨文是约3000亿美元、为期五年的云算力采购对微软是重组后仍要消化的约2500亿美元Azure承诺对亚马逊是约380亿美元、为期七年的集群对CoreWeave还有约220亿美元的GPU云合约。当OpenAI的市场份额被竞争对手抢走它的每一次降价都是为了维持住自己曾经讲过的增长叙事。镜头转到另一边Anthropic也不轻松。GPT-6 Astra两周抢走企业AI支出的13%份额证明OpenAI能靠模型的性价比切走更多市场份额。旗舰一旦够用、价格又压得住企业预算会很快改道。这就预示着一旦增长缓慢Anthropic也会被账单架在火上烤。对亚马逊AWS的承诺、对谷歌和博通的TPU采购还得算上租SpaceX的机房“哪哪也都是钱”。这一天两家其实都在降价每一次降价都是一次预付的赌注。但价格战没有终点未来只有下一把刀。

相关推荐

我把 Jev 接入了业务系统:3 个真实场景告诉你什么时候该用它、什么时候别用
我把 Jev 接入了业务系统:3 个真实场景告诉你什么时候该用它、什么时候别用

最近 Jev 这个词在技术圈刷了屏——前 OpenAI 研究员做的「System One」决策模型,号称比传统大模型快 200 倍、成本低 100 倍。很多同学问我:这玩意儿到底能不能用在生产环境?适合什么场景?这篇文章不讲虚的,直接上干货… · 2026/9/24 3:33:15

基于SG3525的750W半桥开关电源设计与调试全解析
基于SG3525的750W半桥开关电源设计与调试全解析

/* MD / 富文本中的 .toc(含博客园搬家等嵌套结构);.toc-box 在侧栏,不受影响 */#content_views .toc,/* 编辑器常在目录前后插入空 p(:empty 仍占 20px),一并去掉避免顶空隙 */#content_views.markdown_views > p:empty:has(+ .toc),#content_views.markdown_views … · 2026/9/24 3:33:15

[从0开始精通AI] Python基础06 模块与软件包
[从0开始精通AI] Python基础06 模块与软件包

摘要:本文系统讲解Python模块与软件包的核心知识,涵盖模块概念、五种导入方式、自定义模块中的__name__与__all__变量作用,以及包的结构、__init__.py功能和绝对/相对导入区别。通过实例演示模块复用、代码组织与导入控制,帮助开发… · 2026/9/24 3:33:15

TSMC 0.18um 1.5GHz小数分频PLL流片实战:Cadence+ADS协同仿真避坑指南
TSMC 0.18um 1.5GHz小数分频PLL流片实战:Cadence+ADS协同仿真避坑指南

/* MD / 富文本中的 .toc(含博客园搬家等嵌套结构);.toc-box 在侧栏,不受影响 */#content_views .toc,/* 编辑器常在目录前后插入空 p(:empty 仍占 20px),一并去掉避免顶空隙 */#content_views.markdown_views > p:empty:has(+ .toc),#content_views.markdown_views … · 2026/9/24 5:32:09

IPD集成产品开发流程管理:从PACE到Charter的研发项目管理实践
IPD集成产品开发流程管理:从PACE到Charter的研发项目管理实践

/* MD / 富文本中的 .toc(含博客园搬家等嵌套结构);.toc-box 在侧栏,不受影响 */#content_views .toc,/* 编辑器常在目录前后插入空 p(:empty 仍占 20px),一并去掉避免顶空隙 */#content_views.markdown_views > p:empty:has(+ .toc),#content_views.markdown_views … · 2026/9/24 5:31:45

读懂AI设计发展演变史后,教你应对设计焦虑
读懂AI设计发展演变史后,教你应对设计焦虑

AI 行业的爆发始于2022年 ChatGPT 和 Midjouney 的发布,到现在已经快4年了,整个发展过程用突飞猛进、日新月异形容一点都不过分。 但不管它过去还是现在,发展得有多迅猛,都依旧处于行业早期的开荒和发展阶段,离真正成… · 2026/9/24 5:31:45

Triton Inference Server Trace 扩展协议解析:通过 HTTP/REST 与 gRPC 在运行时配置追踪
Triton Inference Server Trace 扩展协议解析:通过 HTTP/REST 与 gRPC 在运行时配置追踪

模型推理服务AI 应用后端 【免费下载链接】server The Triton Inference Server provides an optimized cloud and edge inferencing solution. 项目地址: https://gitcode.com/gh_mirrors/server117/server 点击查看 免费下载 导读 本文围绕 Triton Inference S… · 2026/9/24 5:31:33

Jev :Agent 又慢又贵的根因,是决策环节的冗余调用?
Jev :Agent 又慢又贵的根因,是决策环节的冗余调用?

Agent 每走一步都在做判断:这条消息紧急吗、这个工单转给哪个部门、这条命令该直接执行还是先问人。这些题的答案就是个结构化结论——是/否、A 还是 B——模型根本不需要写一段话来推理。 Agent每做一次判断,就得把整段上下文喂给大模型、等它生成一整段… · 2026/9/24 5:30:56

ENSP校园网组网实战:从VLAN规划到静态路由的完整配置指南
ENSP校园网组网实战:从VLAN规划到静态路由的完整配置指南

/* MD / 富文本中的 .toc(含博客园搬家等嵌套结构);.toc-box 在侧栏,不受影响 */#content_views .toc,/* 编辑器常在目录前后插入空 p(:empty 仍占 20px),一并去掉避免顶空隙 */#content_views.markdown_views > p:empty:has(+ .toc),#content_views.markdown_views … · 2026/9/24 5:30:32

基于YOLOv8的渔船作业监控系统:从环境搭建到边缘部署全流程
基于YOLOv8的渔船作业监控系统:从环境搭建到边缘部署全流程

简介:这是一套面向计算机、人工智能、自动化等专业学生与教师的毕业设计级项目资源,围绕YOLOv8实现渔船作业监控系统,可用于毕设、课程设计、大作业或项目立项演示。压缩包共97个文件,约24.21MB,以70个Python源码文件为… · 2026/9/24 0:00:13

1D-CNN时间序列建模实战:从Conv1d原理到工业落地
1D-CNN时间序列建模实战:从Conv1d原理到工业落地

简介:面向时间序列数据建模的一维卷积神经网络完整实现,适合深度学习入门者及需要快速验证时序模型的研究者,能够从音频、文本、传感器或股价等序列中挖掘局部特征与时间依赖。压缩包体积很小,只有3KB,内含3个Python脚… · 2026/9/24 0:00:26

柔软的L:汉语语流中被忽视的舌肌张力控制
柔软的L:汉语语流中被忽视的舌肌张力控制

1. 这个“L”不是字母表里的L,而是舌尖上的L最近在几个方言群和语音教学社群里,反复看到有人发一句:“也说字母L:柔软的长舌”。初看以为是英语发音课笔记,点开才发现全是方言爱好者、播音系学生、语言康复师甚至戏曲演… · 2026/9/24 0:00:44

了解更多?预约专属演示

我们的顾问将为您一对一讲解产品与方案

企业微信二维码