欧洲杯体育但任务本钱分裂低 93% 和 96%-开云(中国)kaiyun体育网址-登录入口

发布日期:2026-09-26 13:11    点击次数:57

欧洲杯体育但任务本钱分裂低 93% 和 96%-开云(中国)kaiyun体育网址-登录入口

Astra冲上限,Sol和Luna抢阛阓。

DeepSeek 快醒醒,ChatGPT 要打到家门口了。

就在刚刚,OpenAI 防御发布 GPT-6 Sol 和 GPT-6 Luna,API 价钱降至上一代的一半左右。其中,Luna 每百万 Token 输入 0.1 好意思元、输出 0.5 好意思元,约合东说念主民币 0.7 元和 3.5 元。

Image

看成对照,DeepSeek V4.1 Flash 闲时的缓存未掷中输入价为每百万 Token 1 元,输出价为 4 元,岑岭时段则升至 2 元和 8 元。按照普通新肯求规划,Luna 一经更低廉,也莫得峰谷订价带来的本钱波动。

DeepSeek 依然抓有我方的价钱王牌。它的闲时缓存掷中输入只须每百万 Token 0.02 元,远低于 Luna。V4.1 Flash 的玄虚才智也彰着更高,领有 100 万 Token 潦倒文,并扶植图文统一、用具调用和念念考模式。

但是,在缓存未掷中的普通肯求中,Luna 一经最初把 DeepSeek 模子拉进了团结价钱区间,这也意味着 DeepSeek 最具辨识度的廉价标签,从此有了一个实力苍劲的国外敌手。

Astra 冲上限,Sol 和 Luna 抢阛阓

本月早些时辰,OpenAI 发布了 GPT-6 Astra,并将其称为公司刻下才智最强、对皆进度最高的模子。Astra 面向高难度和高价值任务,但每百万 Token 10 好意思元输入、50 好意思元输出的价钱,决定了它很难成为日常责任中的默许选项。

Sol 和 Luna 承担的是另一项任务。

OpenAI 示意,两款模子沿用了与 Astra 左近的老师递次,将 Astra 在专科责任、事实准确性、编程、规划机操作和对皆方面的进展,带到速率更快、价钱更低的居品层级。

新的 API 订价令东说念主出乎预见。

GPT-6 Sol 从 GPT-5.6 Sol 促销期的每百万 Token 4 好意思元输入、20 好意思元输出,降至 2 好意思元和 10 好意思元;GPT-6 Luna 从 0.2 好意思元和 1.2 好意思元,降至 0.1 好意思元和 0.5 好意思元。

Image

关于这波降价,OpenAI 将其归因于推理基础递次和缓存效劳的改善,并称看法是为了径直让期骗户。

OpenAI CEO Sam Altman 在发布后强调,确切伏击的计划是完成一项任务要花若干钱,而在这个维度上,他合计阛阓上刻下莫得居品大致匹敌 Sol 和 Luna。

居品单干也随之变得显现。

Astra 连接负责最高才智上限,Sol 面向需要较强推理、编程和 Agent 才智的主流专科任务,Luna 则用极廉价钱贯串高频、范围化责任。

OpenAI 这次争夺的要点,一经从榜单上的最高分蔓延到每一好意思元大致完成若干责任。

官方公布的获利自大,GPT-6 Sol 的主要竞争力采集在专科责任和 Agent 任务上。

在测试跨销售、营销、运营、客服、财务和东说念主力资源等责任流的 AutomationBench 中,GPT-6 Sol 以 xhigh 推理强度取得 33.2% 的获利,高于 Claude Opus 5 最大推理强度下的 26.9%,单项任务本钱却唯有后者的 9%。

Image

它还卓著了低推理强度的 GPT-6 Astra,并以远低于 Claude Fable 5.1 的本钱取得更高分数。

Image

Agents’ Last Exam 掩饰 55 个细分行业,主要磨练长链路且具有实质经济价值的专科任务。GPT-6 Sol 在最大推理强度下得到 56.4%,卓著 Claude Opus 5 在该评测中的最高获利,单项任务本钱低了约 60%。

Image

事实准确性也有彰着改善。

OpenAI 使用用户曾标志事实瑕玷的匿名确切对话进行里面测试,GPT-6 Sol 的瑕玷数目约为 GPT-5.6 Sol 的一半,并运行接近 Astra 的可靠性。

Image

GPT-6 Luna 在较高推理强度下,则以约莫百分之一的本钱追平 GPT-5.6 Sol。

编程和电脑操作更强,OpenAI 也运行卷白菜价了

编程是 Sol 最伏击的应用场景之一。

OpenAI 浮现,里面有计划东说念主员使用编程 Agent 的范围正在快速增长,若按照 API 价钱规划,中位数有计划东说念主员每天糟践的 Token 价值一经卓著 600 好意思元,位于第 90 百分位的有计划东说念主员则卓著 7000 好意思元。Agent 接办的任务越长,推理本钱对使用频率的实现就越彰着。

在磨练代码能否径直合并进确切神志的 FrontierCode 中,GPT-6 Sol 比拟上一代彰着跨越,并以更低本钱追平 Claude Fable 5.1 xhigh。

Image

在确切代码库的软件工程测试 DeepSWE v1.1 中,Sol 最大推理强度得分为 68.8%,距离 Claude Fable 5 的最高获利 69.9% 只差 1.1 个百分点,单项任务本钱约低 80%。对比之下,DeepSeek V4.1 Flash 的得分是 74.2%。

Image

GPT-6 Luna 在团结评测中得到 66.6%,与 Claude Opus 5 和 Fable 5 中等推理强度的发扬左近,但任务本钱分裂低 93% 和 96%。

它随机顺答应担最复杂的软件工程神志,却可能成为代码检查、批量修改、轻量成就和多 Agent 并发任务中更经济的执行模子。

规划机操作方面,Astra 仍然是 OpenAI 才智最强的选拔,但 Sol 和 Luna 进一步改善了本钱效劳。

在 OSWorld 2.0 离线测试中,Sol xhigh 得到 60.5%,与 Claude Opus 5 medium 的 60.3%基本格外,单项任务本钱低约 80%;Luna 最大推理强度的获利卓著 GPT-5.6 Sol medium,本钱唯有后者的十分之一。

Image

模子的相易形式也袭取了 Astra 的调度。

OpenAI 称,Sol 和 Luna 会减少术语、乖癖措辞及价值较低的细节,恢复合座略短,同期更了了地知道我方检查过什么、莫得检查什么。关于需要集中联接的编程和本事任务,抒发是否可靠,正在与单次恢复是否漂亮变得相似伏击。

模子发布后咱们也迎来了网友的首批实测,很快呈现出两种天壤悬隔的评价。

成就者 Flavio Adamo 提前试用 GPT-6 Sol 后示意,往时在 GPT-5.6 上鄙俗需要约一小时的任务,如今鄙俗可以在约 20 分钟内完成,Token 糟践还不到原本的一半。

Image

Image

咱们用 GPT-6 Sol 实测威尼斯运河快艇游戏时,模子最终拜托了可以径直游玩的 Three.js 制品,桥洞闯关、倒计时、航迹尾流、水面反射和追赶镜头等中枢功能均能平方运行,且审好意思如故格外可以的。

Image

Bridgebench 的 3D 火箭辐射测试更径直地展示了价钱差距。

Image

Image

视觉质料上的论断却莫得那么乐不雅。

aipulsedaily 使用团结教唆词让 GPT-6 Sol 与 Claude Opus 5.5 构建纽约 Three.js 场景,合计 Opus 5.5 更圆善地呈现了街说念、出租车、屋顶、布鲁克林大桥和中央公园,还增多了部分细节;Sol 的终局更接近静态画面,吞吐相机移动和连续渲染轮回。

Image

Bridgebench 在另一组同教唆词测试中也合计,Opus 5.5 的视觉试吃和联想完成度彰着更高。

Image

Image

不外研讨到 Opus 5.5 的 API 价钱,我只可说,要啥自行车呢?毕竟性能、价钱、速率本便是不成能三角,GPT-6 Sol 和 Luna 的卖点在于用可罗致的才智,换取数目级上的本钱和速率上风。

关于追求单次最好效劳的创意任务,Claude 仍可能更有劝诱力;关于需要同期派出多数 Agent、反复迭代或长期运行的责任流,OpenAI 的价钱上风会赶快蓄积。

DeepSeek 的价钱护城河,迎来 OpenAI 的挑战

Artificial Analysis 也给出了更克制的不雅察。

其 Intelligence Index 和 Coding Agent Index 自大,GPT-6 Sol 与 Luna 的总体智能水暖和 GPT-5.6 系列大致持平,部分心志跨越,也有部分心志回退,确切权贵的变化来自本钱下落。

按照该机构测算,GPT-6 Sol max 完成一次 Intelligence Index 任务的本钱约为 1.06 好意思元,比 GPT-5.6 Sol max 的 1.99 好意思元低近一半;GPT-6 Luna max 约为 0.07 好意思元,比上一代的 0.18 好意思元低约 60%。

两款模子的输出 Token 用量反而略有增多,Sol 从约 2.9 万升至 3.1 万,Luna 从 4.1 万升至 5.1 万,价钱下落仍然对消了用量增多。

Image

Token 单价以外,OpenAI 还更新了 GPT-6 的教唆词缓存。系统会进步默许缓存掷中率,让 Agent 更充分地复用已有潦倒文,缓存输入读取可得回 90% 的扣头。

成就者刻下可以在适度台检察缓存比例和变化,也能检查哪些教唆词未能掷中缓存。

推理强度和可用用具可以在对话半途调度,同期保留此前潦倒文的缓存;新的显式断点则允许成就者决定教唆词前缀在那里实现,以便优化复用范围。

关于连续读取代码库、文档和历史对话的 Agent 而言,缓存省俭的用度可能比公开单价下落更伏击。

另外,GPT-6 Sol 和 Luna 从今天起面向 Plus、Pro、Business、Enterprise 和 Edu 用户登陆 ChatGPT Work 与 Codex,Free 和 Go 用户可在桌面应用中使用 GPT-6 Luna。

Image

两款模子暂未插足 ChatGPT 的普通 Chat 对话,关系权限会在本日寂静绽开,鄙俗来说,Codex 的绽开速率会更快一些。API 用户一经可以通过 `gpt-6-sol` 和 `gpt-6-luna` 调用新模子。

OpenAI 居品负责东说念主 Tibo Sottiaux 还告示,Plus、Pro 和 Business 账户将得回一次预存的使用额度重置,让订阅用户大致在现存周期内多使用一轮额度。

Image

GPT-6 Astra 发布时,OpenAI 展示的是模子才智大致抵达多高的位置。但万万没料到的是,Sol 和 Luna 上线后,OpenAI 也运行研讨智能密度的经济效益。

一方面,跟着 Luna 的普通输入和输出价钱插足 DeepSeek V4.1 Flash 的区间,两者的价钱鸿沟一经被彰着削弱;

另一方面,OpenAI 背后还有 ChatGPT Work、Codex 和 API 构成的、更完善的居品体系,价钱接近以后,居品进口、用具扶植、运行踏实性和成就者生态都会重新影响选拔。

DeepSeek 用廉价让通盘这个词行业重新规划 Token 的价值欧洲杯体育,OpenAI 则把这种压力带进了众人前沿模子的中枢战场。接下来,廉价不会再是某一家公司的牌号,而会成为通盘头部模子都绕不开的必答题。