三伍新闻资讯,有趣实用的生活常识!

最新更新文章排行

三伍新闻资讯

当前位置: 首页 > AI智能

闲聊的OpenAI免费,干活的DeepSeekAPI涨价,AI进入分层定价时代

时间:2026-08-12人气: 作者: 佚名

闲聊的OpenAI免费,干活的DeepSeekAPI涨价,AI进入分层定价时代(图1)

(图源:图虫)

山雨欲来。

8月6日, 发布了一则公告, 其宣布了有计划于不远的将来对API服务定价进行一体化的向上调整。关键在于, 这可不是迩来首次提及要提高价格, 在该公告里, 存在着几个字眼是值得予以留意的: 预估其上涨幅度偏大。

闲聊的OpenAI免费,干活的DeepSeekAPI涨价,AI进入分层定价时代(图2)

(图源:官网截图)

它一向凭借量大管饱的特性, 在AI领域备受众人喜爱, 然而现在突然敲定提升价格, 致使业界产生剧烈震动。

隔天, 宣布将免费用户默认的模型, 升级成为GPT-5.6 Luna后, 便又开放了, 无限量文本聊天通道。

特别说明一下, 针对免费用户来讲, 在开展普通文字聊天这个行为的时候,不会再遭受消息数量上限的约束了, 能够持续地去进行文本方面的交流对话。

一方面, 性价比之王宣布提高价格, 另一方面, 早已经培养出一群订阅制用户的情况之下, 向用户免费开放功能。

中美AI巨头,为什么会出现看似方向相反的举动?

也顶不住涨价了?

官宣要涨价前, CEO梁文锋被奉为“梁圣”。

原因之一是,实在太划算了。

去年2月26日, 有一个错峰优惠活动通知, 这个通知是在其API开放平台发布的。错峰时段是北京时间每日00:30~08:30, 在这个时段, 出现了API调用价格大幅下调的情况。有降价幅度, 其中, -V3已经降至原价的50%, 而-R1则降至25%。

今年5月22日, 宣布V4 - Pro模型API价格, 在5月31日那个限时2.5折优惠结束之后, 会永久降低到原价的1/4, 也就是把2.5折价格永久化, 而且降幅高达75%。

在进行调价之后, 出现了这样的情况, 输入当中缓存命中的部分是0.025元每百万, 还有输入里缓存未命中的部分是3元每百万, 另外输出的部分是6元每百万。

这创造了那时全球顶级大模型的最低价格记录, 在业内甚至为其赋予“通用AI大模型斩杀线”之称: 有比它价格低的, 却没有它好用;相比于贵的其他, 它不仅量大而且能满足需求。

闲聊的OpenAI免费,干活的DeepSeekAPI涨价,AI进入分层定价时代(图3)

(图源:公告)

但是,6月成为的定价策略的分水岭。

6月底, 预告V4正式版上线, 上线之后将会引入峰谷定价机制, 这个机制是, 平时价格保持不变,然而高峰时段调用价格会直接翻倍。

闲聊的OpenAI免费,干活的DeepSeekAPI涨价,AI进入分层定价时代(图4)

(图源:网络截图)

在高峰时段, V4 Pro的百万输入, 当缓存命中时, 会从0.025元涨到0.05元, 而当缓存未命中时, 会从3元涨到6元, 百万输出则会从6元涨到12元。

-V4-Flash, 每百万输入, 在缓存命中的情况下, 平时的价格是0.02元, 而在高峰时段, 此价格会提升到0.04元;对于百万输入, 若缓存未命中, 平时价格是1元, 高峰时段会升至2元;那么百万输出, 平时价格为2元, 高峰时段则是4元。官方将这种价格调整的原因归结于事更合理地配置资源以及提升服务稳定性。

闲聊的OpenAI免费,干活的DeepSeekAPI涨价,AI进入分层定价时代(图5)

(图源:国联民生证券研究所)

为什么价格会出现先降后增的情况?

人气太高带来的算力成本激增,或许是答案。

高盛于7月的研报里表明, 开展高峰时段价格调整之举, 并不表明需求转而疲软, 相反却显示出国内针对AI模型的需求始终保持旺盛态势, 且算力资源趋于紧张, 行业竞争正从早期那种激进的价格战, 逐渐回归至更为理性的定价框架。

在8月4日的时候, V4 Flash API居然已经因为“史无前例的访问量”而浮现出容量不够充足的情况了。

能够从调用的数据当中, 看出人气是多么旺盛。开源的AI Agent工具透露显示, 8月1日单独的一天, V4 Flash在它的平台处理了8万亿, 其中存在这样的情况, 5万亿是来自免费的额度, 3万亿是来自付费的调用。

,真的有点顶不住了。

目前,究竟要涨价多少,暂时未知。

可开机实验室对中外 AI 巨头们的单位调用价格做出统计, 结果发现, 在放眼全球的情况下, 中国厂商的模型于价格一端还是相当具有优势的。

通常来讲, 大模型去判断问题、回答问题所需花费的金额, 跟输入、输出的内容之“长度”存在关联。要是输出所占比例高(像是长文编写或代码生成这种情况), 那么输出价格起着关键作用;要是输入所占比例高(例如长文档剖析), 则输入价格至关重要。

按照开机实验室并非完全精准的统计, 针对国内的大模型, 从输入价格角度去看待, 当缓存没有命中地情形之下, 价格最为昂贵的那个是阿里Qwen3.8 - Max, 其价格为12元每百万 ;而价格最便宜的是阿里Qwen3.7 - Flash, 仅仅只需要0.20元每百万。要是缓存命中了, 那么最便宜的模型是 - V4 - Flash - 0731, 仅仅只需要0.02元每百万。按输出价格来作比较, 最便宜的那款是阿里Qwen3.7 - Flash, 其价格仅为0.8元每百万 ;价格最贵的是Kimi才新推出的一款大模型K3, 它的输出价格乃100元每百万。

闲聊的OpenAI免费,干活的DeepSeekAPI涨价,AI进入分层定价时代(图6)

(中国厂商大模型API价格 图源:开机实验室)

对于海外的大模型产品, 从输入价格方面而言, 在缓存未命中的情形下, 价格最贵的是旗舰模型Fable 5, 大约需耗费6.747元每百万;最便宜的则是GPT - 5.6 Luna, 仅仅只需0.0135元每百万。从输出价格进行比较, 最贵的依旧是Fable 5, 大约需耗费33.737元每百万;最便宜的同样是GPT - 5.6 Luna, 仅仅只需0.081元每百万。

闲聊的OpenAI免费,干活的DeepSeekAPI涨价,AI进入分层定价时代(图7)

(海外厂商大模型API价格 图源:开机实验室)

据测算, V4 Flash正式版完成单项标准测试任务, 那其平均成本大约是0.03美元, 仅仅是旗舰模型Fable 5的1/100左右。

闲聊的OpenAI免费,干活的DeepSeekAPI涨价,AI进入分层定价时代(图8)

(图源: )

总的来说,中国AI大模型还是以便宜大碗占据优势。

经由最新数据进行测算得出, 在上周, 也就是8月3日至8月9日这个时间段, 平台所统计的AI大模型调用量里位居前四位置的都是中国的AI大模型。其中, -V4-Flash-0731, 也就是-V4-Flash正式版处于第一位, 其周调用量达到了8.83万亿, 环比呈现出增长了570%的状况。

价格调整出现于-V4-Flash正式版上线之时, 那个时候模型调用量快速增长。国联民生研报表明, 随着智能体应用增多, 单项任务消耗的(词元)数量显著高于传统聊天场景。怎样在保持价格竞争力的情况下覆盖推理资源投入, 这正成为大模型厂商一同面临的商业化问题。

AI价值点转变

所以, 有涨价这一情况, 同时聊天是免费的。存在一升一降这种态势。看起来趋向的方向是相反的。但实际上, 这是同一条逻辑的不同方面的呈现。

提价, 所提的乃是 API 的价格, 这价格有所提升。免费, 免除的为用户纯文本对话消息条数上限, 此上限被免除。然而, 二者所面对的是完全不一样、存在显著差别的场景, 并非同一情形哟。

一方面, 那种简单的交互功能, 也就是聊天, 正加速着“去溢价化”。当免费模型足以覆盖多数用户日常所需时, 为“聊天”单独收费的商业根基正在消散离去。这样的举动, 与其说是表现得慷慨大方, 倒不如说是顺应技术进步所产生的必然结果。

AI作为“工作搭子”的价值, 在另一方面, 还远远没有见到顶峰。峰谷定价方案, 透露了一个关键信号, 价格峰值, 恰好发生在工作时间内, 也就是9:00-12:00、14:00-18:00。这就意味着, API的重度用户, 不是闲聊的那些人, 而是把它嵌入工作流的企业开发者和Agent应用。

简要来讲, 基础交互功能正处于价值降低状态, 然而生产力工具的价值却迎来了凸显走势。

那么对于AI来说,最有价值的生产力场景究竟在哪?

AI 是最先被验证能"卖出价格"的场景。

自2025年5月上线以来, 它的Code创下了AI编程市场最快的收入里程碑, 在2025年11月达到ARR(年化运行收入)突破10亿美元, 2026年2月超过25亿美元,企业客户的贡献已超过了总收入的50%。同期, 它的总ARR约为140亿美元。今年2月, 它完成了300亿美元的G轮融资, 估值达到了3800亿美元。

而以做“中国的”为目标的智谱在今年也给出了类似的观点。

3月底的时候, 于业绩报告会上, 智谱CEO张鹏作出这样的表示, 那时候提到公司API调用定价, 该定价在一季度有这样一种情况, 也就是提升了83%, 即便处于这种定价提升的状况下, 市场仍然呈现出供不应求的态势, 而调用量出现了增长, 增长幅度为400%。

张鹏指出, 长期价格的本质乃由价值确定而来, 资源具有有效替代人力、提升转化效率以及智能水平的特性, 此类资源是稀少且珍贵的。

当已经对生产力场景的付费意愿做了验证, 这一种逻辑正在朝着更广范围的桌面办公Agent领域不断蔓延。

当下,桌面办公Agent,正在成为新的主战场。

譬如有今年3月上线之后, 腾讯迅速地崛起。在今年第一季度财报里面, 腾讯宣称, 按照日活跃账户数来计算, 已然成为中国最受民众欢迎的带有人工智能属性的具备效率特征的智能体。

今年5月, 腾讯云发布公告宣称, 此举措致使其与协同工具出现大幅度价格调整, 面向企业用户的旗舰版, 价格涨幅达到了154个百分点, 基础企业专享版的涨幅同样高达100个百分点, 不仅如此, 腾讯云旗下的AI编程助手, 以及办公协同产品随之纷纷提高了企业版的订阅费用。

闲聊的OpenAI免费,干活的DeepSeekAPI涨价,AI进入分层定价时代(图9)

(图源:网络截图)

根据易观分析的《2026年Q2中国办公智能体平台市场洞察报告》, 6月的时候, PC端的月访问量达到了2097万次, 在国内排第一。

闲聊的OpenAI免费,干活的DeepSeekAPI涨价,AI进入分层定价时代(图10)

(图源:易观分析)

字节同样毫不逊色, 6月的时候, 豆包正式对外宣告, 会在免费版本的基础之上推出增值服务, 具体而言, 标准版、加强版、高级版各自都要收取包年价格为688元、2048元、5088元, 要是按月交钱, 单月的价格分别是68元、200元和500元, 1月, 字节对组织架构作出变动, 开展了ToB业务范畴内规模最大的组织调整, 飞书以及豆包的产品团队进行了合并。

近期, 则值得留意, 开机实验室察觉到, 字节跳动旗下的TRAE有在开展线下广告投放, 经易观分析那份报告可知, 这个 AI 类型的应用, 访问量仅次于别的某些呢, 后面还有表示范围之类限定的内容没说完, 此处是逗号结束。

8月3日那天, 阿里巴巴发布了全新一代的旗舰模型Qwen3.8 - Max, 其总参数达到2.4万亿, 激活参数大概约950亿, 具备1M上下文, 并且同时一并推进企业级Agent产品“千问办公”的公测, 而后者是由、、悟空这三款产品整合而成的。

中信建投持有这样的看法, 阿里等处在前列的厂商, 不断去扩大模型的规模且将 Agent 能力予以强化, 进而渐渐转向提高价格这一行为, 展现出国产大模型慢慢步入了“能力提升以及商业变现”的阶段。

AI要成为你的赚钱搭子了,或许涨价只是个起点。

标签: AI   DeepSeek   OpenAI   分层定价   生产力工具