三伍新闻资讯,有趣实用的生活常识!

最新更新文章排行

三伍新闻资讯

当前位置: 首页 > AI智能

DeepSeek官宣即将大幅涨价,服务器终于挤爆?

时间:2026-08-06人气: 作者: 佚名

机器之心编辑部

顶不住,服务器真的顶不住, 要涨价了。

DeepSeek官宣即将大幅涨价,服务器终于挤爆?(图1)

在周四上午的时候, 那些使用 API 的同学们, 都留意到了这样的一条公告, 说是要涨价了, 且预期的涨幅将会是很大的, 虽说此次官方并没有去透露具体的幅度以及生效的时间, 不过已经建议企业与开发者要「合理规划请求量、控制充值金额」了。

AI 开发者社区里顿时炸开了锅。

长期以来, 它凭借超高的Token性价比吸纳了庞大的流量, 其中Token性价比是包含极低的输入费用、输出费用外加很高的缓存命中率的, 然而与此同时, 它面临着算力成本压力。随着模型调用量呈指数级暴增, 补贴式的低价策略, 似乎难以为继了。

在上周, V4 Flash 0731发布了, 在此之后, 大模型拥有了接近于Opus 4.8的能力, 然而, 与此同时, 它只有Fable 5百分之一的价格, 这样的成本, 在处理高并发任务时, 可以说占尽了优势, 在处理日常对话任务时, 也可以说占尽了优势, 在处理代码辅助任务时, 同样可以说占尽了优势, 在处理高吞吐检索任务时, 还是可以说占尽了优势, 于是, 很多开发者都在尽情使用。

该模型上下文长度达 1M, 速度极快, 几乎是「用了就很划算」, 任何工作都能交予它做, 毫无心理负担。

事情发展到这里, 最终重现了去年R1那个时候的热闹场面: 就在本周二, 好多开发者都反馈说, V4 Flash API老是频繁地出现Busy的状况, 或者延迟急剧上升, 又或者出现短暂停机的()情况。不仅如此, 就连APP端也出现了宕机的状况了。

DeepSeek官宣即将大幅涨价,服务器终于挤爆?(图2)

能用于编程的、具有智能特性且属于开源性质的 AI 工具, 由于套餐包含着特定内容, 致使大量用户因新模型的出现而涌入, 在 8 月 5 日这一天, V4 Flash 的 token 消耗数量已然达到了 6.3 万亿。

DeepSeek官宣即将大幅涨价,服务器终于挤爆?(图3)

已存在诸多关于V4 Flash 0731的评测, 比如说, 有个独立AI评测平台, 更新了其综合能力图, 将知名模型的价格和智力水平一同进行对比, V4 Flash 0731处于左上位置, 智能水平高, 价格还低。

它框出来的右下的那么多模型,都有着落后的危险。

DeepSeek官宣即将大幅涨价,服务器终于挤爆?(图4)

此外, 当下这仍然仅仅是个Flash版本, Pro版本推出后, 预计将会持续缩小范围。

如此看来, 似乎确实有涨价的理由。

实际上, 于上个月, 就已然预告会采取峰谷定价机制, 在北京时间每日的9:00 - 12:00、14:00 - 18:00这个时间段, 高峰期调用价格为翻倍状态。官方大概期望凭借此来引导流量错峰, 然而这样的方式看起来仍然难以全方位平衡服务成本与负载压力, 毕竟V4 Flash 0731出现之后全球各地都在使用, 24小时皆处于高峰期。

诚然, 此番涨价预告或许也是新版本发布之中的一部分。官方预计在8月上旬对 -V4-Pro 的 API 部署进行全面上线。Pro 版本乃是旗舰模型, 其拥有 1.6T 深度 MoE 架构, 此种架构激活参数约为 49B, 在长文本。(1M)、复杂智能体任务以及硬核编程方面具备超强实力。

与此同时, 围绕V4系列模型, 官方配套的生态很有可能会同步推出, 开发者能够借助更精细的框架, 这个框架含有MCP服务器、Agent执行环境以及多层调度, 把V4 Pro的Agent潜能充分发挥到最大程度。

虽是 API 涨价即将到来, 可于那些需要具备高性价比之大模型、复杂代码生成以及 Agent 工作的开发者来讲, 正式版本的 V4 Pro 以及大幅得到增强的 Flash - 0731, 仍是在开源与商业大模型阵营里极为关键的竞争力量。

标签: DeepSeek   涨价   AI模型   服务器   开发者