三伍新闻资讯,有趣实用的生活常识!

最新更新文章排行

三伍新闻资讯

当前位置: 首页 > AI智能

DeepSeek-V4-Flash正式版跑分亮相:约98%缓存命中打造极致性价比

时间:2026-08-02人气: 作者: 佚名

在 IT 之家 8 月 1 日所传达出的消息当中, 深度求索于昨日也就是 7 月 31 日借助 API 文档发布日志, 表示 -V4-Flash 正式版 API 展开了上线公测。而@、@arena 等 AI 跑分基准平台在今天也就是 8 月 1 日同步更新了与之有关的基准测试结果。

@ ( )

说的这家, 是一家在国际上处于领先地位的, 独立的AI基准测试与分析机构, 它专门针对大语言模型, 也就是LLM, 还有视频生成, 以及AI音乐等多个领域, 去做没有偏见的性能与托管成本评估。

其中, Index(智能指数)是最为核心的、具有综合性的技术基准, 它被用以全面衡量 AI 模型的绝对智能水平, 再者, 它能追踪技术演进。

有报告表明, 名为V4 Flash 0731的事物, 于人工智能分析智能指数(AII)里, 得到了50分, 其分数比在2026年4月发布的V4 Flash要高10分, 且比V4 Pro要高6分。

V4 Flash 0731的智能指数, 较GPT - 5.6 Luna(最高51分)低1分。即便今日已把GPT - 5.6 Luna的价格下调了80%, V4 Flash 0731在其自有API上面的单任务成本, 依然比GPT - 5.6 Luna(最高51分)低约60%。

致使这一差异出现的关键要素是, 有为其自身的 API 给予了大概 98%的缓存命中折扣, 此折扣幅度大大超过了业内多数厂商所提供的 90%的缓存命中折扣。

DeepSeek-V4-Flash正式版跑分亮相:约98%缓存命中打造极致性价比(图1)

@arena (Arena.ai)

@arena 也就是 Arena.ai , 那是当下全球 AI 行业极具权威性的, 基于“人类偏好”的大模型即时对战以及评测平台。它是由著名的 LMSYS Arena 团队开创的, 采用了诸如国际象棋那样的 Elo 积分系统, 借助纯粹的由人类开发者进行的双盲盲测也就是 Blind A/B , 去针对全球 AI 模型施行高强度的淘汰赛排名。

在它的细分榜单里头, Code Arena, 那也就是前端代码竞技场, 又被称作Arena, 是当下用来评估大模型网页开发能力的, 是前端工程能力评估的, 还是Agent级自动化编码能力评估的黄金标准, 并且是行业风向标。

据报告表明, -V4-Flash-High凭借1586分的成绩, 对Code Arena跑分榜单进行了重新塑造。

它的价格, 每个为 IT之家还注明这个价格对应的 现汇率状况是约合 0.28 美元 且此汇率换算成人民币是约合 1.9 元人民币, 而另一个价格是每个为 0.14 美元 其对应的现汇率约合 0.95 元人民币, 在同类产品当中它属于性价比是最高的那个。

在前端代码范畴内, 它的总体名次是第7, 于开源种类里的排名是第3!在各个种类当中, 它于消费产品领域的排名为第4, 在基于参考的设计、数据及分析、游戏领域的排名是第6, 在品牌与营销领域的排名是第7。

和 -V4-Flash-High- 相较,这属于一个明显的提高, 性能增长了 154 分, 且与 -V4-Pro- 相比, 提升程度更大, 抵达了 121 分。

DeepSeek-V4-Flash正式版跑分亮相:约98%缓存命中打造极致性价比(图2)

和其它模型对比

到 IT 之家对 X 平台展开查询, 结果发现已然存在不少开发者, 他们分享了运用 -V4-Flash 正式版的对比视讯呢:

- V4 - Flash与GPT - 5.6 Luna模型的视频进行对照比较, - V4 - Flash与GPT - 5.6 Luna模型的视频进行对照比较, - V4 - Flash与GPT - 5.6 Luna模型的视频进行对照比较, - V4 - Flash跟Kimi K3模型的视频进行对照比较。