
V4 Pro正式版0813上线了,主要升级了Agent能力,网页,API,app现在都可用了, 也重磅亮相,我第一时间做了测试, 是最大的惊喜,它和我用过的所有Agent都不一样,废话不多说了,直接看重点。
V4 Pro跑分如下,整体提升感觉没有flash那么惊艳,网络安全能力这一项比较突出超越。

API价格更贵了。
涨价前:

涨价后

统一成一张「涨价前 vs 涨价后」的表格。按每百万 计算:
涨价时间:2026 年 8 月 17 日 00:00(北京时间)
高峰时段:9:00–12:00、14:00–18:00;其余时间为低峰/空闲时段。
我用我的经典模拟火星登陆题目测试了一下,
用HTML和three.js制作一个火星登陆模拟过程,全程要符合物理过程,逼真,发挥你最大的想象力,开始吧
结果比较困扰,三个都是完全一样的提示词,max档位,以下是对比:
结果是kimi K3依然是最好的(花费时间大概1个半小时),但奇怪的是V4 pro 0813(花费时间大概30分钟,需要说明的这是还没正式官宣时测的,只是API页面显示更新到了0813,用的,cc效果也差不多)效果竟然感觉没有 V4 flash 0731(花费时间20分钟左右)好,测得我都郁闷了。
V4 flash 0731确实是一个怪兽级模型,当然这一个说明不了很多问题
V4 pro 0813具体表现还需要大量的实际生产测试。
另外 v0.1 现已在开发者预览版中推出!
现向全球开发代理框架的开发者开放,并以 MIT 许可开源代码库。
由 元框架驱动, 是一个围绕一个核心理念构建的代理框架:一切皆插件。模型、工具、技能、会话、沙箱、文件系统、循环、编排和 UI 全部作为插件实现,可以自由组合、匹配、替换和扩展。
试用地址:

我第一时间用 又重测了一下模拟火星登陆,这是官宣后我新建的API key,肯定是正式版的V4 Pro,

测试过程发现了一些非常有意思的东西,假设某个功能现在没有, Agent 在执行任务的时候,可以自己发现缺少某种能力,然后自己完成开发、安装和调用,这个与DSH设计有很大关系,感觉有点自我进化的意思?
比如识图:

还有一个轨迹模式,也非常有意思,现在完全可以知道 Agent 的工作进展,你的 Agent 员工具体的思考步骤,调用工具,工具返回结果都清晰可见。最有意思的是,它会用不同颜色区分 AI 执行任务时产生的各种内容,比如橙色代表工具调用,绿色代表上下文,然后其会向轨迹一样在顶部展示。

对话框下面还能实时看工具调用,缓存命中,token速度,输入输出token等。

最终交付花了大概1个半小时,结果不太理想,主要物理过程实现有问题,但设计和审美还是在线,毕竟这才是DSH0.1版本,下面是无删减单次shot结果演示。
这两天我会用 做一些测试看看,同时发了一篇80页设计论文,值得好好研究一下。

我的整体感觉是对 非常重视,站的高度很高,有点像AI时代真正的操作系统雏形,自我进化是其中一个核心,还是开源的。
具身智能迎来「DeepSeek 时刻」:国产机器人用更低成本
自变量双臂机器人仅用标准夹爪,在传送带前连续一小时分拣181...(57 )人阅读时间:2026-08-14
DeepSeek Harness和V4 Pro正式版同时重磅
DeepSeek V4 Pro 0813正式版上线,重点升级...(144 )人阅读时间:2026-08-14
两年造出旗舰SoC,这家无锡创企想让端侧AI在一颗芯片上跑通
端侧AI热度持续攀升,市场预计将高速增长。为支持AI应用,诚...(101 )人阅读时间:2026-08-14
从0到1带你全方位了解DeepSeek Harness到底什
DeepSeek开源的Harness发布,GitHub速破万...(84 )人阅读时间:2026-08-14