千呼万唤,.5终于来了。
7月31日,即梦AI正式上线了.5视频模型,会员可用。
这同样是自打今年2月.0往后, 字节视频模型所进行的一回重大升级, 早在6月底的火山引擎大会时, 字节就披露有预先告知, 那时还呈现了.5制作的一些视频, 具备30秒原生4K的状况, 能够讲是成功勾起了十足的好奇心。
大家盼到何种望眼欲穿的地步呢, 在我们那些针对潜水的社群里, 差不多每天都会有人问:

一直到今天,终于等到了。
综合下来从官方所给出的信息以及创作者们相应的反馈方面来看, 我们将5最具备值得去进行测试的能力归纳成为了四项: 首先一点, 在以真人作为主体的视频里面, 人物之中所展现出来的神态变得更加逼真了;其次则是, 长镜头所具备的空间一致性以及连续性表现得颇为突出, 与此同时, 单次生成的时长限制被往上拉高了, 这样一来也就减少了因为画面拼接而产生的跳跃感;除此之外, 5还进一步地强化了视频编辑这一项能力。
不过, 即梦AI上的.5, 在此刻仅具备480P与720P这两种分辨率, 先前所说的最多可高达50个的多模态参考输入现已变为30个。除此之外, 还拥有智能编辑以及超长视频功能, 其中超长视频功能能够支持单次生成时长为180秒的内容。
想到在.5正式朝向所有用户放开接纳这扇之前的状态时, 那就有着好些创作者已经把体验资格给取得了, 并且他们进行测试所制作构成的视频, 在社交媒介上边已然积攒汇合了格外多还经过多回探讨的情况, 所以话语不繁复冗长, 在把我们最后的实际测试得出的结果进行分享之前, 先去瞧瞧在社交媒介上大家围绕着.5已经创作出了哪些十分受关注且很火的事例:
起初最为火爆的, 大概当属在日期为7月15日时进行推送并且名为火山引擎国际版相应且独此一家官方账号所发布的欧文的故事短片, 这条视频以某个特定的方式重现了在1998年世界杯期间那个年纪正好是18岁的少年的具有十足经典意义的进球。

视频的时长大概是1分45秒, 它在制作时全程运用了这种方式, 它回顾了1998年世界杯期间迈克尔·欧文对阵阿根廷时的那个极为精彩的进球, 并且呀, 视频里的画面还会不经意地穿插进小时候的欧文在街头踢球的场景, 而且整个过程里面存在着多次特别丝滑的转场表现, 所以呀你压根察觉不到哪怕一丝AI拼接时留下的轨迹, 最终组合成了这样一个完整的视频。
此条视频被发出后, 于X上获取到了一千三百二十万的浏览量, 视频发布方毫无谦逊之意地这般写道, .5完全冲破了AI视频创作能够抵达的界限。
在6月23日, 发布了多个动画短片, 这些动画短片是由AI动画创作者制作的, 且是用0.5制成, 另外, 成片的质量达到了非常高的水准。

单说画面风格的一致性方面, 其表现相当不错, 镜头的连续性上, 同样展现出色。就连作者自身, 也多次反复观看, 尝试着去不断“找茬”, 然而却又声称“讲真的, 实在是找不出任何一点瑕疵”。
来看今日, 在 .5正式发布之后, 我们最新所看到的某些事例, 像博主 “赵伯祚”, 此人亦是一名导演 , 其在快速体验了 .5 180秒的超乎寻常之长的视频功能后 , 发布了一则关于俩人俩猫送星星归家的童话故事情节。
他于视频描述里宣称, 自身借助四张角色图, 以及文字脚本, 运用一键直出的方式, 制作出了这条时长三分钟的动画片。
在这条视频的评论区,大家也纷纷感慨,“行业要被改变了”。

不过, “AI新榜”留意到, 依据积分预估, 就算存在折扣, 时长为180秒的视频那也是要消耗5220积分的。须知, 订阅价格为499元的梦AI高级月会员, 一个月整体可得积分总计才6160积分的。
除此以外的时候, 我们察觉到并发现了这么一种情况, .5去生成时长为30秒、分辨率是720P 的视频, 所需的积分数量为780 积分 , 进而折合之后的单秒价格是2.1元 ;而超长视频, 之所以这么说乃是因为其时长为180秒 , 它的单秒价格更为昂贵 , 差不多正是以2.35元/秒这样的价格呈现。在这之前的时候 , .0 1080P分辨率的单秒价格为1.38元。

.5更贵,但也更强了。
以前, .0至多支持单任务上传9张参考图, 然而, .5却将此数值直接提升到30。并且, 30个参考物能够是图片、或者视频, 还可以是音频, 也能够是3D白模。

“3D白模”,这个值得单独说一下。
我们找了一个官方的case演示,先上传一段白模预演视频,
再配上角色参考图,


在提示的词语当中十分清晰地写明, 究竟是哪一个模型对应着哪一个角色, 剧情要怎样去推进, 整体呈现出什么样的风格, 如此一来便能够达成运用白模去绘制分镜的目的。与此同时, 它还有着另外让人意想不到的支持功能, 那就是可以上传已经建好的模型动画, 告之于模型按照什么样的材质以及什么样的色调, 便能够通过一键操作来完成渲染。
该视频使用了AI生成技术

实测.5四大亮点能力
我们也针对开头提到的.5四大大亮点进行了实测。
首先是多人动态场景,来测试真人的生成效果。
提示词:
0.5针对这段城市群体形象的处置, 真切之感十足充沛, 是那种只要不瞧看水印便会认作是实际拍摄情形的水准。
该视频使用了AI生成技术
随后, 我们把难度做了进一步的升级, 将其由真人转变为长镜头打斗场景。我们预备了两张关于人物的参考图, 一张是西装男的照片, 一张是皮衣男子的照片。提示词如下:
夜晚来临前时分, 有两名男子待在天台之上搏斗, 身穿皮衣那位男士第一个抛出拳头而出, 穿着西装男子侧身进行躲避闪避之后从而再反击回去, 两个人撞到粉碎一面玻璃隔断, 破碎的玻璃朝着逆光方向飞散开了紧接着随之就在水泥地面持续翻滚展开扭打着, 一路一路进而一直打到天台尽头之处边, 视角镜头从身旁旁边横着跟拍过去, 始终保持保持中景那样的景别还有浅背景景深视野, 背景其中是城市天际线以及暖色系色调的落日, 二者相互映衬, 搏斗打斗过程当中穿插着喘息声音、拳头击打发出的声音、玻璃破碎的声音以及碎片落地的声音, 连续足足30秒的画面, 期间不进行镜头切换切镜展现。
这是.5的生成结果:
该视频使用了AI生成技术
能看到, 提示词所要求的黄昏场景, 还有打斗动作, 以及玻璃碎裂的音效等, 均实现得颇为逼真, 两人翻滚扭打之际的光影, 以及衣角等细微之处也都顾及到了, 整体成片的质感几乎不存在AI感。
可是, 或许就由于进行打斗的动作相对较为简单一些, 并且时长方面有着三十秒的要求, 这就致使处于中间部分那从翻滚进而扭打至天台边缘的那段情形显得有点单调乏味, 也就是两个人始终都在不停地翻动打。然而整体以空间而论的一致性以及连续性都被做得比较不错。
另外, .5会依据提示词自行补充完善合理的细节, 比如说我们上传了体现两只猫的照片, 打算制作一个关于泰国旅游的Vlog, 输入以下这些提示词:
用参考图里的那两只猫, 也就是图1和图2当中的猫, 作为短片的主人公, 要让它们的外观保持一样, 去生成具有真实日常vlog画风的短片。早上, 床之上卧着俩猫在被窝里进行了个懒腰伸展动作, 之后起床, 橘猫开启了荷包蛋煎制事宜, 如此这般后俩猫于桌前就座, 边瞅动画片边进食早餐, 早餐完毕, 白猫着手进行行李归拢收拾, 俩猫一道启程出发, 俩猫各自戴一个小帽子同时背一个小书包, 搭乘飞机至泰国市集之处, 一块惬意地拍摄下合照搞打卡, 画面尽显治愈且温馨, 随后开启泰国一日游玩行程: 于集市闲逛, 购置小礼物, 身着泰国服装拍照留影, 跟当地民众修习双手合十并道“萨瓦迪卡”, 来到海边畅饮椰汁。
成片完整之程度相当高, 不但全都精准无误地做完了提示词所要求的每一项动作, 还一并塞入了充满生动之感的细节, 比如收拾那洗漱用的一些套件, 乘坐飞机之时抓拍了窗外的景致等等。
该视频使用了AI生成技术
接着, 我们再度尝试了一番电影级长镜头运镜。在此处, 我们运用了文字生成, 其提示词为:
下雨天的夜里, 有由霓虹灯闪耀着光亮的夜市街道景象。在0到8秒的时段, 采用着中景来进行跟拍。有一位身着红色大衣的女性, 手里撑着一把透明的雨伞, 在人群当中急匆匆走去。那个她, 在一家馄饨摊面前停住脚步, 将手中的伞收起来, 对着摊主说道: 老样子, 多放一些辣。在8到16秒的时候, 画面切换到摊位的正面, 是中近景的景别。摊主是一个五十多岁的男性, 围裙上沾着面粉。他抬起头露出笑容, 用带着西安方言的口语回应了一句: “今天这么晚? ”手上没有停下动作, 舀汤、撒葱花。碗里有蒸汽升腾起来, 被霓虹灯映照成粉红色。在16到24秒, 画面切到了女性侧面的特写。她把碗接了过来, 脑袋低下去吹了吹, 用很轻的声音讲: “等一个人。”雨滴落于她的肩膀上面 , 在24 - 30秒时能够看到, 前景是她于摊位那儿低下脑袋吃着馄饨, 可发现远处巷子的尽头有一个撑着黑伞的人影, 那个人影刚刚抬起脚打算走过来, 犹豫了一下后又转过身去离开, 那个人影在雨雾里头越走越远。
在不依赖抽卡操作且是一次生成这个条件下, 我们所获取到的那个视频, 起初的前20秒展露出的表现情形, 基本算得上并无什么显著疑难。在人物角色的予以刻画方面, 在镜头进行推进的过程当中, 背景所配备的音效, 还有那位摊主的方言进行的对白情形, 均呈现出与提示词所要求的状况保持一致的态势, 街道所展现出的夜景氛围, 也具备着格外浓郁的生活气息韵味。然而要是仔细去进行查看的话, 招牌上面所呈现出现的汉字, 还是出现了扭曲变形的状况。

更为严重的情形出现在最后的十秒, 特别是镜头三。所要达成的那个效果是讲她回应摊主道这样一番“在等待其他人”的说辞, 是被当作实际发生的状况被呈现出来, 然而呈现的却是她坐在座位上说出了这番内容, 如此一来便会显得十分怪异。
该视频使用了AI生成技术
于是, 我们便想要顺便着去测试一下那个.5视频的编辑能力。对于好多创作者而言, 去做局部的精细化编辑能力可是十分重要的, 因其意味着你不必整个重新来过, 仅仅只需去调整那不满意的那个点。
然而, 我们发觉到, 去使用.5做编辑一个视频之事时, 无论你所做的改动呈现为何种情形, 耗费用于编辑视频的这960积分是确然需要的, 这里所指的960积分是折会后的数值, 不过, 再次创建生起变为出来一个时长为30秒长度的视频, 仅仅只需要780积分就行了。

看起来, 是去挽救一个镜头, 还是凭借运气去重新抽卡, 对于创作者而言, 这是一个。

AI视频赛道,又要变天了?
非常巧的是,也在今天发布了他们的新一代AI视频模型H3。
那日, 有两个视频模型, 朝着王座之上的.0发起挑战, 然而, 此二者切入的方向并非一致。
我们真实测量得到的感觉是, .5正沿着“虚拟摄影机”的能力持续向上推进。打破了15秒的生成限定、否定了 30个参考放入之处、破坏了那个声画同步形成, 这些参数所指向的均为同一件事: 拍摄前期。它要使你毫无凭借地塑造出一个世界, 而后按电影级别的方式将其拍摄下来。
通过社交媒体这儿创作者所反馈的情况来看, -H3所走的属另外一条路径, 也就是视觉包装跟后期特效方面。像综艺花字, MV歌词动画,logo演绎, 电商产品宣传片, 活动片头这些, 以往那是得依靠设计师手动去拉关键帧, 去套模板, 在剪辑软件里一帧一帧精心打磨的工作, H3尝试凭借一个做到搞定。它想要成为的是“后期之王”。
要是实际情况确实是这样的话, 那么这两者反而是相互补充、相互促成的, 将视频制作的整个流程给补充完整了, 并且还给热度极高的AI影视赛道再度增添了一定助力。
存在这样一个细节是可供提及一番的: H3公布会进行开源。AI视频模型进展至开源这个阶段, 这表示后续会有其他人持续去做推理方面的优化, 针对特定风格予以微调, 进而衍生出数量众多的垂直领域的特化版本。
.0统治了半年之久的AI视频,真要变天了。
充电一整晚,打工两小时:2028,解开人形机器人的“续航死结
2026年7月,优必选超仿生人形机器人U1系列因续航问题引发...(56 )人阅读时间:2026-08-01
180秒直出!Seedance2.5实测:活人感很强,单秒价
字节视频模型Seedance2.5于7月31日正式上线,是继...(62 )人阅读时间:2026-08-01
我把DeepSeek塞进Codex跑了3个真实任务,只花了0
DeepSeek V4 Flash 上线后,作者用仅剩 6....(77 )人阅读时间:2026-08-01
狂奔4天半的神秘AI,奥特曼宣判「永久停用」
OpenAI承认闯入Hugging Face的未发布原型模型...(123 )人阅读时间:2026-08-01