国庆长假期间,中国的视频模型,已经加班加得芯片冒烟,又双叒叕杀疯了。

国庆长假期间,中国的视频模型,已经加班加得芯片冒烟,又双叒叕杀疯了。

先是在临近放假前,字节为Seedance 2.5推出了Draft模式,使用者可以先用480P快速生成样片,在满意之后再输出1080P成片,痛点非常明确:

抽卡次数越多,越能节省成本。

再就是可灵4.0的内测,这可是阔别半年以上的版本更新,快手重回牌桌,依然靠的是差异化,用「影视级工作流」,以及多关键帧控制能力,主打专业化场景,扬长避短。

这似乎也和抽卡的行业痛点密切相关,可灵更侧重于搭建「摄影棚」,把随机发散的生成变成高度可控的排片。

最后——也是意料之外的——到了还有高手的环节,Vidu发布了新一代视频模型Q4 Preview,直接把首发价格打到了每秒不到1毛钱,这是前沿视频模型市场从没见过的价格带。

不到1毛钱只是起步价,真正有分量的是成片档位,就算直接出1080P,每秒也只要几毛钱,等于把高清成片带进了「角时代」,以前要掂量着点的生成按钮,现在可以放开了点,视频生产力的上限,也就跟着被抬了上去。

如果说Seedance是在设法让抽卡不那么烧钱、可灵是在让抽卡次数尽可能的变少,那么Vidu就是在反其道而行之:

只要成本够低,大家就不会那么在意抽卡,甚至可以为了追求完美,「应抽尽抽」。抢占了下一阶段的生产力入口。

我在之前几次测试视频模型的时候,就说过成本是最大的拦路虎,看似成千上万的积分,稍微「贪」一些,就能在几个小时内轻易用光,这是相当郁闷的。

况且我还只是一个测试者,那些以此为生的创作者只会更加敏感,普惠生产的爽感始终可望不可及。

更关键的在于,这并非只会拖累创作端,消费侧的体验也会受到劣化,比如因为抽不起卡,很多AI短剧公司会对影片细节降低要求,只要不影响剧情,运镜的失误、人物的错漏、动作的变形都是可以容忍的。

这是视频模型整个行业共同面对的一题三问:能力必须往上走,效率持续提高,最后还得让更多的使用者负担得起。

Seedance已经吃掉了绝大部分AI短剧的生产市场,以致于2.5版本的迭代都没有太大的震动,因为对于很多从业者来说,2.0就已经够用了,而且在效率上很难有同级别的对手。

这就是SOTA的「高处不胜寒」。

可灵有点憋屈,属于「起早赶晚集」,明明是最早杀进前沿阵营的国模代表,却再一次被字节摘了桃子,在外网,可灵4.0被吹爆的程度,和它憋着的那股劲儿,对比很有意思。

某种意义上,可灵4.0代表模型向上走的天花板能有多高,频繁赞助各大电影节的动作,也体现了可灵想要打入导演——而不只是创作者——作为供应链上游的野心。

相较之下,Vidu是实打实的一只黑马,在很长一段时间里,它藏在排成长队的追随者队列里,并没有露出爪牙,Q4 Preview的鲜明表现力,乘以亲民价格力,得出的是AI视频行业苦求多年的「生成自由」。

如果我们相信AGI是一个大周期——而不是平均一个月要降临三四次的那种——那么技术红利的「后劲儿」只会越来越大,能做视频,只是模型还原物理世界的途径点罢了,越到深水区,积累就越重要。

我还记得这条赛道刚刚开始的样子:

Runway从2023年开始领跑,Gen-3曾是公认最强的一代视频模型;

然后Pika又以别出心裁的AI特效刷了一波屏,成为媒体关注的焦点;

接着就是横空出世的Sora,尽管最后放了一个大烟花,但前半年里真是让所有同行都感到绝望;

最后是谷歌的Veo系列视频模型,配合Nano Banana,一度成为多模态领域的王者,是如今难以想象的风评;

到了现在呢?

Sora已经查无此人,Pika几乎停止更新,谷歌正忙着解决语言模型掉队的大问题,而Runway虽然还活着,却已经在官网开始卖中国视频模型的API了⋯⋯

当一个视频模型要靠销售竞争对手来实现盈利,一切就都尽在不言中了。

用「国家队」来形容中国视频模型的外战之横扫和内战之激烈,贴切之处就在于,值得关注的核心选手名字响亮,而且打法不一样,彼此之间的竞争又足够激烈,很难靠一次领先就躺下来吃老本。

选择多了之后,用户也就有了自由,是选Seedance的成熟,还是可灵的艺术,抑或Vidu的量大管饱,都意味着可以拥抱一种完整的能力布局,一个创作者完全可以在不同任务里选择不同模型,今天适合自己的工具,也未必包办明天的全部需求。

国庆长假期间,中国的视频模型,已经加班加得芯片冒烟,又双叒叕杀疯了。

国庆长假期间,中国的视频模型,已经加班加得芯片冒烟,又双叒叕杀疯了。

国庆长假期间,中国的视频模型,已经加班加得芯片冒烟,又双叒叕杀疯了。

国庆长假期间,中国的视频模型,已经加班加得芯片冒烟,又双叒叕杀疯了。