那个拍出神作《牌子》的AI导演,携新巅峰之作震撼回归
2026-10-01 04:12:43未知 作者:徽声在线
那个打造出神作《牌子》的AI导演,携新巅峰之作震撼回归
在威尼斯的红毯上,一位备受瞩目的年轻导演正准备亮相,同时,他还斩获了两项AI影像大奖。这位小伙,或许很多人已经耳熟能详。
他的名字,就是DiDi_OK。
不久前,DiDi_OK利用Seedance 2.5技术,推出了他的最新力作《Candy》,中文名为《糖果》。这部作品,让我在初见时便为之惊叹,毫不犹豫地转发推荐,呼吁大家逐帧品味。
在AI影视圈,DiDi_OK的名字几乎无人不知。
但即便如此,仍有许多朋友可能对他并不熟悉。不过,你很可能已经看过他的作品。
诸如《箭头》、《网站》、《垃圾站》等佳作,都出自他手。而数据最为惊人的,则是今年2月刷屏的《牌子》。
这部作品在B站上播放量高达2000万,全网更是接近亿级观看。
我至今仍记得,初次观看《牌子》的那个夜晚。在循环播放了6、7遍后,我心中涌起一股强烈的感慨:
“明明都是人类,为何在DiDi_OK面前,我就如同一个只会流口水的废物?这个人的思维和审美,究竟是如何形成的?”
毫不夸张地说,这是我真切的内心独白。自那以后,DiDi_OK便成为了我心中无可争议的AI影像第一人。
而这次的《糖果》,更是DiDi_OK在主持人平行宇宙系列中的巅峰之作,将技术与创意推向了新的高度。
如果你还未曾看过,不妨先睹为快。相信我,你定会为之惊叹。
与市面上许多油腻的AI作品不同,《糖果》依然保留着强烈的Di味。
它融合了高维规则的展开、SCP的神秘感、黑镜的深邃意味,甚至还带有刘慈欣的科幻影子。
当然,还有那令人赞叹的叙事节奏、镜头语言以及审美品味。
因此,当《糖果》发布后,我觉得这是一个绝佳的机会。
我决定找他进行一次深入的专访,聊聊他的一切。
由于他身在国外,且这几天正在威尼斯电影节领奖,我们之间存在时差。在经过两天的协调后,我们终于约定了访谈时间。
访谈当天,北京时间上午10点半。
而他,则在黑山那边凌晨4点半便早早起床,因为6点多还要出发前往山里。
我们畅谈了近2个小时,我问了许多我想知道的问题。聊完之后,我觉得,我一定要将这些内容整理出来,与大家分享。
那么,接下来,就让我们开始吧。
一. 他迎来了AI的时代
DiDi_OK,是一个极具魅力的人。
他长期定居伦敦,在WPP Production工作。
WPP是全球最大的广告与营销传播集团之一,大家耳熟能详的奥美,便是WPP的子公司。而WPP Production则是WPP旗下最核心的制作团队。
因此,在AI出现之前,DiDi_OK便一直在动画、3D和游戏相关领域深耕。
他的本硕专业都是动画。
后来进入WPP后,也是从动画做起。
他前往英国的故事也颇具趣味。
那时,他还在国内与朋友合伙开工作室赚钱,主要拍摄广告等。
但做着做着,他突然觉得这件事变得乏味起来。
有一天下午,他们正在外面拍摄广告。
他突然向朋友提议:要不我们出国吧?
朋友问他:去哪里?
他说:要不然英国吧?
去英国的原因也颇为离奇,
因为他们以前拍完片后,半夜会一起观看影视飓风节目。而Tim也是DiDi_OK的赛博偶像。
既然Tim以前在英国,
那不如就去英国吧。
于是,他回家学了半年英语,并申请了伦敦艺术大学。
起初,他妈妈甚至没帮他报名,因为觉得他绝对考不上。
但最后,他还是偷偷报了名,并且真的考上了。
几年后,
这位当年拍完广告半夜看影视飓风的小伙,受Tim邀请,坐到了影视飓风的AI课程里,与大家分享自己的创作心得。
你看,世界总是充满奇妙的循环,人生有时也真的像一个略显俗套的剧本。
在AI之前,他其实就已经开始在创作了。
2021年,他在伦敦艺术大学创作了一部名为《Moth》的作品。
而且,从那时起,他的作品就已经颇具Di味了。
在一个被雾笼罩的封闭世界里,中央矗立着一座巨塔。
所有人都认为那里绝不能触碰,但主角却像飞蛾扑火一样,一定要上去一探究竟。
哪怕真相令人失望,哪怕会付出生命的代价。
他也想看一眼,世界真正的样子。
他的脑海中,关于科技、未知世界、文明的想法实在太多了。
但在过去,限制他的是那个时代的生产力。
传统动画的工作流程实在太长,几乎不可能由一个人独立完成一部影片。
流程一多,人就多了起来。每多一个人,你脑海中的想法在传达出去时就会损耗一点。
再经过建模、绑定、动画、后期等繁琐流程,损耗更是不断累积。
到最后,你脑海中的那个创意,在最终屏幕上呈现时,可能连一半都不剩了。
因此,这些年来,他一直在研究一个东西,用他的话说,那就是:
力道。
如何让自己脑海中的创意和感觉,尽可能最低损耗地传达给观众。
而终于,他等来了他的时代。
AI,来了。
二. 《糖果》:坏人会爆炸
如果让我来介绍《糖果》,
我可能会认真解释半天:
这是一个关于一级文明、外星规则、暴力、秩序、人性和科技发展的科幻故事。
但是,当我让DiDi_OK来解释时,他自己想了想,只用了十个字左右:
“坏人会爆炸,好人就没事。”
极其朴素,但又精准无比。
这个故事一开始,人类能源使用能力达到了抵达一级文明的门槛。
然后,土星的一颗卫星“潘”跑到了地球附近。
接着,全世界开始发生一件特别离奇的事情。
只要一个人准备伤害别人,
砰!他就会爆炸。
这个爆炸不会变成血肉模糊的场景,而是会变成:
一大堆糖果。
一开始,大家都懵了。
是外星人?新型武器?还是上帝的旨意?
后来慢慢发现,这个规则只专门针对:
暴力。
DiDi_OK给它设定的底层判断标准也非常具有中国特色。
就是四个字:起心动念。
这部作品上线后,我看了4遍。当时我问了他一个让我感到非常矛盾的问题:这明明是一个反暴力的故事,
可大家看的最大的爽点,却是看坏人被另一个更强大的力量给干掉。
那这件事,本身就不暴力吗?
DiDi_OK当时就笑了,说我看到了精髓,而且,这其实就是他故意的。
片子后来把反复违反规则的人送去了月球。
看起来仿佛太好了,文明和平了。
但这件事情背后,却依然带着群体暴力的影子。
因此,他甚至花了很长时间设计片子里代表大众意见的女性发言人。
他想让她拥有一种特别容易被大众接受、信任的气质。
有点像《三体》里的程心。
因为这件事情本身就带着一种“所有人都觉得这一定是对的”的危险。
DiDi自己也没有站在绝对非暴力的那一边。
他觉得现实里常有一个很残酷的问题:
善良的人,往往就是被欺负的人。
所以从中世纪的西方骑士到中国的侠客,
人类几千年一直在幻想一件事:
正义最好拥有力量。
于是这个时候,《糖果》的内核变得不一样了。
一颗外星卫星拥有判断什么是恶的最终解释权,全人类因为恐惧惩罚而文明,然后大家集体同意,把不符合规则的人送去月球。
这到底算文明?还是秩序?又或是暴政?还是一个比我们现在稍微好一点的世界?
DiDi_OK没有答案。
这个问题,属于每一个观众。
三. AI的真正进步
访谈之前,我把《箭头》《牌子》《网站》《垃圾站》等等DiDi_OK的片子又重新全部看了一遍。
其实有一个最明显的变化,就是《糖果》这部片子,因为用的Seedance 2.5技术,所以终于敢变慢了。
比如这个教科书级别的长镜头。
讲道理,以前DiDi_OK的片子还是经常会快切的,比如《箭头》和《牌子》,经常5秒就会换一个场景。
理由特别简单,AI影像行业里的大家,可能都猜到这个现实原因。
因为你不敢慢,因为模型能力完全达不到。
过去的模型能力,是无法支持长镜头的细节不变的这种镜头叙事的。
于是呢,就只能不停用新的视觉刺激,把模型来不及暴露的问题给掩盖过去。
但是《糖果》里,第一次出现了大量安静的叙事。
比如这个镜头。
实验室里,一个年龄稍大的官员往前走。
旁边年轻研究员一路跟着,态度非常谄媚,期待被注意。
但是官员一直很冷淡,直到突然搭理了他一句。
那个年轻人的身体立刻微微再弯了一点,眼神亮一下。
这时候,你能看出来:
“诶,他听到我说话了。”
但DiDi说,这才是他觉得模型真正突破的地方。
表演。
以前他一直觉得AI表演过不了关,那些表演的细节度不够,所以,一直会少这些叙事。
现在Seedance 2.5在他眼里,这个鸿沟已经正式跨过去了。
开头那个女孩吃糖的镜头也是。
他特别在乎女孩脸上那个小痘痘。
我甚至第一次看的时候,都没有注意。
但是对DiDi_OK来说。
这是一个极其重要的信息锚点。
因为这个极小的信息点,会让观众第一眼看到的时候,会觉得,这是一个真实存在的人。
当演员的脸本身可以提供信息的时候,导演才敢把镜头停在那里。
还有这个手指甲超近特写下,皮肤和指甲的质感。
还有这个超近景特写中,角色呈现出来的高精度皮肤微观细节,包括毛孔、细纹、皮脂光泽及受光变化;同时细微表演如眼神、呼吸、肌肉牵动与微表情均具备可信度。
而这一点,DiDi_OK说,这种细节度和精细度,只有Seedance 2.5才能达到。
他觉得,这个模型,至少给他省掉了60%的叙事成本。
这个词我特别喜欢。
大家天天聊AI降低多少制作成本。
他聊的,是叙事成本。
我觉得,真正改变叙事的,从来都不只是所谓的分辨率更高或者价格更便宜。
是我们过去你只能绕着模型的缺陷去讲我们的故事。
但现在,模型开始允许我们,按我们脑海中的想法去讲故事。
这才是,真正的进步。
四. Seedance 2.5改变的一切
对于Seedance 2.5这个模型,我们聊了很多。
DiDi_OK说,假如现在有人告诉他。
以后这辈子都不会再有新的视频模型。
只能永远用Seedance 2.5。
他觉得,也够了。
因为坦率的讲,从我的视角看,Seedance 2.0发布的时候,全网的反响远比这一次2.5大。
但那时候,DiDi_OK觉得,2.0还可以,确实震撼,但是好像没有那么大的变革。
直到这次Seedance 2.5。
可能很多人第一眼觉得,啊?不还是AI视频吗?跟2.0区别也不是很大啊。
但是DiDi_OK觉得,这反而是一次真正意义上的跨时代升级。
我问他:到底跨在哪?
他说了两个词。
高度定制化。
高精度的运动规律。
这两个词听起来特别技术。
尤其“运动规律”,实在是没有所谓的“电影感”“1080P”“一镜到底”听起来性感。
但观众的眼睛特别诚实。
比如一辆车拐弯,车身应该有侧倾,悬挂应该有压缩,刹车和加速应该产生不同的俯仰。
一颗糖从人体里面炸出去,它应该有质量,有初速度,撞到东西以后会反弹,几百颗糖之间还会互相碰撞,跟镜头的距离不同,虚实也不一样。
所谓运动规律,其实就是:这个世界到底符不符合我们从世界认知到的物理规律。
所以《糖果》里面那个最核心的“糖果爆炸”,其实也是AI能力的一次极限测试。
DiDi_OK说,现在Seedance 2.5出来的视觉,已经可以经得起慢放和暂停了。
他甚至故意设计那种让大家来暂停看看的镜头。
就比如警察局的这场戏,画面里面同时有很多人,DiDi_OK给后面一个黑人角色单独设计了一条故事线。
先挣脱、然后推桌子、拿起电视,再准备攻击警察,随后灯光闪烁,所有人的动作短暂停顿,特定的人同时炸成糖果。
DiDi_OK借助模型的能力,同时指挥十几个人的动作,每个人都有自己的故事线。
这就是DiDi所谓的第二个特点,定制化。
因为过去,我们用AI做一个怪兽啥的,其实真的都不算难。
难的东西往往都很日常,比如“让左边第三个人先往后看。然后拿起电视。右边警察继续保持现在动作。灯闪以后第二个人爆炸。”
AI真正进入工业生产以后,最需要的能力,恰恰是这种定制化。
DiDi_OK说,从画面上,他感觉,几乎没有什么是他想实现,但是实现不了的了。
比如一堆糖果组成马蒂斯的《舞蹈》。
微缩景观下的移轴动画。
等等等等。
因为模型能力的增强,运动规律和可定制化都变得极强,所以也带来了另一个变化,过去的工作流很多就有点跟不上版本了。
比如过去,为了一个镜头,可能要垫好几张图,来让模型理解。
所以,他说那时候,他有一个很明确的优先级:
参考图,大于提示词,大于模型选择。
甚至为了让模型完成它能力本身完成不了的动画和运镜效果,他会大量使用Blender来建模进行参考。
比如角色和表面之间的运动追踪,就像手机屏幕上的字,以前AI生不准。那就一个字一个字追,全是后期进行人工修复的。
基本就是能工智人。
本质上很简单,都是因为模型能力达不到,而DiDi_OK又不想降低自己的作品效果,就会用很多其他手法来进行弥补。
然后,就来到了《糖果》。
他说,这套逻辑明显开始反过来了。
参考图的重要性明显下降。
Prompt的重要性开始疯狂上升。
因为模型理解能力变强了。
很多过去必须先做好的关键帧才能做的动画,现在可以直接用嘴说了。
所有的传统辅助是一个没用,很多过去要额外做两个星期的后期,也消失了。
DiDi_OK说,这是他第一个,几乎百分百纯度的AI片子。
甚至他用上Seedance 2.5之前,他已经用2.0做了3分钟的《糖果》了,做了将近40%,在他用上2.5之后,毅然决然,全部推翻重来。
这也是这个AI时代非常操蛋的一点。
你的苦心经营的半年的技巧,还有很多所谓保持一致性的工作流,可能就会被一次模型发布直接吞噬。
DiDi_OK说,那些都属于小数点后面的技术,他现在也越来越没有兴趣了,真正决定你上限的,还是你的个人能力,还有模型本身的理解力。
当模型开始吞掉工作流。
创作者剩下来的,才是真正属于创作者的东西。
五. 创作到底是什么?
我问DiDi_OK:“你觉得AI真的能算创作吗?很多人说,不就是抽卡吗?创作在哪里呢?”
他给我讲了一个特别好的例子。
2023年,他参与过一个F1赛车宣传片,实拍加虚拟制作。
那时候,很多镜头可能要NG500多次。
一天光场地费,就是10万英镑。
赛车漂移过去,轮胎擦地,然后烟冒出来了,导演觉得,那个烟不好看,再来。
所有调度一切归位,然后再来一遍。
就这样,不断的Roll,不断的挑选。
直到导演觉得,这个第397次的烟最好,就用这个第397次的镜头。
所以,DiDi_OK说,创作,从来都不是生成多少次的事,也不是AI不AI的事,因为本质上,传统影视,也是抽来抽去的逻辑。
真正的创作,是那个“不要”。
为什么这个导演,要第397次呢?前面那396次,为什么都不要呢?
这个“不要”,才是审美,才是判断,才是经验,才是那个真正的。
创作。
只不过,在AI加持之下,抽卡的速度变得越来越快,质量越来越高,是以前的传统影视,远远不可企及的。
但是反常识的是,模型越来越强以后。
DiDi一点都没有更轻松,反而更痛苦了。
过去一颗8秒镜头,磨两三天就差不多了,因为你知道,模型就那样了,上限就在那,可以安慰自己,这不是自己的问题。
但现在,有了Seedance 2.5这种级别的模型,第三次就能给你一个特别牛逼的结果。
那说明,它能做。
这时候,压力就全部给到DiDi_OK的身上了。
为什么我调度不出来?
为什么没想到那个机位?
为什么还不够好?
以前两三天一个镜头,现在他甚至可能磨一个星期。
他说:
“模型是明显能做到的,但是我却做不出,那明显就是我自己的问题,我还是太菜了。”
AI时代,也是一个残酷的时代。
当表达成本越来越低的时候。
平庸也会越来越没有借口。
聊到最后。
我问了他一个特别大的问题:“你拍了这么多文明、规则、社会、人性的东西,那你自己心里最底层,还相信人类吗?”
他说:“如果聊人类本身,那我一定是一个极度的悲观主义者。”
他说自己有时候,会陷入很严重的存在主义危机。
当AI真的能帮你完成越来越多事情的时候。
你自己到底还剩什么?
他公司里的新人也经常问:
老师,以后应该学什么?
他也不知道。
然后,他说出了我觉得整个访谈里,我最动容的一句话:
“当AI能帮我做所有事情的时候,我到底,是否真的是一个有意思的人呢?”
没有答案,就像他的作品一样。
访谈结束以后,我又把《糖果》看了一遍。
我突然觉得,这部片子更好懂了。
DiDi_OK明明说自己对人类这么悲观,可他的作品里,总是有一种特别奇怪的底色:
希望。
突然感觉,在他的身上,我看到了徽声在线一个角色,就是维德的影子。
他可能平时不是特别愿意跟人互动,甚至对人这个物种有时候有一些悲观判断,可到了最后,他跟维德一样。
不希望人类输。
我特别喜欢这个矛盾,因为很多伟大的创作者,很多时候就是这样。
他们创作。
很少因为觉得这个世界已经很好了,恰恰是觉得它还不够好。
所以才会创造另外一个世界。
那个让很多人,能跟他一起感受美好的。
美妙世界。
以上,既然看到这里了,如果觉得不错,随手点个赞、在看、转发三连吧,如果想第一时间收到推送,也可以给我个星标⭐~谢谢你看我的文章,我们,下次再见。
>/ 作者:卡兹克
>/ 投稿或爆料,请联系邮箱:[email protected]