

来源 | FoST未来叙事
文 | 子路
首先,恭喜DiDi刚刚凭借《Candy》拿下法国SHAIKE Film Festival 2026 Best Short Film三强奖项!
这是一个影视行业罕见的,彻底打破类型限制,把实拍、AI、混合制作拉到同一个评选维度的电影节。来自40多个国家的450部短片同台竞技,《Candy》最终杀出重围,跻身TOP 3。

就在获奖前,我和DiDi深度聊了聊《Candy》的创作理念、过程,他投身AI影像创作一年半来的思考、行业变化等。
完整对话已发布在小宇宙等播客平台,大家可搜索【AI超创快上车】去收听DiDi本人的分享噢~
第一次看到《Candy》,我就意识到这是一个非常特别的作品。ㅤ
它完全由Seedance 2.5制作,呈现了高度复杂的运镜、转场与AI表演能力,并且保持了DiDi_OK一贯的童真底色与奇思妙想,仅B站播放量已突破500万。
某种程度上可以说,《Candy》已经触达了当下AI创作的天花板。
半年前,我和DiDi深度探讨了神作《牌子》的创作过程,他曾大胆预言,“2026年底会是AI发展的一个奇点。”
如今他告诉我,随着Seedance 2.5更新,人类已经跨越了这个AI奇点。但技术更新也带来了观众更高的期待、更多产业结构的重组、甚至一些残酷的淘汰。对此,他又提出了一个新问题。
不只AI影像,各行各业可能都要面对这个叩问:我们,真的是一个有趣的人吗?

以暴制暴的观感当然很爽,但DiDi为故事设计了一个温柔的底:坏人爆炸后隔段时间能恢复,再次犯罪则再次爆炸;爆炸三次的恶人将被放逐月球,还地球一片净土。
很有趣,他把自己的名字设计成了爆炸三次的彩蛋。

接到火山引擎Seedance 2.5的创作邀约时,DiDi_OK还没想好剧本设定,脑子里只有一个简单的念头:
我想让人爆炸成糖果,感觉很有意思、很帅。
他用2.5测试,要求“人体爆炸但保留衣服、糖果爆炸效果从颈部向上喷射”。也就测试两三次,他发现AI生成视频已经达到3D演算80%的效果,慢放之后帧与帧之间也有逻辑,他就确定,这个方向能做。
从有技术创意到测试后确定执行,只用了一个小时。
剧本创意,则来自一种长久积累的愤怒:
好像好人往往会吃亏,这让我很费解。包括国外所谓的“teenager文化”,敢惹事的小年轻能获得特权,中产反而要活得小心翼翼。
就像姜文《让子弹飞》里那句话,“好人就得被人拿枪指着,这是什么道理?”

02 死磕2.5的AI技术力,探索提示词魔法
DiDi创作AI短片有一些莫名的数字执念,他称为一种“隐形品控”:剧本构思15天,上手制作23天,短片成品尽量控制在9分钟内。
比如《Candy》,我想尽办法让它停在8分59秒。再多,好像感觉就不对了。

技术与表达的精妙融合,集中体现在转场镜头上。
作品后三分之一处有一段长达24秒的连续转场镜头,他不断用画面交叠的方式转换场景,后景仍存在,前景就已通过人物动作延伸开。
这在过去AI影像创作里是几乎不可能做到的,空间关系太过于复杂,基本都要用抠绿+3D的方式后期制作。但DiDi告诉我,这段镜头他只设计了角色位置关系的草图,其他全都是用提示词操控2.5生成的。
以前常用遮镜头做转场,但我会觉得一直这么做是一种敷衍,所以这次尝试了空间折叠并不断切换的极限操作。我希望让观众看到这个切换过程,世界各地的人都在如何面对“潘”。

这当然是困难的,他特别提到一个可能不会被观众注意到的“耸肩”:
那两个穿蓝色衣服的生化人,我想这段有后景转场、镜头拉远、前景转场,同时要求两人对话,然后右边这人耸了一下肩,表现一种不置可否的状态。
这对算力要求就会非常高,AI模型同时要顾及的东西太多了。但我就很执着于那个动作,这段我大概迭代了上千次,算是全片成本最高的镜头。
很难、很贵,但有了这个耸肩,这段戏就活了。

这就涉及到我们半年前曾讨论过的,AI表演能力问题。
当时我们都认为,AI生成的表演过于浮夸,一旦超过5秒就假了。什么时候AI表演能像话剧一样做到长时间让观众沉浸,叙事类AI影像作品必然迈入下一个时代。
也是在《Candy》制作过程里,DiDi发现Seedance 2.5能处理比过去更细腻的情绪。实验室里,年轻科学家跟着中年领导说话,他就希望做出那种急着让对方听自己解释的谄媚感,连念台词的语气都要到位。

有了这个发现,他一度玩得更开。
片中拍玻璃的女孩,原本有一段更完整的表演:前景两个人讨论问题,她在后景朝观众做手势,仿佛在求助,他们看不见我,你们总能看到我吧?
这段打破第四面墙的设计已经做了出来,女友看后却提醒,这段剧情正在交代重要信息,女孩的动作反而会让观众分心,于是他决定删掉这段表演。

删除内容还包括一条完整的宗教线,DiDi估计,自己每次最终呈现的作品,大约只有制作总量的三分之一。
虽然会舍不得一些内容,但他完全尊重女友的意见,百分百接受。
她代表了第一次看到片子的观众,如果她没有感受到,那就是没有感受到,就这么简单。
技术不断给他更多可能,留下哪些,依然要回到观看本身。
03 创作是与虚无感对抗,AI与实拍不是零和博弈
DiDi仍然在上班。
他定居伦敦,是全球最大的广告集团WPP旗下最核心的制作团队WPP Production成员,日常除了自主AI创作,还需要为国际头部互联网制作TO B宣传片、负责与各品牌合作的美术把控。
就在我们对话期间,他身上还同时有4个项目在进行中。这也就意味着每次自主创作的23天制作期会进入一种极度的“灼烧感”,每天只能睡两个多小时。
也许去领奖,反而成了一种忙里偷闲。

用AI一定不等于便宜。比如说我需要一些实景参考,就需要找专业摄影师实地拍摄,这个价格会很贵。
但这并不意味着必须很有钱才能做AI创作,即便类比实拍导演,每个人的侧重点不一样、经费需求也不一样。
这也就提出了一个新问题,在DiDi看来,AI与实拍、或所有传统制作方式,不会是零和博弈,因为AI很有可能并没有太多低成本优势。
他在工作中已经看到了许多案例,比如都市情感类内容,实拍成本更低;
包括现在各大流媒体都在探索的AI生成电影,当时长拉到90分钟,品控就未必有实拍容易。“减少人员意味着品质下降,用稳定团队进行稳定输出,成本又会上去。”
编辑
《流浪地球》编剧:“短视频怎么就不算电影呢?”
相比某一种内容类型迭代,他更关注AI技术不断进步带来的产业结构改变。
2.5时代已经有些明显,AI生成视频已经把内容的前期、制作、后期压缩在一次点击里,“开始即结束。”一个人主导的创作,也许会比一个团队的成果更成功、高效。
那原本每个细分工作都指向一个岗位的生产体系,该迎来一场多么残酷的清洗?
大学已经取消了很多专业,但我认为“有了AI就可以跨过基础美术教育”是错的。
就拿审美来讲,AI时代很需要一个作者了解饱和度、明度这些基础概念,甚至需要自己会画画,才能理解算法、把AI用得很舒服,不然始终是模棱两可的状态。
各行各业的人可能都要问问自己,我的基本功是否扎实?我在成长中是否因为虚荣而错过很多事情?
这些自我叩问最终汇聚成一个问题:当AI把一切冲散,我是否还是个有趣的人?
编辑
《Candy》里的彩蛋
现在,DiDi会有意识减少社交,他需要的健身、游泳都在公寓同一个楼里,除了吃饭睡觉就是工作、创作,最多出门晒晒太阳。
他也组建了自己的创作团队,但并不出于商业目的。团队里有女友、朋友,也有因创作共振的伴山文化创始人郑林老师,两人每周固定聊故事,大家帮助他把作品打磨得更精彩一点。
甚至在真实生活半径里,并没有人知道他就是“DiDi_OK”。他希望这个名字未来会成为一个符号,就像自己很喜欢的街头艺术家Banksy:
他是一位神秘的涂鸦艺术家,每次都会在街头画一幅涂鸦,然后消失,至今也没有人准确知道他长什么样子,是一个人还是一群人。
我很崇尚他的创作态度,我女朋友可以是“DiDi_OK”,郑林老师也可以是“DiDi_OK”,它会高度绑定在作品上。
编辑
《垃圾站》致敬Banksy最近留下的神秘雕塑
这些来自爱人、友人、师长的交流与保护,与自我表达及观众反馈一起,进一步冲淡了他的虚无感。
他会把做AI创作当作“请客吃饭”,正常上班,正常生活,发一些片子,喜欢或不喜欢,大家自选口味就好。
下一次做什么,他还没想清楚。但他知道,自己仍然想让看完的人,心情好一点。













