复刻《牛来》的成本与挑战分析
- 845
制作粗糙的角色建模与令人捧腹的台词,听说《牛来》是一部由两位创作者用五年时间制作的电影,谁能不心动,想试试用AI创建自己的《牛来》呢?我也没能抗拒这个诱惑。于是,先观看了成片,下面是《牛来》中广为流传的“喊妈”片段。需要声明的是,由于我是新手,技术水平有限,希望观众多多包容。在制作这个视频时,Seedance是一个显而易见的选择,尽管效果出众,价格却有些令人担忧。因此,我希望找到一个更具经济性的解决方案,毕竟《牛来》的制作本身并不需要涉及复杂的特效。对于我这样的新手来说,易用的工具更是高效的关键。
恰好在七月底,MiniMax刚刚推出的MiniMax Design工作台将图片、视频、音频和简单的剪辑整合在同一平台上,非常适合我们这种临时起意的人来尝试。用户只需直接告诉模型想要完成的任务,Agent就会自动选择合适的工具。这一特点特别适合《牛来》的制作:没有电影级别的特效,只需要几个低多边形角色和短小精悍的段子,追求的是便宜、快速,以及幽默。因此,我决定本着“能用AI解决的事就尽量节省开销”的原则,试试制作的感觉。
第一步不是先写脚本,而是先定义牛的形象。我开始在网上查找素材,虽说盗摄不太妥当,还是决定先试试看。工作台的一个优点是素材不会在制作时变得越来越杂乱。我选择了五张最能体现牛角色特征的参考图来生成五视图;视频制作完成后,再将角色的五视图与场景图结合使用。新生成的结果会主动关联到相关素材,从而形成一幅引人注目的节点图。
这次的Agent先后调用了G Image 2和四次香蕉Pro,总计只消耗了MiniMax Design的450积分,折合大约3.15元。这样就完成了几个主要角色的基本建模,确实非常划算:牛妈妈的五个视角基本一致,尽管最显著的鼻部特征被磨平,变得较为普通。这并不是因为建模技术差,而是因为它太过于追求角色的“标准化”。在检视角色的过程中,需要首先确认轮廓和比例,再看口鼻及肢体部分,最后关注材质。虽然找不到更好的参考素材,角色设定暂时就定下来了。先创建角色的主要目的是保持后续视频中的人物形象的一致性,避免在制作过程中出现变形。事实证明,MiniMax Design在标准化制作流程上保持了人物一致性的效果相当不错。
接下来,我随意添加了一些短小段子,让模型开始制作内容。工作台的另一个优点是启动过程没有障碍。选择模型时保持“自动”,Agent会根据需求调用MiniMax H3或Seedance 2.0 Fast,然后将视频与角色图和场景图连接。生成后的时间线可以进行裁剪、变速、分离音频,直接导出,不需要再启用其它剪辑软件。不过,需要注意的是,和文本类型的Agent不同,这个任务流程几乎是单线程的。制作一段10秒的视频大约需要15分钟,其他项目只能排队等待,这也是这个App功能设置的一个缺陷。Codex和Claude code都支持多线程操作和多模态能力,而MiniMax design在有一个视频生成时,其他创作只能静静等待。这样的单线程设计对视频制作的效率造成了影响。
令人欣慰的是,成品的画面一致性超出了我的预期,牛来仍然是那个红色的小个体,妈妈也保持了棕黄色的身体和两只角。然而让我觉得痛心的是修改环节。我本想把《牛来跳河》中的“中国人能飞”改成“中国牛能飞”。可Agent调用Seedance进行视频编辑时却报错了,随后自动切换为Speech-2.8-HD来补充音频。虽然Agent的这种自动切换策略很聪明,但实际的效果却令人失望。画面没有变化,声音却突然换了另一种音色,显得极其突兀。对Agent来说,任务完成了;对观众来说,这头牛就像突然换了配音演员。
在开头的“喊妈”名场景的调整中,我也遭遇了类似的问题,主要出在声音的准确性上。调整音频几乎只能通过提示整体修改视频声音,然而最终产出的音频与视频的契合度极差,几乎无法使用,只得考虑重新制作一个完整的视频,这样一来,token的花费也就不小了。尽管声音调整欠佳,但MiniMax在画面调整方面的表现其实还算不错。在“迷宫问路”的段子中,最初版本无法清晰呈现牛与蛇在迷宫中的关系,导致整个视频的逻辑失效。在经过两次针对性的修改后,终于呈现出了“迷宫”的感受,画面也得以使用。