打开网易新闻 查看精彩图片

文│骨朵AI‍

4月上线的原生多模态模型快乐小马(Happy Horse)在市场上的评价褒贬不一。为客观验证工具实操能力,骨朵AI组成了嘉宾测评小组,用一场足球赛的片段为统一脚本,让几位测评者使用快乐小马完成创作,拆解产品优缺点,横向对标Seedance、可灵等主流工具,评测快乐小马使用中的优缺点。

注:本文为直播+正式测评对话整理

主持人:芈木木|骨朵AI合伙人

港科大AI领域资深研究员,曾任职字节跳动商业产品部,商汤科技(AI大模型及人工智能解决方案科技公司)AI产品部

测评组嘉宾:无限画布(吴老师)|电影美术指导,AIGC创作者

长期深耕影视美术赛道,曾任多部院线、剧集项目美术指导、概念设计师,参与代表作《阿修罗》《幻城》《无问西东》《龙牌之谜》等;2023年全力布局AI视觉影视共创。产出《星空的回望》《月球漂流记》《一九三七》等多部获奖AI科幻短片,其中抗战题材AI短片《一九三七》斩获2024年国际网络电影节最佳短片奖,精通AI漫剧、商业AI宣传片、概念预告片全流程制作。

测评组嘉宾:孙斯宇|剪辑师、影视行业资深AIGC讲师

拥有十余年传统影视全流程从业经历,2022年深耕AIGC视觉生成赛道,精通StableDiffusion实操;擅长打通传统影视工业化流程与AI技术,在画面质感、镜头调度、AI视频生成效率优化、视觉创意创新方面拥有大量商用实战经验。

测评组嘉宾3:锦鲤小金金|编剧、个人AIGC创作者

剧本杀头部主持人、自媒体博主、OiiOii超短剧练习生,出版专业编剧工具书《剧本游戏写作入门》;手握多项影视类奖项,代表作包含《微雨燕双飞》《时空电话》《凤逆天下》等短剧,自制漫剧《床底17天》《山鬼》《不存在的车站》,深耕AI短剧剧本创作多年。

打开网易新闻 查看精彩图片

光影效果好,但人物逻辑失控
木木:关注我们直播间的朋友们都知道我们最近的直播开始做AI工具相关的测评。这一次我们测评的是阿里自研的、原生多模态的 AI 视频生成的大模型,它有一个非常可爱的名字叫快乐小马 happy horse。

快乐小马在今年4月底的时候开始灰度测试,很多创作者也对这款产品进行了试用,这次我们统一选用世界杯足球对抗作为创作题材,虚拟了中国队和外国队,三位嘉宾拿到同款基础剧本框架,分三段标准镜头:0-15秒广角赛场全景、15-45秒球员对抗中景、45-60秒人物情绪特写,约束球场、球衣配色、观众、光影等基础提示词,单人成片目标1分钟。大家分别基于自身创作习惯调整提示词、参考图,直观对比不同使用思路下快乐小马的生成效果。

金金:这次想表现在一场足球的比赛当中,错失了绝杀的良机。我本来希望用模型能有全景特写,能体现出人物情绪的起伏。另外因为构建了七八个人物,希望也能进行一个人设的统一,也在提示词里面对光线和氛围都进行了约束。此外对于足球赛规则下的人物站位也做出了约束,现在请播放这个作品:

这个作品我是在官网上直接做的,这里要表扬一下快乐小马的界面非常清晰简洁,对于新手很友好。我把这段拆成了5段,分别生成15秒。但试用时感觉意外还是比较多的,有一些视频重复出了很多次,最后成片后对素材做了剪辑,把能用的东西都拼在一起,我觉得实在就以我目前的制作水平,我没有办法再做得更好了。最后这段视频大约总共花了60块钱,但是我认为再多花钱也不会做得更好了。

孙斯宇:其实整体来说人物一致性还可以,至少能在头几帧保持人物是原来的人。但是快乐小马就是如果提示词给的太详细了,反而会抽风。但如果参考给的不够多,人物劣化就会非常的严重。我试过光用文字描述没有给参考图,结果每个人脸上都是马赛克。后来又试过提示词给子五百到六百个字,结果人就基本上全是静止不动的了。
无限画布:快手小马是没有生图功能的,所以要做视频就只能把图片做好后丢给它,然后用“智能多参”功能,刚才金金老师做的光影还是不错的,但动作就出了很大问题,人物一致性有时候也不准确。
羋木木:金金代表了有传统的影视知识但刚开始用 AI 制作的、偏新手的水平。确实会发现有点玩不转,生成视频总是很难达到脑中的画面,这可能也是用编剧的思维去构建它的时候,我看你给的提示词以我看是一整段,可能编剧语言让工具无法理解了。因为金金是先后做了几次,所以我们也来看看中间踩的坑,放一下有明显故障的几段视频:

羋木木:他们俩在干嘛?面对镜头气就是那种很气鼓鼓的表情,你当时想让他呈现的是什么样的一个画面?
金金:这是在球门禁区前的双方对峙,我想让他们俩面对面,试了很多次,一直改提示词,不知道为什么会有这个问题。也许我看足球不是特别多,不是行家,
无限画布:好像是在对观众怒目而视,也不知道他们是在研究什么。挺有意思,这样的情况会出现,也是 AI 给我们的惊喜。

羋木木:更魔幻了,我笑点太低了,守门员为什么站在那么远的地方,然后对着旁边的人去喊,是不是提示词出了问题。吴老师明白这个逻辑吗?
无限画布:早期的模型不够智能,比如我们让一个人转过身背对观众,如果你对他的面部进行了详细描述,就发现生成后他脸总是会朝着观众,因为 AI 会默认你给他的信息要展现齐全。所以快乐小马还是比较初级,不太智能。
羋木木:市面上的大模型现在已经不大出现这些问题了,但快乐小马可能在这些细节上还没有跟上这些更好的模型。这个是没有跟上通用模型的进度,那我们再来看下一个视频。

金金:当面临球门的时候,因为守门员和射门的人本身就是对立位,现在就没办法实现,这还是人物站位逻辑的问题。
孙斯宇:我觉得主要跟提示词有关,快乐小马主要的问题就是它对物理的理解是比较差的。Seedance商业化比较好,主要是因为它对物理环境这些东西理解的比较好。现在主要是有提示词污染的问题:比如在描述一个人物满头大汗、表情紧张这些问题之后,他一定会给你正面的视角。如果你没有描述,只是说想要一个射门的镜头,提示词前面写上手持跟踪镜运镜,它就默认镜头一定会在人物身后。所以如果说给他只有一个手势的背后跟踪,他就跟踪从后背角度射门,在面对守门员的时候就又不行了。

打开网易新闻 查看精彩图片

缺乏首尾帧功能
金金:孙老师描述的很有专业度了,因为我自己偏小白,如果要做到这种程度需得去学更多镜头语言。其实是不是用首尾帧功能会更容易出来?因为用首尾帧就能把它们的位置提前排好。我用的是多参。
无限画布:快乐小马它没有首尾帧的功能,所以就没有办法完成这个要求如果想要解决就只能是我们给一张已经做好的参考图,参考图的门将和就是前锋是面对面的状况,也许还能会做得好一点。
羋木木:那我补充问一句,现在像比较火的这种什么即梦、可灵,包括libTV和Tapnow这一类工具,首尾帧是必备功能吗?
无限画布:是的。大约2024年的时候,最早的那款风靡全球的runway开辟了首尾帧功能,当时一下子就让AI 的视频制作成为亮眼的新事物,也让特效制作变得很简单,比如我们可以直接从一个人变成一个妖怪。或者是从像上面说的,从远到近。所以我很惊讶快乐小马居然还没有具备首尾帧的功能按理来说这是 AI 视频应用的最最初级必备的功能,尤其是我们在做商业广告当中,它是必备的功能。
羋木木:我也想问一下现在的快乐小马能生成多长时间? Seedance2.0的时候是15秒,现在据说新的模型需要的是25秒?
金金:Seedance新模型是30秒,目前快乐小马是15秒。15秒确实它没有首尾连贯的话,会很突兀的。我们再来看下一个视频吧:

金金:这一段做的像短跑运动员。按理说是人物往前带球跑,后面外国运动员追,但将近十几秒的过程中他们一直在跑,100m 冲刺都冲完了,最后一个镜头是跑着跑着突然球门歪了,就跑面向他们的,这是怎么回事?吴老师和孙老师知道吗?
孙斯宇:大模型可能有很多素材,所以还是提示词不够严谨的问题。你跟他说球门,可能他底层数据大部分都是正向的球门,大概率就会抽到正向的素材。这个问题可以用多参解决,你在生图生视频的时候可以加一些参考图,会发现快乐小马最大的优点就是:如果你参考图给的够细,即使生成720的视频,视频质量也会非常好。但如果参考特别少,跑到后面到15秒的时候视频会越来越劣化。

所以目前的解决办法是,你就明确给到侧面图,就相当于首尾帧了,它就能体现出来你要的效果。也有最后射门之后,突然球门就一下就正过来了,就出现现在这种抽风的感觉。但是如果给参考图够多,大概率会得到你想要的结果。

羋木木:我站在偏小白的角度感觉要学的知识点挺多的,想问一下几位老师,在刚才的这种情况下,现在市面上的这些工具是不是都有生成侧面的可能?
金金:是的,快乐小马还是落后了很大一截。
无限画布:可能都会有不准确的时候,但是多抽几次卡其他的应用容易成功一回。快乐小马就是可能多次抽卡效果都不会太理想。
孙斯宇:差不多,现在的 AI 理论上就是抽卡。不管这个模型好与坏,只要你抽卡抽的次数够多,总是总会抽到你满意的画面的。这就主要看它的底模了,底模有的训练的素材多少,它生成的结果它也确实不一样,毕竟字节那的视频训练素材可能是要比别的模型要多的。
羋木木:这是因为依托于抖音和快手的字节,底层数据比较多的原因吗?
孙斯宇:所有的底模都差不多。最早我们一起做文生图的时候开源的底模都在那,包括最近字节发布的开源的插件,它是是基于阿里的12.2的数据的模型继续往上再扩展。所以他们在训练后期数据的时候,加的量可能不一样。这就造就现在seedance确实断崖式领先,只能说快乐小马有很大的进步空间。

打开网易新闻 查看精彩图片

性价比不高,分享省钱的办法
羋木木:我们看一下孙斯宇老师针对同样的足球的剧本和分场做的视频。

斯宇老师的视频也是1分钟左右的时长,要体现身体对抗的碾压,还使用广角场景并保持一致性。另外,还需要激烈的肢体触碰和攻防,双方还会有微表情。

我看斯宇老师的提示词说0到15秒的时候需要一个大广角的赛场的全景,15~40秒的时候会进行一个对抗的中景,40秒到60秒的时候是双人的面部的特写。对于露天的专业球场、草地是否平整、看台的红蓝区的观众,以及阳光的侧影、双方的球衣配色和画外音解读都做了约束,写了一段很长的提示词。如果需要参考相关提示词可以进入骨朵AI公众号下方的群聊,群里会进行发放。

金金:我想问一下斯宇老师,这段视频是你一下子给了一大段提示词让它生成,然后拼接成的吗?
孙斯宇:前期因为素材不够,差不多是生成15秒的视频,分了三四个场景分别给它提示词。比如说场景一,这个场景要干什么,规定时间。场景二要做什么。在做了30秒左右的视频之后,就可以五六个镜头一起给一大段提示词,再用场景一,场景二,场景三,场景四,场景五让它随机生成。

因为有时候生成的情况太不可控了,说实话针对这个质量,价钱也不太合适。因为基本上它最低充值20块钱就只能生成一条15秒。所以我做的是720p 的视频,没有做1080p 的。

羋木木:斯宇老师刚才说你使用过很多的工具,会非常精心的去钻研提示词。我们从花多少钱,人物一致性、整个的动作等等等方面,比较一下小马和其他工具的优劣吧。
孙斯宇:说真话它没有完全达到我想要的效果。我主要用开源软件,从本地部署的整个质量来说,劣化有点严重。我的意思是我用本地模型,用一些比较笨的方式,生成的质量都会比它好,试错成本也会比较低一些。现在本地跑一张单张的图片只需要10秒钟,差不多20万像素左右。最早低像素的360p 的视频,2分钟左右也能跑完一个。现在快乐小马生成视频,基本上跑15秒也要等5分钟还要收费,我感觉很不合适。
羋木木:你感觉花多少钱合适?
孙斯宇:我花六块六办了一个会员,充了三次最低额的,总共花了60-70块钱吧。
无限画布:看着都挺漂亮的,画质看着还可以。对于这种光影你给了什么提示词?
孙斯宇:在刚开始生成前三条视频前,我确实按照剧本当时设想的那种光影的效果给的提示词,但是生成的三条视频从场地、人物表情方面来看都是废的。后来我把提示词更改后投喂给豆包,让它给我生成了一张图片,豆包生成效果其实还是蛮好的。之后我用本地生成的10来条视频都作为参考图给小马。快乐小马这一点还是很不错的,只要你给它参考,它的风格化保持的非常好,质感、颜色都不会有大的偏差。
金金:原来是这样。我在做的时候只给了它一个足球场的参考,所以看台上没有人。孙老师生成视频的观众席就很好,是用豆包生成的图投喂的?
孙斯宇:对。因为开场的第一帧其实是用豆包生成的。所以人还会摇小旗,虽然摇得很怪,物理上有点问题。包括第一帧闪光灯的效果也是在提示词里给到的。它会完全就是根据你的提示词走。有时候提示词离得太近,生成的东西会很怪。有一次生成的时候,还“穿越”了:本来想从场外一个无人机镜头到近景推到球场,再推到观众,再推到草地上的足球,结果生成的视频是观众拿着旗子在天上飞。
无限画布:我觉得是这很惊喜的事情,我们想做这个效果都做不出来。
孙斯宇:视频有保留。我顺便分享一个省钱小技巧:我之前把所有的关键词都在本地跑了一遍,先跑成分辨率很低的视频,哪怕这个画面只有100个像素点,一个人只有一个红色的像素点,都可以,只要能看清人就行。跑出来之后,我拿这个东西再去生成,就能省很多钱,毕竟每跑一次要等时间又要花钱。

我刚才说了,底模可能都差不多,包括我刚才用 Z image,还有刚出的 krea2这两个软件一样加豆包相同的提示词情况下,生成的球场的照片是没有太大区别的,但在光影和人物数量方面有一点点区别。你仔细看镜头近景举应援旗的小人,动作基本上都是一样的,包括生视频也是我就直接拿到wan2.2里面去生5秒的视频,再扔到快乐小马里面让它去跑,这样能省下很多资金。

无限画布:但是精通本地部署的人,用其他的应用也就可以完成。
孙斯宇:最新出了一个 scail2的动作迁移,他已经能做到2800帧的动作迁移了,人物也不劣化,闭源做这个东西反而没有开源那么好。2800帧就是快1.5分钟了,现在有一些做 AI 短剧的人,已经可以把短剧直接扔给它做 AI 人物替换,然后改成三维的3D作品,就直接当自己的原创发出去。我们仅从工具软件的功能性上来说,这样直接替换人物变成自己的作品发行,就变成了一门成本很低的生意。现在有些出海作品就会这么做,但是这个工作流我还没试过。
羋木木:我这里插播一个问题,像孙老师自己能布开源模型,也会去研究技术流派。我们现在出于测评的目的,我想问你是不是不太会选择快乐小马?
孙斯宇:如果是商用项目的话,我会选闭源软件,闭源软件毕竟更省心,做出来的成本会比较低,学习成本也会低。开源的软件就很难让一个团队完美的去运行。当然每个人做法也不一样,比如用开源软件可以很快组建一个团队去做相应的项目,这样的话用闭源的软件的学习成本就太高了,很可能学习一两个月的时间只能做一些简单的东西,假如突然有个特别好的想法可能完全实现不了。但是闭源软件数据比较多,工程师团队人也多,功能也更丰富一些,还有一些隐藏功能,可能就完全能符合你的需求。目前看来如果做商业项目还是要用闭源软件。
羋木木:你自己目前体验最好的你认为是哪家?
孙斯宇:基本上就是Seedance一家独大,如果升级2.5之后,整体效果还会更好一些。

当然这主要在于个人使用,所有平台的画廊里面都有好多创作者做出来非常漂亮的东西,包括快乐小马。快乐小马的广场里面做出来的一些视频,效果也是非常惊艳的。如果实际去看他的工作流,看他的提示词,你能看到它是一定要有参考图的,广场里面完全没有纯文生图生出来的东西。

但如果用即梦的话,你会发现即梦的广场里面有好多是没有参考图的,是纯文本生成,效果也是非常的惊艳。

打开网易新闻 查看精彩图片

表情夸张和变形,文字生成扭曲
羋木木:我们现在来播放一下无限画布老师的作品,无限画布老师已经制作了很多年的 AI 作品,作为一个传统的美术指导和现在资深的一个 AIGC 的创作者,看看他用快乐小马生成的效果是什么样的。

金金:为什么传球是用脸进行的?表情也有些奇怪(笑)
羋木木:我要吐槽。第一个点他怎么能用脸进球,在物理上科学吗?它数据库里是有是有哈兰德踢脸上进行半球实验的梗?
无限画布:不知道为什么处理成这样。挺有意思,球的比例也变得特别的大。当然,从球赛规则上说,除了手以外,不管你用身体哪个部位把球打进球门都可以,并不犯规。
羋木木:第二个点是刚才的视频里面,我看到球都已经飞进球门了,这个人突然之间又把球从哪抱出来了,中间还有一个用手打进去的球。
无限画布:整个创作过程还是蛮痛苦的,里面发现几个问题:第一个,开场的时候我就先放了一个用seedance2.0做的画面——航拍镜头从远处飞到球场里面,它展现的比较好。用无人机还会有一些轨道的痕迹,展现球场也会比较漂亮。虽然说是航拍,但是seedance它就已经很智能了,能够模拟怎么样去把球场表现的好看,以及运镜运动轨迹如何表现得好看。但是快乐小马的航拍镜头只能很僵硬的进入球场当中,我看到包括金金老师和斯宇的作品,足球往哪飞一直很有不确定性,球员踢足球的动作也不是很好看。

之后我和金金老师一样给他提供了一个场景的参考,就发现其实把我给害了。因为给了场景之后,它默认球场跟我提供的参考一样是没有观众总之我给他什么图他都只会很僵硬的去模仿图。

一开始我给了提示词之后,是人物一个人在空荡荡的球场上跑,后面都没有人追。因为它执着于我给的参考图是空荡荡的球场。这时候我另外尝试了快乐小马里面的一个主打功能“视频编辑”。就是视频出完以后,觉得视频哪里不好可以让他去改。我告诉它在这个视频里面需要加入几个对方的球员在追着他,这个倒是完成的还可以。但后面需要处理在球场上的女观众,提示词试了非常多遍,比如让她坐在看台,坐在观众席上,周围还有很多的其他的观众一起在喊,但它永远出不来。如果是单独切近景让女观众坐在观众席上的,出来的图依然是女观众背对着球场,正面面对观众,想让她背对着球场就一直试了很多遍都不行。最后我只能除把参考图删掉,让它模仿央视转播现场直播的比赛去完成这个剧本。我觉得出来的效果应该能看出来,是他们之前喂过很多的电视转播的画面,但它模拟电视画面后整个画质又变差了。

金金:我有看到那个女孩的表情,从高兴变哭的时候有一个明显的垮脸,这不是一个人类正常的表情,有点像冰淇淋融化一样往下去掉。我已经很久没有见过模型式能生成这么奇怪的效果,这是什么的原因导致的?
无限画布:我试了很多次,几乎每一个视频都出状况。她的表情似乎都是呈现出了垮脸的效果,至于什么因素不太清楚,斯宇觉得是训练模型的问题吗?
孙斯宇:人物表情夸张的问题,是所有的开源闭源模型和软件的通用的通用的毛病。也许因为人的微表情本身就是很难以观测的,在表情夸张的情况下AI观测得更多。这方面包括我们说seedance的 AI 感也是存在的,目前为止没有什么太好的解决办法。基本只能是靠抽卡去选一个更好一点的。
无限画布:各位老师,你们觉得小马做的微表情目前你们满意吗?对微表情的捕捉准确吗?
金金:我感觉好像没有太多的表情吧,我也有写球没进之后的失落,但它好像也没有太多的表现。
无限画布:您觉得不是很理想,或者没有达到你想要的那种结果对吗?那你们觉得台词怎么样?因为我的段落里面台词是比较少的。
孙斯宇:我的差不多三句台词,另有一个话外音。其中外籍球员说了句英文到最后我也没听懂他到底在说什么,声音也是没有生成得特别好。但是话外音部分还不错,能听懂。但还有个题外话,刚才画面出现的广告的字,所有的中文字都是有问题。其实阿里系的模型像千问等等都是阿里系的,千问对文字支持挺好的,快乐小马会生成出这样也挺让人意外的。
无限画布:那你的还不错,我这里面也有一个旁白,解说员在说话。但是当我给提示词以后,他不理解旁白,会让某一个角色去这句旁白的话,那段也是有问题,所以我就没采用。
金金:我这里面有一段是没进球之后球员互相安抚,那段他俩就说的就还好。我发现如果像斯宇这种技术流去抠提示词的细节,瑕疵就会少很多。比如还有人的动作,斯宇老师那段的球员的身高都差不多,体型也都差不多,动作规律上可能差一些,比如说我看到守门员在空中飞了一圈才接到球,也是很奇怪的。
无限画布:我用“视频编辑”功能给他加了一群人,但是他可能用了像功夫足球里的一些夸张的效果。双方球员像是拥抱一样抱在一块儿了,有点像打橄榄球,不像足球。
金金:另外为什么他脸上这么多麻子?我觉得还是可能他对美学理解也不太好。

打开网易新闻 查看精彩图片

综合评价
羋木木:大家进入自由开麦环节,从更综合的方面来评价一下这款产品吧。比如说花费同样的token,快乐小马的各个指标表现怎样?
无限画布:因为我一直在传统影视行业,现在也是想用 AI 来完成一些影视项目,最近也一直都在接一些AI类广告类。我特别看重的一个点是视觉效果需要好,此外是提示词的准确度,比如说人物要保持一致,场景要保持一致,Seedance目前是能够准确的完成我给的他的指令的,快乐小马就不是很理想。

包括刚才说为什么脸上都是麻子?我们给的参考的球员脸上是有那么一些风吹日晒的浅色雀斑,但是他在捕捉到这些信息的时候并没有去做美化,并且有点夸张。另外编剧老师给了我们一些提示词,但是小马几乎没有按照提示词去完成我们想要的故事内容,我们目前做的这些视频,几乎让观众看不懂这到底讲了个什么剧情。我们作为影视工作者,至少需要能够把我的故事传达给观众,目前就很遗憾。另外关于费用问题,因为现在有折扣价,而一旦几天的折扣用完之后,衡量下来其实也没有多便宜,性价比就不大高。

我觉得对于制作者来选择工具,至少有一种优势是让我们必须用它的,要么是价格有优势,要么是效果,或者有一些其他工具完成不了的技能但我们打开快乐小马会发现它的功能很少。比如说生图功能它是没有的,像可灵的“智能分镜”也是没有的。可灵、即梦目前可以自动帮你切近景或切特写,几乎不用太多描述它都能自己理解。包括我们刚才说的首尾帧的功能也没有。我觉得它落后于这两款最好的应用至少好几个月甚至半年。

另外就是画面精度,像斯宇刚才说的斯宇用的是720,我这边其实已经在用1080了,但是没感觉到这个1080比720的画质好多少,这也已经是它的上限了,肯定不能达到2k 和4k,这就商业需求,因为客户要求一般是2k 的或者4k 的。如果是应用在自媒体上,它价格又没有优势,所以很难让我去下定决心去充值和应用。这是我的整体感受。

羋木木:那我整体简单总结一下,快乐小马技术上可能落后于seedance他们,但是价格上又没有比他们低太多,所以无论从性价比上还是从效果上,目前对于吴老师来都不会考虑。
金金:我也不太能考虑。因为我是3月刚开始就接触这个 AI 工具,是最早来试用快乐小马的,但估计没有以后了,因为确实是不太行。我用Seedance昨天晚上还刚做完了一个5分多钟的短片,有20多个镜头,最终只有一个镜头缺一点画面,再去补个几秒钟就够了。如果换快乐小马就大约只有几秒是能用的,这个真的就非常头疼了,都不仅是浪费钱的问题,而是根本解决不了问题。而且反复抽卡让人非常难受,像刚才吴老师说的,我们做影视的首先就是需要表达内容准确,别管你这个画面做成什么样首先要满足基本需求,知道在演什么东西,不能干着急。
羋木木:再看一遍觉得太魔性太抽象了!有很多令人疑惑的问题,说穿蓝衣服的球守门员怎么能跟穿红衣服的球员是一队的?为什么他们俩总是站在一起?我就需要去解释他们是一个对抗关系,后来他终于明白是要做红衣球员踢进球门的故事,但是他们的对抗关系又变成共同面对另外一个敌人。

所以从从刚才金金老师说的一样,连最基础的故事逻辑主线都没有。

金金:我觉得比如说其他工具可能就是人物多了以后站位乱了,两个人不太可能出现这种情况,但是没想到这快乐小马就两个人还会出这种问题,还有一段出了一个吴老师说的那种问题,他脸扭过来了,但是背还没转过来。 羋木木:

网易云音乐的广告片出现过这样一个事故。就是身体转过来的时候头没有转过来,这算是严重的广告投放事故了。但我不确定他是用什么工具做的。但说实话,他的画质好像比你们刚才快乐小马生成的画质还要好一些。

孙斯宇:我突然发现我们刚才一直提的,快乐小马风格化保持比较好,好像它生成的画画面锐度和饱和度特别的高。

我和金金老师的视频只有人物的素材是相同的,其他场景的素材都是我们自己生成的,但我们俩画面特别相像,明显就是一个下午的时间的画面。它好像默认素材的风格就往这个方向偏。另外所有的球员只有脸略有不一样,他们的身材和强壮程度我感觉都很相似,人物就都是一眼AI。

无限画布:因为我们试的类型是一个球场,它可能比较亮一些,但是还没试过比如阴暗的惊悚的内容跑出来会怎么样,如果它还是饱和度很高,就会显得很奇怪。

另外不管是可灵还是即梦,除了刚才我说的他们有可以出图的功能以外的话,他们也都有画布功能。比如说我在同时进行好几个项目的时候,假设要同时做一个广告片,一个漫剧,还有自媒体小视频,有画布功能我就可以把每一个项目区分开来,同时进行也不会乱。快乐小马也没有这个功能,一旦工作项目多就会很凌乱。并且可灵或者即梦,充一次值可以同时让他出图出视频,甚至可以让他去写剧本,比如说我们说的libtv或者是Tapnow,是可以给我们做脚本做分镜的,但快乐小马就只有生视频,从这个角度它的设计也不是很科学。我想知道大家做这段视频都花了多长时间?

孙斯宇:整体时间差不多也要个七八个小时左右吧,大多数时间是在研究提示词。即使现在我自己的作品多看了几遍之后,也会发现他的足球运动轨迹是莫名其妙的,会突然瞬移到另外一个地方,然后被踢飞。这是一些小细节,不仔细看可能看不出来,但它逻辑太不通了,拿去做商业化真的是不太行。
无限画布:7~8个小时按理来说可以做完1集3~5分钟的漫剧了,但是用快乐小马的话只能生成1~2两个镜头,效果还不是很好。
金金:我没统计,只知道最后那一段出不来的视频大概花了两个小时,最终还是没有出来。最后一次给我出来是只有配音,黑屏没有画面,后来忍不住试一了下Seedance,一次就出来了。
无限画布:我和金金老师也差不多,也没太去抽卡,一是费用问题,另外一个是我觉得这个本身就是我们考量的一个点。一个工具是否可以节约时间成本,这也是AI 的意义所在。我们都知道传统拍摄花好几个月去拍摄一部电影,而用 AI 很快就能完成,如果一个AI 工具还这么不智能,耗了我们这么多时间,像斯宇做一个这样的影片花了七八个小时,可见它需要改良的地方真的就很多。不过目前快乐小马是不是要更新迭代,不知道你们有没有收到过消息?
孙斯宇:它已经更新了,就它这两天刚更新的1.1的模型。
金金:对,我们用的就是1.1。
无限画布:那这版已经是它更新的模型,那么它未来下次更新会是什么样就不知道了。
羋木木:大家的评测也都是非常真实的评测,如果快乐小马的朋友们看到了的话也可以去吸纳一下,我们也比较期待下一期有更多的进展。当然可能像金金已经不想再试用了?
金金:已经有点崩溃了。
无限画布:如果快乐小马能有更新的模型,有有改进改良或者有更新的东西,我们也会愿意去尝试。
羋木木:三位嘉宾对观众朋友们表达一下最后的总结?
金金:我觉得新人想上手 AI 这个制作其实不是非常难,只要我们选一个好的工具就可以。
孙斯宇:跟观众朋友说 AI 毕竟是一个趋势,希望大家早点入行,一起推助力我们 AI 行业发展的越来越好。
无限画布:我们作为专业影视工作者,欢迎更多的企业或专业的团队去开发新的Ai应用,但我们更希望它不是一个噱头,不是为了搞一个发布会;企业不能只重视营销,而应该踏踏实实、沉下心来把产品给做好,让我们这些用户在使用后用好的口碑去相传。因为产品体现着企业的精神和文化。另外的就是我们这次选题,选的是足球,也希望大家多关注周星驰的《功夫女足》或者是世界杯的比赛,祝大家看球快乐!也许今天我们做的足球比赛视频也能给大家带来一点欢乐。
羋木木:谢谢三位嘉宾,也谢谢直播间前的各位观众朋友们,下期再见!

PS:欢迎将本文转发朋友圈

AIGC相关从业者,可以添加骨朵AI主编微信(BaozhuPan)或骨朵传媒运营微信jinguduo),也可通过扫描下面的二维码进入骨朵AI交流群。

打开网易新闻 查看精彩图片

4群无法添加可进入备用群

打开网易新闻 查看精彩图片

添加微信后,请发姓名+城市+职业,能有作品链接、公司简介更好。

欢迎有AI漫剧、AIGC内容的相关创作经验的朋友多多联系我们,对赛道感兴趣的朋友也可以和我们建立联系。

打开网易新闻 查看精彩图片

打开网易新闻 查看精彩图片