总结:祝贺海尔,喜提暴死的AI项目
聊聊项目
大概几年前的时候,我在华为做大数据,被裁了。
情况是这样的:
- 上线了一个项目,效果不理想,于是华为就要求项目负责人优化。
- 然后,优化无果,把两个项目负责人裁了,招聘青碧凝霜来接手二开
- 青碧凝霜拒绝,开始了职场自保
- 然后就被裁了
核心是一个问题:能上线,但是效果不理想。 死在我手里了。
上线只是一小步,上线以后稳定盈利,才是最难的。
聊聊AI项目:套皮
海尔的这个AI项目,他100%套皮。 没有自研的AI模型,也没有任何技术深度,就是纯套皮。
做的就是优化提示词 + 帮用户生成提示词。 做的非常非常好看。 提示词做得好。
你随便写个垃圾提示词,然后经过AI分镜 + 提示词优化以后,剧情质量真的大有提升。
有多好看呢?
- 他是做了好几个人设,比如说分镜师、模型师、文案师傅,进行了AI分工
- 给每个人设加了一个立绘
- AI可以并行可以串行
- 自动生成提示词模板
- 材料素材可以复用
- 设计了一套独立的提示词系统,
- 分镜技术,可以通过简单的模型生成提示词
- 可以拼接成品
- 从使用体验上来看,基本上算一流
和市面上普普通通的文字 + 输入比起来,这个项目的颜值 + 第一感觉绝对能打。 美工绝对没问题。审美绝对在线。不是T0也是T1级别。
细节打磨到位。 能够比传统模型效果好整整20%。
聊聊系统设计
首先这个系统,他是非常非常的自动化的、而且是单向的。 不支持修改和回滚。
比如说:我在写提示词的时候,提示词写的不好,导致最后效果很差。 钱是不会退给你的。 而且:这个流程由于已经生成了成品,所以没办法二次修改提示词。
比如说:你已经生成了一个成品。这个成品在小细节上有瑕疵,你想修复。 不可以,不支持。
整个流程分成五步,假如你已经进入第四步,无法回退到第三步。假如你发现第五步的时候,第一步弄错了,只能将错就错。
至于为什么?那非常简单:难以维护N对N。 一共五个流程,每个流程都能回退,这个开发成本太高。做个单向流动的,适合普通人理解。
聊聊AI的幻觉问题
五个测试,一共生成了大概15个成品,花了大概1000元钱。
其中,大部分的效果中等偏差。
举个例子:
- 做了一个电冰箱 + 烤箱的广告,然后打开电冰箱,里面出现了一个炉子
- 抽油烟机像空调一样打开了风扇叶
- 三开门洗衣机打开的方式不对
而另外一个问题,就是双生子问题:
- 一个其乐融融的家庭,有两个妈妈一起像照镜子一样吃饭
- 然后两个妈妈一个向左走去,一个向右走去
爸爸的头诡异的旋转了90度:我觉得人类是做不到90度的。
还有常见的问题:字是乱码的,生造字。 镜头切换非常非常生硬。 AI味道很重。
然后就是:生成的视频不遵守提示词规则。
比如说:你告诉他视频中要出现一个水壶、然后还有其他11个东西。 那有概率这个水壶就不出现。
如果不收费的话,我只能说效果真的是嘎嘎棒,问题是:1秒钟1元钱。只能说中等偏下。
同质化的AI脸
不知道为什么,同质化的AI脸。
AI味道很重,而且经常细节会崩。 就是空间割裂:两个人明明距离很远,然后突然贴下一帧贴近。或者上一帧很近,然后下一帧很远。
剧情很跳。空间错位,声音AI味道很重。嘴唇乱动。
豆包常见的圆圆脸。然后就是霸总AI脸。
如果不收费的话,那效果的确可以说没问题。但是一秒钟一元钱。
聊聊项目的情况
然后就是:资源不够。 测试环境经常性的卡死。
整个项目就5个测试在用,然后卡死了大概3-5次。
测试的反馈就是:我中午休息了两个小时,然后还没生成。
开发那边的反馈是:中午发版了。
只能说稳定性非常差。
聊聊定价
1080p的,一秒钟1元。 60秒就是60元。
领导就说:测试的时候,不要生成1080P的,太贵。 只是生成了720P的。
一张图片大概0.5元。
从素材来看,图片也是相同的问题:同质化严重。 距离商业化很远。
和群友的沟通
群友说了:这个定价,直接劝退99%的人。 得效果好才行。
效果偶尔惊艳,但是不能细看。细看崩坏的厉害。
测试提了:应该做回退功能,还有崩坏、角色出现双胞胎的情况,被全部拒绝。因为直接修不了。
总结
美工到位,设计自己流程和提示词,大大提高了视频的效果。
但是由于技术限制,导致第一眼看过去非常非常惊艳,但是第二第三眼看过去,细节、空间、剧情、作画崩坏。
价格极高无比,劝退99%的用户。系统稳定性没有经受过考验。
