一段AI生成的体操视频,引发近百万网友围观,LeCun等一众大佬还因为它吵起来了。
体操表演,emmmm怎么不算呢?
通过视频右上角的水印,此段视频正是由那个一度被认为是“下一代”文生视频的Dream Machine(来自Luma AI)生成的。
大伙儿看后纷纷坐不住,围绕此讨论的,是AI视频领域的一个熟悉的话题:AI是否理解物理规律。
LeCun直接开麦:
视频生成模型不理解基本物理知识。更不用说人体了。
华盛顿大学计算机科学教授Pedro Domingos看后也“摇了摇头”:
AGI可能并不会像一些人预期的那样即将到来。
畸变雀食离谱
自Sora问世以来,“AI是否理解物理规律”这个话题就被越来越多人关注。
下面这段Sora生成的“寄居蟹用灯泡当外壳的夜间场面”是个经典的例子,海浪与沙滩的互动非常细腻,寄居蟹腿上的纤毛也活灵活现。
对比真实拍摄的类似场景照片,也就灯泡没有电源不应该亮这一个明显破绽了。
最近Luma AI的Dream Machine也一样,生成的第一视角探废弃房子真实感拉满:
由此,不少人认为Sora、LUMA等的视频生成模型已经理解了简单的物理规律。
然鹅,这次被放出的视频着实有点太离谱。
不仅腿脚乱飞,频频上演大变活人:
就这高难度的空中悬浮翻跟头,也是牛顿都要被气活了的节奏:
以至于网友看后还表示,说恐怖大可不必,说搞笑还差不多。
如此抽象,LeCun直接评论视频生成模型不会懂物理。
他还进一步解释,Sora或者其它视频生成模型都有类似的问题,视频生成技术无疑也肯定会随时间推移而进步。
但:
真正理解物理的学习系统并不会具有生成性。就像鸟类、哺乳动物等比任何视频生成系统更了解物理。然而,它们都不能生成详细的视频。
类似还有另一种思考:
即使AI视频生成模型之后会进化的很好,生成的视频质量“完美”,那么就意味着它理解物理了?
LeCun等的观点,立马引起网友的质疑:
鸟和哺乳动物也会生成详细的视频,只不过是在大脑中生成无法将其具像化。
然鹅,这种反驳并未说服LeCun。
此外,还有不少人持反对意见。
例如,谷歌DeepMind/Brain团队研究员Lucas Beyer就指出:
这就像是展示一个由几年前的Dall·E mini生成的图像,然后称当前的图像生成方式注定失败一样。
毕竟,之前生图模型生成的图像be like:
至于模型会生成如此离谱的视频?
有网友认为是缺乏体操表演数据,还有网友认为是身体部位的模糊处理,使得模型无法理解人体结构,继而不能保证肢体动作的连贯性。
视频生成在计算上更为复杂,并且具有高度的上下文相关性,对详细标注的训练数据有更大的需求,这些需求现在还未得到充分满足。
前段时间SD 3翻车,同样对人体生成效果不好,网友也讨论过这一问题,过于严格的数据审核,可能误删了一些无害的成人图像,影响了模型对人体结构的理解。
One More Thing
除了Luma AI的Dream Machine生成体操视频大翻车,Runway的Gen-3也……
同款三头六臂:
同款空中悬浮绝活:
如何学习大模型
现在社会上大模型越来越普及了,已经有很多人都想往这里面扎,但是却找不到适合的方法去学习。
作为一名资深码农,初入大模型时也吃了很多亏,踩了无数坑。现在我想把我的经验和知识分享给你们,帮助你们学习AI大模型,能够解决你们学习中的困难。
我已将重要的AI大模型资料包括市面上AI大模型各大白皮书、AGI大模型系统学习路线、AI大模型视频教程、实战学习,等录播视频免费分享出来,需要的小伙伴可以扫取。
一、AGI大模型系统学习路线
很多人学习大模型的时候没有方向,东学一点西学一点,像只无头苍蝇乱撞,我下面分享的这个学习路线希望能够帮助到你们学习AI大模型。
二、AI大模型视频教程
三、AI大模型各大学习书籍
四、AI大模型各大场景实战案例
五、结束语
学习AI大模型是当前科技发展的趋势,它不仅能够为我们提供更多的机会和挑战,还能够让我们更好地理解和应用人工智能技术。通过学习AI大模型,我们可以深入了解深度学习、神经网络等核心概念,并将其应用于自然语言处理、计算机视觉、语音识别等领域。同时,掌握AI大模型还能够为我们的职业发展增添竞争力,成为未来技术领域的领导者。
再者,学习AI大模型也能为我们自己创造更多的价值,提供更多的岗位以及副业创收,让自己的生活更上一层楼。
因此,学习AI大模型是一项有前景且值得投入的时间和精力的重要选择。