APP下载

Sora与未来叙事:AI如何颠覆内容创作

2024-05-21陈光

传媒评论 2024年3期
关键词:人类内容模型

文_陈光

2024 年2 月16 日,OpenAI 发布了其首个文生视频模型Sora。这一突破性模型的发布在行业内引起了轰动,重新定义了当前AI 文生视频技术的极限,彻底颠覆了生成式AI 在视频领域的全球市场格局。Sora不仅仅是一个技术突破,更是对人类叙事方式的一次深刻挑战,预示着内容生产领域未来的无限可能,也让我们对通用人工智能(AGI)的进步更加期待。

在此之前,尽管AI在图像和音频生成方面取得了令人瞩目的成果,但高质量、长时间的视频生成仍是一个难以攀越的峰顶。Sora的出现,一次性将视频生成时长提升了15倍,达到60秒,远超行业水平。不但如此,Sora还能生成复杂的多机位视频,场景连贯,角色丰满,细节精致,几乎可以与现实中的场景媲美,这在以往的技术中是难以想象的。这种能力不仅极大提高了视频内容的创作效率,也为内容创作者提供了前所未有的自由度。想象一下,只需输入一段描述,Sora 就能为你呈现出一个完整、生动的故事场景,这无疑将极大地激发创作者的想象力和创造力。

还原世界并超出想象的模型

用文字自动生成视频,其技术难点主要体现在如何处理并理解视觉信息的高维特性和动态变化。视频不仅包含了静态图像的空间信息,还包含时间序列上的动态信息,因此对计算资源和模型处理能力的要求极高。实现这一技术需要借助深度学习中的生成模型,如扩散模型(Diffusion Model),以及强大的时空变换架构,例如Transformer。Sora能惊艳亮相,其背后得益于以下方面取得的技术突破:首先,Sora 采用了将视频和图像数据转换为统一表示形式的方法,使得模型能在大规模数据集上进行训练;……

登录APP查看全文

猜你喜欢

人类内容模型
一半模型
内容回顾温故知新
人类能否一觉到未来?
人类第一杀手
重尾非线性自回归模型自加权M-估计的渐近分布
1100亿个人类的清明
3D打印中的模型分割与打包
主要内容
人类正在消灭自然