OpenAI再现黑科技!发布文字生影片AI“Sora”

OpenAI再现黑科技!发布文字生影片AI“Sora”

OpenAI今天正式发表文字转影片生成式AISora」!就跟DALL-E一样,只要给出文字叙述(或静态图片也可以),Sora可以自动生成1080p动画,各种不同的角色、动作类型和背景细节全方位配件生成!

经过,Sora 可以生成各种风格(包括真实电影,动漫风或黑白)的影片,长度接近一分钟,显然超过目前大多数其他测试的文字转影片模型,而且这些影片都关心在保持合理的连贯性上,好像他们的第一款影片中除了文字之外,街头水洼的倒影、衣服随手行走的展示效果,甚至是主角的脸上的肌理都栩栩如生。

OpenAI 表示,Sora 是基于 DALL·E、GPT 模型的研究成果,一方面使用 DALL·E 3 专着的重述生成技术,能够为视觉资料高度描述性的标题,所以索拉可以更忠实、也更新遵循用户的文字指令,并生成丰富的情感、引人入胜的角色,甚至索拉还可以深入理解现实世界物理中真正提到的人、事、物的指令存在的面貌。

当然OpenAI的Sora展示页面新生儿或少有一点浮夸成分在,但这些展示影片如果没有作假、没有事后调整,跟其他文字生成影片的话AI模型对比确实是创制最高竿的技术,令人印象深刻。

就像目前所有的生成式 AI 一样,OpenAI 表示 Sora 还是有很多问题,可能难以准确模拟复杂场景的物理原理,也可能无法理解因果关系。例如一个人咬了一口饼干,但在之后的影片里饼干上可能没有咬痕;或者无法准确理解指令中的空间关系,可能会出现左右矛盾,或者难以生成希望的镜头移动角度等。

目前 OpenAI 并没有将 Sora 开放,起码普拉子里目前只能定位为「完全预览研究」,只有特定跟官方合作的人可以使用,已经跟一些外部人士组成「红队可以使用 Sora 来评估相关风险,同时也向一些艺术家、设计师和电影制作人提供使用权限,以获得改进模型的意见。

OpenAI表示,还将跟专家合作探索模型的漏洞,并正在建立定位工具,来检测网路上的影片是否由Sora生成;同时还将跟全球政策制定者、教育者、艺术家接触,来探讨如何不会被偷窃。

本文来自INSIDE,经授权后发布,本文观点不代表沙鸥科报立场,转载请联系原作者。

相关文章

  • Chat With RTX将支持Gemma

    Google 近期推出开放式模型Gemma,NVIDIA 亦宣布与 Google 展开合作,包括关系:在所有 NVIDIA AI 平台上(包括本地端 RTX AI PC、云端、数据中心)针对 Gemma 进行最佳化。同时,NVIDIA 自家Chat With RTX也…

    2024-02-24
  • 人工智能 监测肺癌,效果堪比专家诊断结果

    人工智能 在深度学习的帮助下,功能变得相当强大,用在影像辨识上效果非常好,医疗方面Google人工智慧巳经在协助病理学家由组织切片显微影像分辨癌症、协助眼科医师为糖尿病患者看眼疾,不过还有许多限制需要突破。研究团队教电脑辨识不同影像的特征模式,像肺结核、癌症、骨折等。

    2020-03-13
  • MIT研究人员找到新方法提升聊天机器人性能

    研究人员发现了一种新的方法,能显著提高像ChatGPT一样的大型语言模型的性能。当人工智能与人之间持续对话时,这些模型常常会出现故障,导致性能急剧下降。研究人员发现,这个问题出在语言模型处理过往“记忆”的方式…

    2024-02-18
  • DianNaoYu:中国提出的国际上首个深度学习指令集

    2016年3月上旬,中国科学院大学岗位教授、中国科学院计算技术研究所研究员陈云霁与陈天石课题组提出的深度学习处理器指令集DianNaoYu,被计算机体系结构领域顶级国际会议ISCA2016(International Symposium on Comp…

    2016-03-12
  • AI 决策更具理性 , 但是否更正确呢 ?

    还记得在准备大学入学面试时,老师总会警告:「记得千万不要搞怪!」不要搞怪的意思很简单,将五颜六色的头发染回黑色,或将时下流行的潮T改回西装,总之去回想想阿嬷的乖孙该长怎样,面试那天打扮成那样就对了!如果今天面试官从人类换成无法被窥见喜怒哀乐的 AI ,那又该如何成功达阵呢?

    2020-02-12
  • 用科技保护环境!AI 可侦测亚马逊雨林生态中非法道路的增减

    根据Inside Science报导,总部位于巴西的非营利环境保育组织Imazon在绘制亚马逊雨林生态圈里的人工道路时,发现绘制范围含420万平方公里的官方地图上,仅显示联邦与地方政府所建造的道路,并未包含实际上的所有人工…

    2021-01-12