Phenaki | 52运营

我们介绍了 Phenaki，这是一种能够在给定一系列文本提示的情况下进行逼真的视频合成的模型。由于计算成本、高质量文本视频数据的数量有限以及视频长度可变，从文本生成视频尤其具有挑战性。为了解决这些问题，我们引入了一种用于学习视频表示的新因果模型，该模型将视频压缩为离散标记的小型表示。这个分词器及时使用因果注意力，这使得它可以处理可变长度的视频。为了从文本生成视频标记，我们使用了一个以预先计算的文本标记为条件的双向屏蔽转换器。生成的视频令牌随后被去令牌化以创建实际视频。为了解决数据问题，我们展示了对大量图像文本对以及较少数量的视频文本示例的联合训练如何产生超出视频数据集中可用内容的泛化。与之前的视频生成方法相比，Phenaki 可以在开放域中以一系列提示（即时间可变文本或故事）为条件生成任意长视频。据我们所知，这是第一次有论文研究从时间变量提示生成视频。此外，所提出的视频编码器-解码器在时空质量和每个视频的令牌数量方面优于文献中当前使用的所有每帧基线。Phenaki 可以根据开放域中的一系列提示（即时间可变文本或故事）生成任意长视频。据我们所知，这是第一次有论文研究从时间变量提示生成视频。此外，所提出的视频编码器-解码器在时空质量和每个视频的令牌数量方面优于文献中当前使用的所有每帧基线。Phenaki 可以根据开放域中的一系列提示（即时间可变文本或故事）生成任意长视频。据我们所知，这是第一次有论文研究从时间变量提示生成视频。此外，所提出的视频编码器-解码器在时空质量和每个视频的令牌数量方面优于文献中当前使用的所有每帧基线。

数据评估

Phenaki浏览人数已经达到56，如你需要查询该站的相关权重信息，可以点击"5118数据""爱站数据""Chinaz数据"进入；以目前的网站数据参考，建议大家请以爱站数据为准，更多网站价值评估因素如：Phenaki的访问速度、搜索引擎收录以及索引量、用户体验等；当然要评估一个站的价值，最主要还是需要根据您自身的需求以及需要，一些确切的数据则需要找Phenaki的站长进行洽谈提供。如该站的IP、PV、跳出率等！

特别声明

本站52运营提供的Phenaki都来源于网络，不保证外部链接的准确性和完整性，同时，对于该外部链接的指向，不由52运营实际控制，在2023年5月10日下午5:12收录时，该网页上的内容，都属于合规合法，后期网页的内容如出现违规，可以直接联系网站管理员进行删除，52运营不承担任何责任。

52运营致力于优质、实用的网络站点资源收集与分享！本文地址https://www.52yunying.com/sites/3135.html转载请注明

相关导航

invideo

省时的人工智能工具使用 InVideo 基于 AI 的文本到视频编辑器，在几分钟内将您的脚本、文章或博客转换为视频。自动调整您的视频大小以适应任何宽高比以发布在任何平台上，等等。

百度AIGC创作平台

输入文案成片输入或粘贴一段文案生成视频选择文章成片从百家号文章中选择内容生成视频智能匹配素材没有素材不用愁，海量内容快速成片模版一键包装丰富模版，标题、字幕、背景全搞定

D-ID翻译站点

D-ID 的生成式 AI 技术为营销、学习和开发以及 CX 领域的专业人士以及各种内容创作者提升了视频内容。我们的平台使用户能够从文本中生成逼真的数字人物，从而显着降低大规模视频制作的成本和麻烦。客户包括财富 500 强公司、营销机构、制作公司、社交媒体平台、领先的电子学习平台和各种内容创作者。我们的解决方案可通过自助服务工作室和面向企业、制造商和开发人员的API获得。D-ID 成立于 2017 年，由一级 VC 支持。使用我们的技术创建了超过 1.1 亿个视频。最近的客户包括 Warner Brothers Pictures、Publicis、Mondelez、Skilldora 和 MyHeritage，他们使用 D-ID 的平台创造了非凡的体验。

Runway

从基本的视频编辑到高级后期处理，Runway 就像在您的浏览器中拥有自己的视频制作工作室。在您的下一个项目中试用我们的专业视频编辑软件，以获得完美的视觉效果、视频格式、色彩校正等。

Decoherence

创建AI动画并将其与你的音乐同步。写下你的提示，选择你的效果，设置为音频频道，今天就创造你的故事。它有两种定价方式——充值10美元或每月30美元。

Kaiber推荐翻译站点

Kaiber是一个视频生成引擎，用户可以根据自己的图片或文字描述创建视频。它为音乐家提供了Spotify Canvas等功能，为艺术家提供了灵感，为创作者提供了内容，为未来主义者提供了乐趣，使他们能够以独特的方式表达自己，并推动AI工具的界限。Kaiber是免费使用的，不需要信用卡。