爱诗科技发布PixVerse V2，更快更长更一致的AI视频生成来了

2024-07-24 13:57 咸宁新闻网

7月24日，爱诗科技正式发布视频生成产品PixVerse V2，全球同步开放，致力用AI视频大模型为每一个用户释放创意可能。

PixVerse V2采用Diffusion+Transformer（DiT）基础架构，并在各方面进行技术创新，提供了更长、更一致、更有趣的视频生成能力。在模型能力提升的同时，PixVerse V2还带来了AI视频生成的全新玩法：在保证一致性的前提下，一次生成多个视频片段，可实现单片段8秒，和多片段40秒的视频生成。

一、以DiT架构为基础，实现多项技术创新

PixVerse V2采用了DiT模型架构，用行业顶尖的模型训练效率实践了视频大模型的Scaling Law，同时在多个方面运用了独创的技术实现了卓越的生成效果。

在时空建模方面，PixVerse V2引入了自研的时空注意力机制，不仅超越了传统的时空分离和 fullseq 架构，而且显著提升了对空间和时间的感知能力，使得在处理复杂场景时表现更为出色。

在文本理解方面，PixVerse V2利用了有更强大理解能力的多模态模型来提取prompt的表征，有效实现了文本信息与视频信息的精准对齐，进一步增强了模型的理解和表达能力。

此外，PixVerse V2在传统flow模型的基础上进行了优化，通过加权损失，促进了模型更快更优的收敛，从而提升整体训练效率。

二、用户第一，提升AI视频创作生产力

基于大量用户反馈和社区讨论，爱诗团队深刻洞察到一致性是AI视频创作的核心挑战，因此，PixVerse V2 在设计和优化上进行了针对性突破：支持一键生成1-5段连续的视频内容，且片段之间会保持主体形象、画面风格和场景元素的一致。这一创新功能，让用户能够围绕特定主题进行高效而便捷的视频创作。

PixVerse V2还支持对生成结果进行二次编辑，通过智能识别内容和自动联想功能，用户可以灵活替换调整视频主体、动作、风格和运镜，进一步丰富创作的可能性。爱诗团队希望在模型性能和美学效果之间寻求平衡，预计未来3个月内还将进行多次迭代升级，提供更好的AI视频生成体验。

PixVerse V2致力让更多用户感受到AI视频创作的乐趣，无论是记录日常脑海中的灵光乍现，还是讲述引人入胜的视频故事，都能变得触手可及。（咸宁新闻网）

声明：本站作为信息内容发布平台，页面展示内容的目的在于传播更多信息，不代表本站立场；本站不提供金融投资服务，所提供的内容不构成投资建议。如您浏览本站或通过本站进入第三方网站进行金融投资行为，由此产生的财务损失，本站不承担任何经济和法律责任。市场有风险，投资需谨慎。同时，如果您在中国发展网上发现归属您的文字、图片等创作作品被我们使用，表示我们在使用时未能联系到您获取授权，请与我们联系。

【本文资讯为广告信息，不代表本网立场】