探索互联网的起源
Ctrl + D 书签

柯灵大模型是快手团队推出的人工智能视频生成大模型,具有强大的视频创作能力,采用三维时空联合注意力机制,能够生成符合物理规律、模拟真实世界特征的大型运动视频。能在精神上支持生成长度达 2 分钟、分辨率达 1080p 的高清视频,并具有自由调整长宽比的功能。此外,这款 AI 视频工具还结合了 3D 人脸和人体重建技术,可实现表情和肢体的完全驱动,让你只需一张全身照,就能体验生动的 AI 唱跳功能。

柯林大模型的功能特点

  • 大而合理的运动三维时空联合关注机制:利用三维时空联合关注机制,它能够对复杂的时空运动进行建模,并生成符合运动规律的大型运动视频。
  • 最多可生成 2 分钟长的视频Koring:得益于高效的培训基础设施和推理优化,Koring 能够生成长达 2 分钟的视频内容。
  • 物理世界模拟:基于自主开发的模型架构,我们可以模拟现实世界的物理特性,生成符合物理定律的视频。
  • 强大的概念组合能力:利用对文本-视频语义的深入理解和 Diffusion Transformer 架构,我们可以将用户的想象转化为具体的图像。
  • 生成影院级画质:基于自主研发的 3D VAE 技术,可生成 1080p 分辨率的影院级视频。
  • 支持自由视频宽高比可变分辨率:采用可变分辨率训练策略,能够在推理过程中输出不同的视频宽高比。
  • 人工智能驱动的创新游戏:结合三维人脸和人体重建技术,实现表情肢体全驱动,用户可上传全身照片,体验生动的人工智能歌舞玩法。
  • 图文视频:Kling 模型可将静态图像转换成 5 秒钟的动态视频,用户可通过文本提示生成各种运动效果。
  • 视频续集:支持一键续拍现有视频,每次续拍 4.5 秒,可多次续拍,最长可达 3 分钟,实现用户的创意。
0已收藏
0已赞

返回顶部