RTX 4090可跑、完全开源,最快视频生成模型问世,实测一言难尽

人工智能 新闻
开源 AI 视频社区又一个重量级选手下场。

这个周末,押注开源人工智能视频的初创公司 Lightricks,有了重大动作。

该公司推出了最快的视频生成模型 LTX-Video,它是首个可以实时生成高质量视频的 DiT 视频生成模型

图片


在一块 Nvidia H100 上,LTX-Video 只需要 4 秒就能生成 5 秒时长的 24FPS 视频,分辨率 768x512,可以说视频生成速度比视频观看速度还要快。同时 LTX-Video 完全开源,包括代码库和模型权重。

图片

LTX-Video共同作者和负责人。

「有史以来最快的文生视频模型诞生了。」

图片

首先来看几个视频生成官方 Demo。

目前,用户可以在 GitHub Hugging Face 上体验预览版 LTX Video。完整版发布之后将免费供个人和商业使用,并即将集成到 LTX Studio 中。

图片

项目地址:https://github.com/Lightricks/LTX-Video

我们尝试生成了两个视频,比如「a dog chasing a boy who is skateboarding」。

再比如「a girl with an umbrella standing on a bridge, and a handsome man walking towards her」。

试用地址:https://huggingface.co/spaces/akhaliq/anychat

接着来了解一下 LTX-Video 的细节。

LTX Video 是一个文本到视频和图像到视频模型,能够以惊人的速度和精度实时创建动态视频。该模型可以在 RTX 4090 等消费级 GPU 上本地运行,无需专用设备即可以低成本地生成高质量视频。

另外,LTX Video 基于开发人员的反馈和真实世界用例构建,可以提供自然逼真的结果。该模型做了高级定制化设计,可以流畅地集成各种外部工具,从而轻松地增强工作流。

在生成过程中,LTX Video 最大程度减少了闪烁和伪影,创建出具有出色细节和清晰度的高保真视频。每一帧都在精心制作下呈现清晰锐利、栩栩如生,符合用户的视觉效果。

最后,LTX Video 实现了无缝的跨帧一致性,从角色到环境,可以保持连贯的视觉效果,将每个细节整合在一起。

未来,LTX-Video 还会有技术报告放出。

图片

责任编辑:张燕妮 来源: 机器之心
相关推荐

2018-11-07 19:46:30

本地ERP

2022-08-31 08:14:46

算法key链表

2020-05-25 09:45:47

开发技能代码

2024-10-28 12:54:36

2023-03-20 18:55:10

微软AI人工智能

2020-12-18 06:01:02

容器镜像软件

2023-02-15 08:18:58

AI工具

2023-04-03 10:04:44

开源模型

2019-09-09 09:29:27

互联网程序员职业

2024-08-26 15:58:35

2024-10-16 14:10:00

AI视频生成

2023-03-15 14:03:24

微软Windows 11

2023-07-13 15:10:06

2024-03-20 00:00:00

StabilityAI开源人工智能

2024-05-24 12:53:06

AI训练

2015-11-13 10:45:48

ASP.NET开发者

2021-11-17 16:20:49

Linux 系统 树莓派

2009-12-01 18:41:08

SUSE Linux

2025-01-10 09:40:00

视频生成AI开源

2024-09-23 15:40:00

点赞
收藏

51CTO技术栈公众号