尧图建网站 尧图建网站 YAOTU WEB BUILD 免费咨询
ARTICLE DETAIL

资讯详情

深耕网站建设与建站编程的一线实战洞察。

LTX-2.5 V2版:同步音画、多镜头连贯的AI视频神器! 更清晰、更可控

LTX-2.5 V2版:同步音画、多镜头连贯的AI视频神器! 更清晰、更可控 LTX-2.5 是 LightricksLTX发布的开源“世界模型”open world model。 它主要用来生成高质量、带同步音频的视频输入可以是文字、图片、视频或音频。简单说就是一个能同时产出画面和声音的 AI 视频生成工具而且支持本地部署不依赖云端 API 计费。今天分享的 LTX-2.5 V2版在上个版本的基础上新增 WebUI自定义模型切换功能支持更轻的GGUF模型满足更多不同配置硬件需求支持自定义lora最多支持同时加载两个lora模型。主要特点原生多镜头生成一次就能生成多个连贯镜头比如远景→中景→特写人物、环境、光线、声音风格都能保持一致不用再手动拼接。画面更清晰、细节更好新的扩散视频解码器让人脸、纹理、屏幕文字更锐利运动更自然伪影更少。智能分配计算资源根据场景复杂度动态调整重要地方画得细简单地方省资源。更好的文字理解用了定制的 Gemma 4 12B 文本编码器 提示词增强器复杂提示多角色、镜头运动、灯光、动作不容易丢细节。自动时长预测可以让模型根据提示自动决定视频长度不用手动设帧数。蒸馏版更快更好用有体积更小、速度更快的蒸馏模型质量接近完整版适合普通硬件。支持多种输入输出文字→视频、图片→视频、视频→视频、音频相关生成等还能同步生成音频。应用领域影视与内容创作短片、广告、概念预览、多镜头叙事视频制作。工作室可直接用于生产流程保持风格和角色一致性。实时与交互应用低延迟生成适合互动化身、实时虚拟世界、直播类场景。机器人与物理AI可微调到真实物理场景数据用于机器人仿真、环境理解等新兴方向目前还在发展中。专业后期与VFX支持HDR/ACES工作流输出可接入专业调色和成片管线。使用教程建议N卡显存8G起支持50系显卡整合包包含所需所有节点下载主程序和模型ComfyUI文件夹解压主程序一键包将ComfyUI文件夹移动到主程序目录下即可。WebUI模式双击启动跳转进入WebUI后根据需要选择生成方式支持文生视频、图生视频和首尾帧视频生成输入提示词上传参考图设置相关参数运行生成即可。ComfyUI模式双击启动ComfyUI进入WebUI后点击左侧的 工作流程选择对应的工作流根据需要选择对应工作流支持文生视频、图生视频和首尾帧视频生成设置相关参数运行即可。实测显存8G起运存32G使用GGUF模型可流畅运行文生视频图生视频。如报显存不足错误可选用其他更低尺寸的GGUF模型模型下载 比如使用Q3LTX 吃提示词可以参考官方提示词指南 https://docs.ltx.io/open-source- ... des/prompting-guide 。官方也支持提示词增强可以使用简单的提示词勾选“提示词增强”会消耗更多显存。如果需要自行编写提示词请不要勾选。软件目录结构 ComfyUI/├── models/│ ├── diffusion_models/│ │ └── ltx-2.5-22b-distilled-transformer-comfy-int8-convrot.safetensors│ ├── unet/│ │ └── LTX-2.5-Distilled-Q4_K_M.gguf│ ├── latent_upscale_models/│ │ └── ltx-2.5-latent-spatial-upscaler-x2-bf16-1.0.safetensors│ ├── text_encoders/│ │ └── gemma4_e2b_it_bf16.safetensors│ │ └── gemma4-12b-with-proj-ltx-2.5-comfy-int8-convrot.safetensors│ └── vae/│ └── ltx-2.5-audio-vae-bf16.safetensors│ └── ltx-2.5-video-vae-bf16.safetensors deepface/......下载地址点此下载
返回列表