LTX-2.5 ComfyUI图生视频,文生视频可以你也可以的)
一、说明LTX-2.5是2026年8月发布的220亿参数开放权重升级版相比2.3版本在画质、性能、功能上有全面升级。 画质与生成能力升级规格大幅提升从2.3的最高1024x1024分辨率、5秒时长升级到支持4K分辨率、最长20秒视频帧率从24fps提升至50fps 。细节伪影改善新增扩散视频解码器替换传统VAE重建阶段大幅减少人脸崩坏、纹理抖动、画面文字模糊等伪影问题动态场景稳定性显著提升 。原生多镜头一致性一次生成即可产出多段衔接镜头全程保持角色长相、场景环境、光线氛围、配音音色完全统一省去大量后期拼接工作 。动态算力分配采用可变令牌率VTR和像素扩散技术根据画面复杂度动态分配算力简单场景少算、复杂场景多算实现影院级帧间平衡 。⚡ 速度与显存优化变化生成速度翻倍官方双GB200环境下10秒视频仅需6.8秒渲染完成速度约为2.3的2倍消费级RTX5090实测10秒片段约1.5分钟仍远快于同类竞品 。显存优化升级通过NVIDIA官方优化省40%显存支持FP4量化最低显存门槛从2.3的8GB提升至16GB8GB显卡已无法正常运行 。你的V100 16G适配提示刚好踩中最低显存门槛需使用FP4量化版本关闭4K模式最高可稳定运行768P分辨率任务无法开启原生4K渲染。 架构与核心功能更新文本编码器升级从2.3的T5替换为定制版Gemma 4对多主体、长提示词的语义理解能力大幅增强提示词遵循度明显提升 。音视频深度融合基于22B参数双流扩散Transformer架构音视频在同一模型内同步预测生成对白、环境音、背景音乐与画面完全同步无需后期二次配音 。专业工作流支持原生支持4K HDR与EXR RAW专业调色工作流ComfyUI发布首日就完成原生集成零配置即可直接使用无需额外适配 。世界模型特性增强强化对物理世界规律的理解大幅减少穿墙等生成幻觉生成内容更符合真实世界逻辑还可支持数字环境模拟、机器人导航辅助等延伸场景 。二、取模板模板下面的输入图都在https://github.com/Comfy-Org/workflow_templates/下载下来可以用作参考也免于到处去找图学习速度会快点时间变为15秒三、运行按上面设置运行OOM了我们把像素调小点这时候要么减少时间要么降低显示像素也许还可以优化但是我还不知道[INFO] Prompt executed in 00:13:33,能接受不四、提示词还是找AI吧肯定比我写的好input图提示词为画面保持关之琳精致的面部神态不变她缓缓抬起眼睫眼波轻轻流转抬手将耳边一缕碎发温柔捋到耳后指尖动作轻柔舒缓。镜头从半身特写缓慢向前推近聚焦她含笑的眉眼暖柔的柔光落在脸颊发丝随着细微动作轻轻晃动整体节奏缓慢优雅全程保留原图人物五官与着装特征画面流畅无变形生成同步的轻柔呼吸声与细碎的布料摩擦声。这次用中文试试听说是可以的生成视频变得这么丑了还是我的关关吗正准备条参数LTX-2.5_i2v_00003_要想保持人脸不变首先关闭prompt_enhance开关固定noise_seed我是固定的在提示词最开头加入的强约束语句严格100%保留参考图中关之琳的全部面部五官特征、脸型轮廓、妆容细节全程人物面部身份完全一致无任何面部变形、特征漂移、五官改变画面保持关之琳精致的面部神态不变她缓缓抬起眼睫眼波轻轻流转抬手将耳边一缕碎发温柔捋到耳后指尖动作轻柔舒缓。镜头从半身特写缓慢向前推近聚焦她含笑的眉眼暖柔的柔光落在脸颊发丝随着细微动作轻轻晃动整体节奏缓慢优雅全程保留原图人物五官与着装特征画面流畅无变形生成同步的轻柔呼吸声与细碎的布料摩擦声。把Stage1的去噪强度调整到0.25-0.35区间进一步降低模型修改原图面部细节的自由度从生成起点就锁死初始人脸特征。改了参数后[INFO] Prompt executed in 00:13:45视频到时候发给大家看我曾经的女神搞成这样LTX-2.5_i2v_00005_