目录一成品展示【视频】二灵感来源三创造历程和效果1.wan2.7-r2v-2026-06-12提示词/可灵第三方平台提示词×【视频】2.Wan2.2-Animate风格迁移模型【视频】3.Mix图像视频平台风格迁移功能效果也不好【视频】4.wan3.0Hypit效果可以【视频】5.wan2.7-r2v-2026-06-12Hypit测试效果动作一致性差×【视频】四成功工作流提炼HypitWan3.0如果你也有类似需求比如换人物、换宠物、参考别人动作、复刻一条短视频可以参考这个思路。1.Hypit开源项目github了解【图】2.codex安装Hypit指令npx skills add hypit-ai/hypit -g3.配置百炼平台的API密钥到环境中$env:DASHSCOPE_API_KEY 你的密钥4.将你的需求告诉GPT来生成提示词【提示词】5.处理素材我是只有30s的额度额度计算是输入时长生成时长累计所以平摊的话各自只有15s的额度。原视频15.3s所以需要将视频裁剪到15S后再提取15S音频这些工作直接让codex做【图】6.Codex执行输入四部分内容15S视频15S音频参考图片视频生成提示词当然可以参考我步骤4中的提示词将素材在电脑的位置路径写在提示词中让模型去读【图】五额外推荐六哲学思考一成品展示【视频】这次的目标很简单把我自己养的小狗替换到一段蒙古舞视频里同时尽可能保留原视频的动作节奏和音乐同步。最后真正让我满意的方案是Hypit Wan3.0 参考图片 参考视频 原始音频。wan3.0--prime_Hypit二灵感来源看到B站一个跳蒙古舞的小狗视频【视频】觉得很有意思我想我可不可以复刻因为自己也养了小狗说干就干。本来以为就是简单的“图片 视频做个风格迁移”真正开始做以后才发现没有想象中那么简单。既要保持小狗长得像背景不能乱变又希望舞蹈动作尽可能接近原视频最好连音乐节拍都能同步。B站参考视频三创造历程和效果总共尝试了多种方式和平台最便宜的实现了自己想要的功能。最终感悟是想要实现好的效果需要好的模型好的工作流。因为阿里云百炼平台有免费的视频生成额度所以不用白不用就拿来测试使用了不然常规的第三方调API一秒最少5毛太贵了顶不住【图】1.wan2.7-r2v-2026-06-12提示词/可灵第三方平台提示词×【视频】效果×内容清晰的但是动作不行一直抬起前爪往下按压当然跟提示词也有关系wan2.7-r2v-2026-06-122.Wan2.2-Animate风格迁移模型【视频】效果×诡异的搞笑感感觉是来叫魂的笑哭Wan2.2-Animate3.Mix图像视频平台风格迁移功能效果也不好【视频】效果×还是原有的视频内容后面偶尔会将自己小狗图片贴上去太抽象了viggle平台4.wan3.0Hypit效果可以【视频】效果√完美达成自己的要求动作跟随一致卧室背景能保留下来wan3.0--prime_Hypit5.wan2.7-r2v-2026-06-12Hypit测试效果动作一致性差×【视频】wan2.7-r2v-2026-06-12不接受独立的reference_audio类型生成上限10s效果×主体更稳定、背景也很稳定但动作明显被模型简化了没有抓住蒙古舞的精髓失去最关键有意思的点wan2.7-r2v_Hypi四成功工作流提炼HypitWan3.0如果你也有类似需求比如换人物、换宠物、参考别人动作、复刻一条短视频可以参考这个思路。-----------整体大概流程---------------你的需求图片 / 视频 / 音频↓Codex↓Hypit负责组织视频工作流↓Wan / Seedance / 其他视频模型↓最终视频1.Hypit开源项目github了解【图】①网址https://github.com/hypit-ai/hypit/blob/main/README.zh-CN.md②作用模型负责生成Hypit 负责把模型、素材、时间轴和需求组织起来。2.codex安装Hypit指令npx skills add hypit-ai/hypit -g3.配置百炼平台的API密钥到环境中$env:DASHSCOPE_API_KEY 你的密钥①密钥配置入口和网页注意密钥是SK开头还难找的不行【图】②踩的坑千万不要搞错了我一直把云服务的AccessKey当成模型API密钥了不是在这里配置【图】4.将你的需求告诉GPT来生成提示词【提示词】这一步比较关键主要是要和GPT掰扯清楚你的需求。例如我上传素材后说希望要做到和原视频的音频同步用的是wan3.0-video-prime模型额度只有30。GPT就会告诉我额度计算规则建议我裁剪视频到15S和提取视频音频。最终所有需求都确定了你的素材也处理好了再上传上去让他检查下没问题给你生成视频生成的提示词5.处理素材我是只有30s的额度额度计算是输入时长生成时长累计所以平摊的话各自只有15s的额度。原视频15.3s所以需要将视频裁剪到15S后再提取15S音频这些工作直接让codex做【图】6.Codex执行输入四部分内容15S视频15S音频参考图片视频生成提示词当然可以参考我步骤4中的提示词将素材在电脑的位置路径写在提示词中让模型去读【图】最终感悟好的模型决定能力上限好的工作流决定你能不能把这个能力真正用出来。五额外推荐卡兹克做的网站作者整理了大量 AI 视频生成的真实案例、Prompt 和模板可以直接研究别人成功的视频到底是怎么写的。这个博主的文章各方面对我有很大的启发①goodcase-githubhttps://github.com/LearnPrompt/awesome-seedance/blob/main/README_zh.md?utm_sourcechatgpt.com②goodcase.aihttps://goodcase.ai/cases/boa-hancock-water-obstacle-race-prompt六哲学思考“互联网时代链接信息与人而AI时代链接的是能力技能可以被复用能力可以被分享。”--Hypit 把 room_dog.jpg、dance_15s.mp4 和 dance_15s_audio.mp3 组织起来Wan3.0 将动作、身份、音乐与画面重新编排Wan2.7、Wan2.2-Animate 的失败也不再只是一次消耗而是能够被记录、比较和复用的经验。过去我们分享链接现在我们分享技能、流程和判断把“让小狗跳蒙古舞”从一个人的尝试变成别人也能接续的能力。技能可以被复用能力可以被分享创作因此不再只属于少数专家。互联网连接了彼此AI 让彼此的能力继续生长。结尾语如果本文对您有帮助请点赞鼓励一下这对我真的很重要。您的每一次鼓励都是我继续创作的动力谢谢啦下次见。