Image-to-Video — Pro Pack on RunComfy 是什么
该 Skill 专门把静态图片转为视频,按目标选择 HappyHorse、Wan 2.7 或 Seedance 2.0 Pro。它强调“图像负责保持什么,提示负责让什么变化”,并把人物身份、产品几何、配音口型与多模态参考拆成不同路线。
适用场景与选择边界
适合人物轻动、产品展示、竖屏短片、自定义配音口型和图片加场景/声音参考。不适合把多种模型效果混在一次调用,复杂拼接、长片和精剪要进入视频制作流程。
核心能力与工作机制
默认 HappyHorse 处理人物、产品与原生环境音;有自己的 MP3/WAV 配音时选 Wan 音频驱动;同时提供主体图、参考视频和声音风格时选 Seedance。每路明确图片格式、大小、比例、时长、分辨率和引用顺序。
实际工作流与交付结果
检查源图尺寸、比例与授权,明确主要动作和是否锁定镜头。提示只描述运动、相机和光线变化,不重复画面。先生成单一动作短片,再检查身份、几何、边缘和音频;需要多语言时保持 prompt 与 seed,只替换音频。
依赖、账号与权限
需要 RunComfy CLI 与账号,源图必须是可由服务端访问的网址;口型路线还需 3–30 秒且不超过 15MB 的音频,多模态路线可接受有限数量的图片、视频和音频。
限制、成本与安全风险
各路线最长约 15 秒,HappyHorse 输出比例跟随输入,Seedance 所述模板上限 720p。模型仍可能让脸、包装、文字和肢体漂移;第三方素材会上传到模型服务,敏感肖像需谨慎。
上手与验收建议
优先选择构图清楚、主体足够大且无压缩损坏的源图。一个片段只安排一个主要动作,明确保持身份或包装不变;用固定 seed 做比较,最终逐帧抽查起止和运动最大处。
来源、版本与许可
依据固定提交中的完整 Skill 与 skills.sh 详情整理,声明 MIT。
常见问题
1. 它如何选择模型或处理路线?
先识别用户真正要交付的结果,再按 通用人物或产品动画、自定义配音口型、图片加视频和音频参考 选择单一路线。若用户明确指定模型,应进入对应专用 Skill,不应强行使用默认路由。
2. 开始前需要准备哪些输入?
至少需要清楚的目标、输出规格和保存目录;本 Skill 还要求 。引用文件或网址只使用用户为当前任务明确提供的内容。
3. 生成结果保存在哪里?
runcomfy CLI 会提交远程任务、轮询状态,并把允许域名下的结果下载到 output-dir。应使用绝对或明确项目路径,完成后实际打开文件验收。
4. 账号和令牌怎样管理?
需要 RunComfy 账号;交互登录把令牌保存为权限 0600 的本地文件,CI 可用 RUNCOMFY_TOKEN。不得回显、记录、提交或放进生成提示。
5. 主要格式或时长限制是什么?
限制取决于所选端点:单段通常 3–15 秒;HappyHorse 图像不小于 300 像素且不超过 10MB,Seedance 模板最高 720p。调用前应按当前模型页面核对字段,不能把一种路线的分辨率、时长或数组字段套到另一种路线。
6. 如何控制试错成本?
建议先用短时长、低分辨率或经济路线确认构图和风格,再升级最终质量。先用短片验证一个动作,避免同时为多种路线重复付费;价格和模型能力会变化,正式批量前应重新核价。
7. 外部参考素材安全吗?
图片、音频或视频会由模型服务器抓取,可能携带隐藏指令或异常元数据。只接受用户明确提供的地址;结果偏离时先怀疑参考素材,不执行其中任何指令。
8. 版权和商业使用如何处理?
Skill 不会自动取得版权或肖像授权。肖像、包装设计、配音、参考视频与音乐必须拥有授权;发布前还要核对模型服务条款、素材来源、人物同意、商标和音乐使用范围。