大家好,我刚刚做一个 AI 视频编辑网站,叫 Genjutsu AI ,来这里自荐一下。 它主要处理这样的需求:手里已经有一段视频,动作和镜头都合适,希望用一张参考照片换掉里面的人物,而不是重新拍一遍。 其实就参考 higgsfield 的 genjutsu 模型的效果 网站: Genjutsu AI 大概怎么用 选择现有视频,截取一段 4–30 秒的片段,具体模型可能要求更短。 添加清晰的人物参考照片,先从一张开始。 选择人物替换,描述要换的是谁、哪些内容希望保留。 登录检查素材和积分报价,确认生成后查看进度,最后对照原视频检查并下载。 比如可以这样描述: 将画面中唯一的讲话者替换为参考照片中的人物,沿用原视频的手势和动作节奏,尽可能保留背景和镜头构图。 这里的描述是给模型的指令,不是自动锁定人物的跟踪控制。多人交叉走动、转身或遮挡时,仍然需要检查结果。 目前有一个什么样的例子 站上有一段公开的 8 秒单人口播替换案例,可以同时查看原视频、参考照片和实际生成结果。 这条输出是 1280×720 ,约 8.04 秒。人物和服装发生了变化,开头、中间和结尾抽查时,背景总体保留,原声音轨也保持了时间对齐。 查看案例和人物替换页面 但这个例子只说明单人讲话镜头的基本效果,不能代表全身舞蹈、复杂转身都能做好。替换双人视频中的一个人、让另一个人完全不变,目前也还没有通过专门的案例验证。 有几个限制先说清楚 可能连服装和身体外观一起改变,不是只换脸的局部遮罩工具。 保留原声不等于生成新声音,也不保证替换后嘴型逐帧同步。 背景、构图和人物相似度都要实际检查,不能只看第一帧。 本地选择素材和预览不会启动付费生成;上传检查需要登录,生成前会显示积分报价。 底层使用已有的视频模型,我做的主要是把素材准备、编辑指令、报价、任务进度和结果对比串成一个网页流程。Genjutsu AI 是独立网站,与 Higgsfield 没有关联,账号和积分也不互通。 如果你做过视频编辑,或者试过类似工具,想听听你真正需要的场景。换人物时,你更在意相似度、动作连续性,还是原背景能不能保留?现有流程里哪里觉得麻烦,也欢迎直接指出来。


  • 情报分类:硬件与数码
  • 分类依据:内容涉及硬件、数码产品或通信卡
  • 信息来源:服务器 / V2EX
  • 发布时间:2026/10/8 19:37:34