VisorSTUDIO 登录

使用文档

帮助与选项指南

每个选项能为你做什么——更快还是更好,竖屏还是横屏,保留人脸还是替换人脸。

高质量图片

生成精细清晰的图片,适合成品和主视觉画面。

质量
细节和真实感最佳——适合用作交付素材。
速度
比快速模式慢,换来更完整精细的效果。
适用场景
创意已经定下来、需要一张成品图时。

把你的角色放进视频里

把你有权使用的视频中的人物替换成你的角色,同时保留原有的动作和背景。

质量
能较好地保留姿态和背景;画面复杂时,建议先试做一小段看看效果。
速度
较慢;长视频会分段处理后再拼接起来。
适用场景
当你想替换你有权使用的素材中的人物时。

按参考照片锁定人脸

生成新图片时,完整保留参考照片中人物的面部。

质量
相似度锁定非常强,但其他方面的发挥空间会略微受限。
速度
比普通图片稍微多花一点时间。
适用场景
当你的角色需要在多张图片中保持一致时。

分段处理长视频

把长视频拆成若干段,这样运行更稳定,中断后还能继续。

质量
段与段的衔接处值得检查一下;大多数画面都能自然衔接。
速度
总耗时更长,但每一段能更快完成。
适用场景
处理长片段时开启,运行更稳定。

快速模式

以相同的分辨率快速出片,先预览、省时间。

质量
分辨率与其他档位相同,只是为了更快而做了精简。
速度
最快的档位。
适用场景
在做成品之前想先快速看一眼时。

高质量模式

以最长时长和最高分辨率输出成品。

质量
在你所选档位中质量最高。
速度
最慢;可能需要排在其他任务后面。
适用场景
导出交付用的成品时。

生成声音与音效

根据文字描述生成音效和简短的背景音。

质量
适合拟音、环境音和风格化音效,不适合完整歌曲或人声。
速度
通常几十秒,具体取决于所需长度。
适用场景
描述具体的事物和动作(“铁门吱呀声”“雨打窗户”),并说明氛围、强度和想要的长度。
限制
长度受你设定的时长限制。复杂的多层混音建议先做几段短音频,再组合起来。

用文字或图片生成视频

根据文字描述或现有图片生成短视频。

质量
画面和声音一起生成——台词会配上相应的声音;每段片段最长 15 秒。
速度
几秒的片段,耗时中等。
适用场景
当你想用一个创意、一张图片或一组参考图做出带声音的短视频时。

锐化与放大

让图片和视频更清晰,重建细节,而不只是把尺寸拉大。

质量
素材越干净效果越好;噪点多或压缩严重的素材可能会暴露更多瑕疵。
速度
图片:几秒。视频:时长越长,耗时越久。
适用场景
处理长片段时,先用较低的档位试一下,确认效果。

提高分辨率

把图片或视频放大到更高的分辨率。

质量
放大倍数越高,细节越锐利,但瑕疵也越明显——素材噪点多时,先用较低的档位试试。
速度
放大倍数越高,耗时越长。
适用场景
草稿用较低的档位,成品用较高的档位。

把主体从背景中分离出来

逐帧识别并分离画面中的人物,只改动角色所在的区域,不影响背景。

质量
分离越精确,头发和手部的边缘越干净;分离不好则会渗到背景上。
速度
生成前会多花一点分离的时间。
适用场景
在视频中替换角色时必须使用;画面复杂时记得检查边缘。

保持姿态与动作

识别身体姿态,在替换角色时保持正确的站姿和动作。

质量
姿态锁定很强;快速运动或遮挡会降低准确度。
速度
逐帧处理,负担小、速度快。
适用场景
适合全身镜头;只拍脸部时作用不大。