返回首页

帮助中心

关于画面译写、镜语译写与声意译写的使用说明与常见问题

最近更新:2026 年 8 月 29 日

画面译写

上传参考图,拆解光影、构图与风格,输出可直接用于主流生图模型的提示词。

支持哪些图片?有什么限制?

支持 JPG / PNG / WEBP / GIF,最大 2MB。边长建议 512–4096px,最长边不超过 8192px。上传文件仅用于本次处理,完成后自动删除。

输出有哪些模式?

可按页面选项输出通用描述、结构化专业词,以及 Flux / Midjourney / Stable Diffusion 等原生格式,复制即可使用。

「去 AI 感」是什么?

在译写时弱化塑料感、强化更接近真实摄影的表述。部分能力需登录后使用,以页面提示为准。

镜语译写

上传短视频,自动分镜并生成画面说明,再按需反推画面提示词与视频提示词。

视频有哪些限制?

支持常见格式(如 MP4 / MOV / WEBM / MKV),时长不超过 1 分钟,大小不超过 30MB。标准 / 精细 / 粗粒度三种分镜均最多 10 个镜头:标准均衡切点,精细更灵敏,粗粒度只保留强切点。上传文件处理完后自动删除。

工作流程是怎样的?

先完成切镜与镜头说明,再在结果区展开「反推分镜提示词」,为保留镜头生成画面与视频双提示词;不需要的镜头可删除。

声意译写

将文本合成为语音:情感塑形、声音克隆或预置音色三种成声方式。

参考音频有什么要求?

建议使用无背景音乐的纯人声。3–20 秒为最佳;较长音频将自动裁剪。文件不超过 10MB。上传音频仅用于本次合成,完成后自动删除。

三种成声方式如何选?

情感塑形:在克隆声色上叠加情感矢量;声音克隆:上传样本还原声纹;预置音色:库内音色即点即听,无需上传。

导出格式有哪些?

支持 MP3 / FLAC / OPUS,并可调节语速(约 0.5x–2.0x)。

账号、额度与隐私

关于登录、额度与数据安全的通用说明。

现在是免费的吗?

当前限时免费开放三大核心能力。注册后即可体验,具体额度与活动规则以页面提示为准。活动结束后将按套餐计费。

必须注册吗?

浏览部分能力可能开放体验,但提交任务、保存历史与部分付费能力通常需要登录。免费额度以套餐说明为准。

历史记录保存多久?

历史记录仅短期保存(例如约 3 天,以产品提示为准),请及时复制或下载重要结果。

上传内容会被拿去训练吗?

默认不会将您的上传用于与您无关的模型训练。处理完成后原始文件会自动删除。详见《隐私政策》。

服务条款·隐私政策