关于画面译写、镜语译写与声意译写的使用说明与常见问题
最近更新:2026 年 8 月 29 日
上传参考图,拆解光影、构图与风格,输出可直接用于主流生图模型的提示词。
支持 JPG / PNG / WEBP / GIF,最大 2MB。边长建议 512–4096px,最长边不超过 8192px。上传文件仅用于本次处理,完成后自动删除。
可按页面选项输出通用描述、结构化专业词,以及 Flux / Midjourney / Stable Diffusion 等原生格式,复制即可使用。
在译写时弱化塑料感、强化更接近真实摄影的表述。部分能力需登录后使用,以页面提示为准。
上传短视频,自动分镜并生成画面说明,再按需反推画面提示词与视频提示词。
支持常见格式(如 MP4 / MOV / WEBM / MKV),时长不超过 1 分钟,大小不超过 30MB。标准 / 精细 / 粗粒度三种分镜均最多 10 个镜头:标准均衡切点,精细更灵敏,粗粒度只保留强切点。上传文件处理完后自动删除。
先完成切镜与镜头说明,再在结果区展开「反推分镜提示词」,为保留镜头生成画面与视频双提示词;不需要的镜头可删除。
将文本合成为语音:情感塑形、声音克隆或预置音色三种成声方式。
建议使用无背景音乐的纯人声。3–20 秒为最佳;较长音频将自动裁剪。文件不超过 10MB。上传音频仅用于本次合成,完成后自动删除。
情感塑形:在克隆声色上叠加情感矢量;声音克隆:上传样本还原声纹;预置音色:库内音色即点即听,无需上传。
支持 MP3 / FLAC / OPUS,并可调节语速(约 0.5x–2.0x)。
关于登录、额度与数据安全的通用说明。
当前限时免费开放三大核心能力。注册后即可体验,具体额度与活动规则以页面提示为准。活动结束后将按套餐计费。
浏览部分能力可能开放体验,但提交任务、保存历史与部分付费能力通常需要登录。免费额度以套餐说明为准。
历史记录仅短期保存(例如约 3 天,以产品提示为准),请及时复制或下载重要结果。
默认不会将您的上传用于与您无关的模型训练。处理完成后原始文件会自动删除。详见《隐私政策》。