热门搜索:和平精英 原神 街篮2 

您的位置:首页 > > 教程攻略 > ai资讯 >音述AI新版本反推提示词功能操作教程

音述AI新版本反推提示词功能操作教程

来源:互联网 更新时间:2026-08-20 13:35

音述AI新版本图片反推需更新至v2.3.1+,通过首页AI工具箱或创作→反推入口进入;上传前裁剪主体占60%以上、关闭智能水印增强、勾选结构化JSON;结果含中文完整版与精简关键词版,技术术语不可删改。

音述AI新版本反推提示词功能操作教程

想用音述AI新版本把一张氛围感十足的参考图快速转成可复用的提示词,却卡在上传后没反应、反推结果空泛或根本找不到入口——这不是你不会用,是没踩对新版界面逻辑和关键触发点。

确认是否已进入「音述AI」最新正式版

打开App后,首页左上角显示「v2.3.1」或更高版本号;若为v2.2.x及以下,需前往应用商店更新。旧版不支持视频反推与多版本提示词并行输出,强行操作会导致解析中断或返回默认模板词。

点击右下角「我的」→「检查更新」,弹出「已是最新版」提示后再进行后续步骤。未更新直接跳入功能页,

【所有反推操作将静默失败且不报错】

图片反推提示词:三步定位+一键启动

方法一:首页快捷入口(推荐新手)
首页中部「AI工具箱」卡片→向左滑动至第三页→找到图标为「放大镜+画框」的模块→点击进入。

方法二:路径直达(适合批量操作)
首页→底部导航「创作」→顶部标签切换至「反推」→选择「图片反推」。

⚠️注意:不要点进「语音转文字」或「音频分析」同类图标,二者UI高度相似但底层模型完全不同,误入后上传图片会提示「不支持该文件类型」。

上传图片后的关键设置项

第一步:上传前裁剪画面主体
点击「上传图片」后,系统自动唤起本地相册;选中目标图→进入预览页→双指缩放并拖动,确保主体人物/核心物体居中且占画面60%以上面积。背景杂乱、主体过小会导致光影与构图参数识别失准。

第二步:关闭「智能水印增强」开关
该功能默认开启,会强行强化图中文字/Logo边缘,干扰AI对原始视觉权重的判断。必须手动关闭,否则反推词中会高频出现“bold text”“sharp logo”等无关描述。

第三步:勾选「输出结构化JSON」
这个选项在上传按钮下方的灰色小字区域,默认是未勾选状态。勾选之后,结果页会同时生成带有字段标签的JSON数据,其中包含"subject_position":"center"、"lighting_angle":"45-degree-left"等可用于编程的字段,非常便于接入自动化流程。

解析完成后的结果使用策略

结果页默认展示「中文完整版提示词」,含主谓宾完整句式,可直接复制粘贴至即梦、通义万相等平台;点击右上角「切换」按钮,可调出「精简关键词版」,用英文逗号分隔,适配Stable Diffusion WebUI。

若首句出现“a photorealistic image of...”,说明模型判定该图为实拍照片;若为“an anime-style illustration of...”,则归类为二次元图像——该前缀不可删除,否则生图时风格崩解概率提升73%。

点击「编辑提示词」可手动删减冗余描述,但

【禁止修改“medium shot”“soft backlighting”“cinematic color grading”等带技术术语的短语】

,这些是经多轮校验保留的核心控制锚点。

视频反推:仅限MP4格式且单段≤12秒

进入「反推」页→切换顶部标签为「视频反推」→点击「上传视频」→从相册选取符合要求的片段。不支持MOV、A VI、带B帧压缩的HEVC编码,上传后若进度条卡在99%,大概率是格式不符。

上传成功后,页面自动截取第3秒、第6秒、第9秒三帧作为关键帧采样点,分别生成对应提示词。你只需在结果页横向滑动查看三组输出,无需手动截图再上传。

每组提示词末尾均带时间戳标注,如“[t=6.2s] subject raises right hand slowly”,复制时务必保留方括号内容,MiniMax H3、Seedance2等模型依赖该标记实现动作锚定。

手机号码测吉凶
本站所有软件,都由网友上传,如有侵犯你的版权,请发邮件haolingcc@hotmail.com 联系删除。 版权所有 Copyright@2012-2013 haoling.cc