语音下单不是简单的语音转文字
交易指令里包含多个相互关联的字段。只说“黄金开多”还不够,系统还要知道手数以及是否有止损、止盈;一句“平多”则对应完全不同的持仓选择流程。
MT5 Plus 会把语音先转成文本,再判断交易动作、方向、品种、手数、价格和风险参数。得到结构化结果后,用户仍需要核对关键字段。语音负责减少输入,不能替代交易判断。
动作识别
区分开多、开空、平多、平空、全平、保本和取消等意图。
数字与单位
处理“零点一手”“两手”“五个点”等中文口语表达。
同音纠正
结合交易词规则处理常见识别偏差,降低术语转写错误。
结构化确认
展示方向、手数、价格和止盈止损,避免只凭一段文本执行。
从按住说话到订单提交
- 按住语音按钮说话期间保持按住,松开后结束录音;向上滑动可取消本次输入。
- 本地语音识别音频在设备端交给离线识别流程处理,首次使用可能需要初始化模型。
- 交易词解析与纠错本地规则先匹配动作、品种、手数、价格、止损和止盈。
- 必要时补充解析本地无法完整判断但明显包含交易意图时,可使用识别文本进行结构化补充。
- 核对并确认检查品种、方向、手数、价格、止损和止盈;只有确认后才进入订单提交。
常见语音指令示例
| 自然语言 | 系统理解 | 用户仍需核对 |
|---|---|---|
| 黄金 4000 开一手多单,止损 10 个点 | XAUUSD 多单,手数与止损点差 | 价格类型、品种后缀、手数和止损距离 |
| 做空 0.1 手,止盈 5 个点 | 当前品种市价开空并带止盈参数 | 当前品种是否正确、手数和止盈方向 |
| 平掉多单 | 打开多单持仓选择流程 | 目标订单、手数和浮动盈亏 |
| 全平 | 进入批量平仓检测与确认 | 管理范围和检测到的订单数量 |
| 黄金保本 | 准备对黄金持仓执行保本 | 目标持仓、部分平仓手数和保本偏移 |
| 取消 / 撤销 / 算了 | 作废本次语音输入 | 确认没有生成待执行指令 |
提高识别准确率的表达方式
- 先说动作,再说手数,最后补充价格、止损和止盈,例如“开多 0.1 手,止损 5 个点”。
- 需要指定品种时直接说出名称,例如黄金、原油或欧元;未说品种时使用 App 当前选择的品种。
- 手数尽量使用明确数字,例如“0.1 手”“一手”;止盈止损说明是点数还是具体价格。
- 松开按钮后再结束句子,识别范围以按下到松开之间的音频为准。
- 安静的环境、清晰的数字和较短的句子通常更容易得到稳定结果。
使用限制与风险边界
重要:语音识别可能存在环境噪声、口音、网络和模型误差。任何下单前都应看确认信息,不能因为“听到了”就假设字段一定正确。
- 基础识别可依赖本地模型,但补充解析和实际下单仍需要可用的网络连接。
- 不同券商的品种名称和后缀不同,语音中说出品种后仍需确认是否属于当前账户。
- 系统不会因为用户未说出手数就随便填一个数量;缺失字段应重新表达或放弃本次指令。
- 语音解析只负责理解交易意图,不判断行情是否值得交易,也不承诺成交结果。
- 本地模型初始化或设备性能较低时,首次识别可能比后续操作慢。
常见问题
语音下单需要联网吗?
基础识别主要在本地完成,无网络时仍可尝试使用本地规则;本地无法完整判断的交易语句可能需要联网进行补充解析。
原始录音会上传到服务器吗?
当前语音解析接口接收的是识别后的文本。原始录音用于本地识别,不通过该解析接口上传。
说错品种或手数会怎样?
系统会尽量把内容转换为结构化字段并显示供核对。无法确定的字段不会被随意猜测,用户应放弃或重新说出完整指令。