老杨 AI 女友 v1.0 专业版|打电话设置界面完整解析

这是老杨 AI 女友 v1.0 专业版的「打电话设置」配置页,该模块用于实现 AI 实时语音通话能力,支持定时提醒触发语音通话、上下文记忆对话;工具仅支持主动拨出,不能接收别人打进来的电话

顶部全局按钮(右上角)

  1. 重启 AI 女友:重启机器人服务,修改配置后,需要重启才会生效
  2. 关闭机器人:停止机器人全部运行
  3. 保存配置:所有参数修改完成必须点保存,否则配置丢失
  4. 导入配置:导入别人分享好的配置文件,快速一键复用整套语音参数
  5. 快速上手:跳转使用教程指引

左侧菜单栏

软件全部功能导航栏,当前选中:打电话设置 其他功能包含基础设置、角色人设、AI 大模型、图片识别、自动表情包、定时提醒、学别人说话、记忆管理、运行日志等全套 AI 聊天能力。

主配置区域详解

1. 启用 AI 语音实时通话(开关)

图中开关为开启状态 说明:开启后,定时提醒功能里可以触发语音通话,AI 可以语音对话聊天,支持上下文记忆;wxauto 底层限制,无法接听外部来电,只能主动呼出

2. 语音合成 (TTS) 服务商

TTS = 文字转语音,把 AI 输出文字变成人说话的声音 当前选择:阿里云,也可切换百度等服务商。

  • 控制台与音色试听:提供跳转链接,可以去阿里云 / 百度官方控制台,试听各种声音效果,复制音色 ID。
  • 语音 TTS API Key / Token:填入你在语音服务商平台申请的密钥凭证,程序调用接口生成人声。

提示:百度支持多 Key;阿里云只需要填这一项密钥。

  • 音色(百度 / 阿里云):当前选用四月 (Maia),下拉可以切换各种男女声、情感音色,决定 AI 说话的嗓音。

3. 语音识别 (STT) 服务商

STT = 语音转文字,把你的说话声音识别成文字交给 AI 大模型处理 当前选择:阿里云 当前 STT 仅支持流式识别,边说边识别,适合实时通话场景。

  • 语音 STT API Key / Token:填入语音识别服务的密钥,用来把麦克风的人声转成文字。

备注:百度需要填写AppID+API Key;阿里云填写 DashScope API Key。

4. 通话行为参数(数值调参)

  1. 接通后延迟 (秒):3

发起通话之后,等待 3 秒,AI 才开始说话;模拟现实电话接通之后的等待停顿,避免刚接通就突然出声。

  1. 静音多少秒视为说完:0.8

VAD 静音检测。当检测到你停止说话、静音达到 0.8 秒,就判定你说完话,AI 开始回答。

  • 数值调小:AI 反应更快,但是容易说话中途打断你;
  • 数值调大:不容易误打断,但会感觉 AI 反应迟钝。

整体工作流程

开启本功能 → 填入 TTS(发声)、STT(听声音)两套 API 密钥 → 挑选音色 → 调整通话延迟、静音阈值 → 保存配置 → 重启 AI 女友。 之后可以配合软件的定时提醒功能,触发 AI 主动发起语音电话,实现实时语音聊天,对话内容会写入记忆库,AI 记得之前聊过的内容。

补充注意:TTS、STT 都需要去阿里云 / 百度云开通对应服务,会产生少量接口调用费用,没有填写正确密钥,打电话语音功能无法工作。

5d084c5357d856208c5123cd9426bd8d_1788587187134996.webp