Skip to content

前台配置

语音前台是 Gateway 连接的实时语音模型。本页设置都写在用户配置文件中 (~/.config/qwaudio/config.env,见配置总览), 修改后执行 qwenaudio gateway restart 生效。

凭据与端点

默认 Provider 是 DashScope(QWEN_AUDIO_REALTIME_PROVIDER=dashscope):

dotenv
DASHSCOPE_API_KEY=your-key
设置默认值说明
DASHSCOPE_API_KEY百炼 API Key,实时语音前台与网关其他功能共用
QWEN_AUDIO_REALTIME_API_KEY语音前台的 DASHSCOPE_API_KEY 高优先级别名
QWEN_AUDIO_REALTIME_BASE_URL / QWEN_AUDIO_REALTIME_URL覆盖 DashScope Realtime 端点(私有部署或代理)
DASHSCOPE_WORKSPACE_ID切换到百炼专属 workspace 端点

完全本地化的前台可通过 QWEN_AUDIO_REALTIME_PROVIDER=speech-to-speech 启用, 见 Speech-to-Speech;自定义 Provider 需实现 Provider 契约,见自定义 Provider

前台工具单独配置:Web 搜索(QWEN_AUDIO_WEB_SEARCH_PROVIDER,见 配置总览);通用对话工具见 前台 MCP 客户端前台 OpenAPI 适配器前台 Profile

Realtime 模型选择

一个 Gateway 只拥有一个当前生效的 Realtime 模型。桌面设置页可以配置本地自有 Gateway 的模型,CLI 提供等价命令:

bash
qwenaudio config show
qwenaudio config set --realtime-model qwen3.5-omni-flash-realtime
qwenaudio gateway restart

精确支持的模型 ID 如下:

模型模型输入模型输出当前客户端传输
qwen3.5-omni-flash-realtime文本、音频、图片文本、音频文本、音频
qwen3.5-omni-plus-realtime文本、音频、图片文本、音频文本、音频
qwen-audio-3.0-realtime-plus(默认)文本、音频文本、音频文本、音频
qwen-audio-3.0-realtime-flash文本、音频文本、音频文本、音频

四个档案都支持 Function Calling。模型能力不等于客户端已经实现的传输能力:本版本 仍关闭 JPEG 观察帧和原生视频传输。WebUI 与 TUI 从 Gateway health 读取权威档案并 只读展示;同一 Gateway 上的不同客户端不能选择互相冲突的模型。桌面版附着到借用的 Gateway 时,或后续 CLI 运行时使用了冲突的已配置模型时,会拒绝不一致,而不会静默 修改运行中服务。回滚时设置上表的旧版模型 ID 并重启 Gateway。