前台配置
语音前台是 Gateway 连接的实时语音模型。本页设置都写在用户配置文件中 (~/.config/qwaudio/config.env,见配置总览), 修改后执行 qwenaudio gateway restart 生效。
凭据与端点
默认 Provider 是 DashScope(QWEN_AUDIO_REALTIME_PROVIDER=dashscope):
dotenv
DASHSCOPE_API_KEY=your-key| 设置 | 默认值 | 说明 |
|---|---|---|
DASHSCOPE_API_KEY | — | 百炼 API Key,实时语音前台与网关其他功能共用 |
QWEN_AUDIO_REALTIME_API_KEY | 空 | 语音前台的 DASHSCOPE_API_KEY 高优先级别名 |
QWEN_AUDIO_REALTIME_BASE_URL / QWEN_AUDIO_REALTIME_URL | 空 | 覆盖 DashScope Realtime 端点(私有部署或代理) |
DASHSCOPE_WORKSPACE_ID | 空 | 切换到百炼专属 workspace 端点 |
完全本地化的前台可通过 QWEN_AUDIO_REALTIME_PROVIDER=speech-to-speech 启用, 见 Speech-to-Speech;自定义 Provider 需实现 Provider 契约,见自定义 Provider。
前台工具单独配置:Web 搜索(QWEN_AUDIO_WEB_SEARCH_PROVIDER,见 配置总览);通用对话工具见 前台 MCP 客户端、 前台 OpenAPI 适配器或 前台 Profile。
Realtime 模型选择
一个 Gateway 只拥有一个当前生效的 Realtime 模型。桌面设置页可以配置本地自有 Gateway 的模型,CLI 提供等价命令:
bash
qwenaudio config show
qwenaudio config set --realtime-model qwen3.5-omni-flash-realtime
qwenaudio gateway restart精确支持的模型 ID 如下:
| 模型 | 模型输入 | 模型输出 | 当前客户端传输 |
|---|---|---|---|
qwen3.5-omni-flash-realtime | 文本、音频、图片 | 文本、音频 | 文本、音频 |
qwen3.5-omni-plus-realtime | 文本、音频、图片 | 文本、音频 | 文本、音频 |
qwen-audio-3.0-realtime-plus(默认) | 文本、音频 | 文本、音频 | 文本、音频 |
qwen-audio-3.0-realtime-flash | 文本、音频 | 文本、音频 | 文本、音频 |
四个档案都支持 Function Calling。模型能力不等于客户端已经实现的传输能力:本版本 仍关闭 JPEG 观察帧和原生视频传输。WebUI 与 TUI 从 Gateway health 读取权威档案并 只读展示;同一 Gateway 上的不同客户端不能选择互相冲突的模型。桌面版附着到借用的 Gateway 时,或后续 CLI 运行时使用了冲突的已配置模型时,会拒绝不一致,而不会静默 修改运行中服务。回滚时设置上表的旧版模型 ID 并重启 Gateway。