LG电子在9月30日于首尔江南区举行的微软行业峰会上,亮出与微软联手打造的智能家居AI语音助手ThinQ ON,内置微软Voice Live技术,支持用户在中途打断AI说话并切换话题。这款产品被视为LG在智能家居入口争夺中的关键落子,也是微软语音AI能力向硬件合作伙伴输出的最新案例。
技术核心:Voice Live如何实现”中途插话”
ThinQ ON的核心技术架构是语音到语音(Speech-to-Speech)智能体。与传统智能音箱的”一问一答”模式不同,Voice Live支持全双工对话:用户不必等AI把完整回答说完,可以在倾听过程中随时抛出新话题,系统会立即截断当前回答、捕捉新意图并平滑切换对话方向。
这一能力解决了传统语音助手长期被诟病的痛点:反应僵硬、听不懂半路改口。在实际家居场景中,这意味着用户可以像与真人对话一样,随时补充或修正指令,而不必等待上一轮对话完全结束。
LG表示,ThinQ ON将在今年内完成升级推送,现有ThinQ ON用户也将通过软件更新获得Voice Live能力。这是LG与微软在智能家居领域的首次深度技术合作,双方此前在AI领域已有多个合作项目。
市场定位:B2B场景的差异化路径
LG并未将战场局限在家庭客厅。酒店前台、办公室、零售门店等商用空间被明确列为ThinQ ON的目标场景。与消费级智能音箱的差异化在于,B2B场景对多轮对话稳定性、环境噪声适应和后台系统集成有更高要求,而这些正是Voice Live的技术优势所在。
从市场格局看,Amazon Echo、Google Home和苹果HomePod主导消费级智能音箱市场已超过五年,但增长见顶。各厂商开始向垂直场景渗透:Amazon切入院疗和酒店,Google发力车载和家庭能源管理,LG则选择了智能家居中枢这一品类,试图在控制权层面占据优势。
与同类产品的横向对比
当前具备语音打断能力的智能助手产品并不多见。Google Gemini 3.8 Live曾率先展示实时语音打断能力,而OpenAI的GPT-Live-1则在API层面提供了端到端全双工语音支持。LG ThinQ ON的差异化在于其作为家居中枢的天然入口优势:它不只是语音交互工具,更是连接空调、照明、安防、家电的统一控制平面。
微软Voice Live的市场布局
Voice Live是微软在语音AI领域的重要技术布局。通过向硬件合作伙伴输出这一能力,微软正在构建一个以Azure AI为底层、以Voice Live为接口的语音AI生态。与自建硬件的策略不同,微软选择了”软件定义硬件”的路径,让LG、三星等传统家电厂商成为其语音AI能力的渠道。
产品参数对比
| 产品 | 厂商 | 核心技术 | 打断能力 | 主要场景 | 上市时间 |
|---|---|---|---|---|---|
| ThinQ ON(升级版) | LG + 微软 | Voice Live(S2S智能体) | 支持全双工打断 | 家庭 + B2B(酒店/办公/零售) | 2026年内推送 |
| Gemini 3.8 Live | Gemini语音模型 | 支持实时打断 | 家庭、车载 | 已上线 | |
| GPT-Live-1 | OpenAI | 端到端全双工语音 | 支持 | API / 电话智能体 | API已开放 |
| HomePod | 苹果 | Siri / Apple Intelligence | 不支持 | 家庭 | 已上市 |
FAQ:LG ThinQ ON与微软Voice Live常见疑问
Q:现有的ThinQ ON用户需要换新设备吗?
A:LG明确表示,现有ThinQ ON用户将通过软件更新获得Voice Live能力,无需更换硬件。
Q:B2B场景的具体落地形式是什么?
A:LG瞄向了三个B2B方向:酒店前台(语音办理入住、控制房间设备)、办公空间(会议室设备管理)、零售门店(顾客语音查询商品信息)。具体合作伙伴和时间表尚未公布。
Q:与其他智能家居平台的兼容性如何?
A:LG未公布Matter协议或HomeKit的集成细节,但从ThinQ ON既有的生态覆盖来看,预计仍将主要服务LG自有家电矩阵,同时保留对部分第三方设备的兼容能力。
Q:微软Voice Live与其他厂商语音AI技术有什么不同?
A:Voice Live的核心差异在于”语音进、语音出”的全双工架构,而非传统ASR→LLM→TTS的三段式拼接。这一架构能显著降低延迟、提升打断响应的自然度,但对算力和模型能力的要求也更高。
小结
LG ThinQ ON升级版的发布,是传统家电厂商与AI软件巨头深度绑定的又一个案例。微软通过Voice Live输出语音AI能力,LG则借助微软的大模型技术补齐语音交互短板,双方各取所需。更值得关注的是B2B方向的布局:当消费级智能音箱市场增速放缓,向酒店、办公、零售场景渗透成为新的增长路径,而语音作为最自然的交互界面,在B2B场景中拥有比消费市场更高的使用频次和商业价值。
相关阅读
- Gemini 3.8 Flash TTS 发布:30 秒复刻声音,支持 100 种语言
- GPT-OSS 开源权重模型发布:120B/20B 双版本 Apache 2.0 可商用,128K 上下文与本地部署全解析
- 腾讯WorkBuddy套件化升级:五产品接入,网盘扩容10倍
延伸阅读
- OpenAI 叫停 GPT-6.1 Astra,对齐测试未达标2 天前
- Meta AI助手Muse被指偷看Mac通知:用户未授权却读出消息,官方否认”监视”1 周前
- OpenAI训练安全新规:高官手握否决权,警报超时自动停训1 天前
- OpenAI 推训练安全新规:高官手握否决权,警报超时自动停训1 天前
