阿里云近日宣布,其智能体编程平台Qoder正式推出“眼镜版”应用,首批支持千问AI眼镜与乐奇AI眼镜设备。这一创新将语音交互与视觉感知深度融合,用户无需手持手机或触碰屏幕,仅通过佩戴智能眼镜即可完成复杂任务操作,标志着人机交互方式向更自然的场景化方向迈进。
与传统语音助手单轮问答模式不同,Qoder眼镜版采用全双工语音技术,支持多轮连续对话。用户可像与同事沟通般自然地布置任务、追问细节或补充要求,系统能实时理解上下文并作出响应。这种设计特别适用于骑行、徒步或手持物品等双手被占用的场景,用户无需中断当前活动即可处理紧急事务。
依托AI眼镜的显示输出功能,系统在任务关键节点、需要确认事项或涉及高风险操作时,会将关键信息以半透明卡片形式投射至视野边缘。用户通过语音确认或轻触镜腿即可完成审批,而任务进度更新、完成通知和异常警报则通过语音播报实时反馈。这种“眼耳协同”的交互方式,使用户在保持动作连贯性的同时获取决策所需信息。
该平台还整合了眼镜端摄像头的视觉感知能力,可自动识别现实场景中的多种信息:包括代码报错提示、设备运行状态指示灯、白板上的流程草图以及电子屏幕显示内容等。通过图像识别与自然语言处理的结合,Qoder能将视觉信息转化为可执行的任务指令,进一步拓展了智能体的应用场景。
目前Qoder已形成多端协同的产品矩阵:桌面端专注复杂项目处理与深度任务执行,支持上下文信息沉淀;移动端提供远程任务管控能力;眼镜版则作为现实世界感知入口,为智能体提供第一视角输入通道。三端数据实时同步,用户可根据场景自由切换操作终端。
据悉,Qoder千问AI眼镜版已启动定向邀请测试,完整功能预计将在2026年云栖大会上正式发布。此次升级将智能体技术从数字世界延伸至物理空间,为工业维修、远程协作、即时信息处理等领域带来新的可能性。







