早在2019年,Patently‑Apple就报道过配备摄像头的新一代HomePod相关技术发明。
随着Apple为这款未来版HomePod做相关准备,Apple针对设想中的多项重要升级补充了专利权利要求。
Apple这份关于基于视线的设备控制的专利续申请值得关注,新增的10项权利要求对这项发明做出大幅限定,聚焦一套更加具体的多设备控制架构:依靠用户视线锁定目标设备,同时由另一台设备协同执行对应的指令。
该专利家族的更大范围文件描述了利用视线信息唤醒数字助手、识别用户希望操控的周边设备,并在指令执行完毕之后给出反馈。
Apple给出示例:用户看向灯具、电视或者电脑,同时说出语音指令,系统就能够推断用户所要控制的设备,无需用户进行繁琐的口头描述。
最重要的改动体现在第一项新增权利要求,Apple在文件中描述一款电子设备,该设备可与各类传感器、输入设备通信,接收用户输入,通过传感器数据判断,满足针对第一台外部设备的视线判定条件,随后向不同于第一台设备的第二台外部设备发送指令,该指令将令第一台外部设备完成状态切换。
这套方案相比单纯注视设备、直接操控设备的模式更加复杂,该权利要求实际保护这样一套架构:解析用户意图的设备、被控制的目标设备、参与转发或者执行指令的其他外部硬件,三者可以相互独立。
这份申请并未将这些功能限定在Apple特定硬件产品上,但这套架构非常适配Apple生态,允许iPhone、可穿戴设备、智能家居硬件与数字助手协同工作,而非各个设备独立运行。
专利文件中的示例解释了这套协同机制的实际意义:用户站在台灯与落地灯之间,说出打开那盏灯,视线信息用来确认用户实际指向哪一盏灯具,语音指令则提供具体执行动作。
新增权利要求还将这套系统和数字助手进行明确绑定,其中一项从属权利要求写明,用户输入可以唤醒数字助手,操控外部设备的指令经由该数字助手完成下发,其余权利要求覆盖通过语音命令让目标设备切换工作状态的场景。
这份续申请对于Apple打造具备更强环境感知能力的Siri有着很高的参考意义,用户不必完整说出打开台灯这类完整语句,系统可以将简短的语音请求结合视线信息,补齐缺失的场景上下文。
Apple特别提到,基于视线的识别能够减少助手的追问环节,降低完成一条指令所需要的用户交互次数,由此形成更加自然的交互模式:语音表达用户想要完成什么操作,视线用来确定操作的作用对象。
Apple同时将指令执行之后的反馈响应纳入权利要求,这份续申请涵盖视觉反馈、音频反馈、数字助手确认提示,或是多种反馈组合,另有权利要求规定提示信号本身可以关联用户个体。
该部分看似属于次要功能,但在视线交互体系当中十分关键,用户需要得到确认,证明系统已经正确识别指令以及控制对象,如果周边有多台可受控设备,没有反馈的静默执行,会让用户很难察觉到系统识别出错。
该专利主文件同样描述通过视觉、音频提示确认外部设备状态变更,并且在指令无法完成时输出差异化提示。
另一项值得关注的权利要求,将视线判定条件与外部设备是否处于用户视场之内相关联。
专利说明文档明确,技术方案并不强制要求眼球精准聚焦在目标物体上,在部分实施方案中,只要设备处于用户的视场范围,就可以满足视线判定条件,同时结合头部姿态、视线方向、注视停留时间综合进行判断。
对比要求用户必须死死盯住控制对象的方案,该设计可以大幅提升这项技术的实际可用性。
这份续申请的核心意义在于,Apple的法律保护重点,已经转向生态协同控制,而不是仅仅把视线当作又一种独立输入手段。
这10项权利要求覆盖整套系统:视线完成场景识别,语音输出控制指令,数字助手负责调度,其他设备参与指令转发,最后向用户返回确认反馈。
这套架构对于未来可穿戴交互界面、智能家居控制、具备深度场景感知能力的Siri有着很高的应用潜力。
这份专利并不代表Apple一定会在某款特定产品落地该系统。但是对比泛泛而谈的视线控制概念,本次新增权利要求指向一套更加宏大的产品战略:Apple设备不止理解用户说了什么,同时感知用户正在看向哪里,判断周边哪一台设备应当做出响应。
