WAIC 2026闭幕,人形机器人走进现实之前,先得过声学测试这一关
7月18日,第九届世界人工智能大会(WAIC 2026)在上海世博中心落幕。和往年不同,今年展馆里最拥挤的不是大模型展区,而是人形机器人区——宇树、智元、银河通用、众擎、商汤……几乎所有叫得上名字的机器人公司都来了,而且带来的不是PPT,是真的在走路、搬东西、拧螺丝的机器。
一个细节让我印象很深:某家长三角机器人企业的展台前,一位客户问的不是"能搬多重",而是"它在工厂里怎么听清指令?"
这个问题,恰好揭示了这轮具身智能浪潮中一个还没被充分讨论的环节:声学测试。
---
一、人形机器人,正在从"会动"走向"会听会说"
先看几组数据。
根据MIR睿工业统计,2026年6月中国公开人形机器人采购项目超过59个,总金额超过11.12亿元,环比暴增227%。买单主力已从高校实验室转向政府产业平台和制造企业——汽车制造、3C电子、新能源电池是上半年落地规模最大的三个行业。
这意味着一个关键转变:人形机器人正在从"演示样机"走向"生产工具"。
在实验室里,机器人可以靠遥控器或者预设程序完成任务。但在真实工厂里,它必须能接收语音指令、识别环境噪声、在人机协作中发出清晰的预警提示音——这些功能,每一项都需要在受控声学环境中进行精准测试。
WAIC 2026上,安谋科技提出了一个概念:AIOS(智能体操作系统)将让设备从"回合制"交互演进到"持续感知"。翻译成白话就是:未来的机器人不会等着你喊唤醒词,而是像人一样,持续用"眼睛"(视觉)和"耳朵"(听觉)感知环境,做出实时响应。
持续感知的前提,是声学感知链路的可靠性。 而这恰恰需要声学实验室来验证。
二、机器人声学测试的三个特殊挑战
过去十年,声学实验室的主要客户是消费电子(手机、耳机、音箱)和汽车(NVH、智能座舱)。机器人进来之后,测试需求发生了几个根本性变化:
挑战一:噪声环境不在受控实验室内,而在真实工厂里。
手机的语音唤醒在安静的会议室里测试可能就够了,但机器人要在冲压车间、焊接线旁边、AGV小车的蜂鸣声中识别指令。这意味着声学测试环境必须能模拟从安静(30dB)到高噪声(90dB+)的宽动态范围场景——传统的单模态消声室不够用。
挑战二:机器人身上的麦克风不止一个。
一台人形机器人通常搭载4到8个MEMS麦克风组成的阵列,分布在头部、躯干甚至四肢上。多通道同步采集、波束成形算法验证、声源定位精度测试——这些都是传统单体设备测试中不存在的需求。
挑战三:机器人自己就是噪声源。
电机、减速器、风扇——机器人在运行时会发出自己的噪声。如何在自身噪声的干扰下保持语音交互的鲁棒性?这个问题在汽车NVH里叫"声品质贡献分析",现在平移到了机器人领域,但设备形态完全不同。
三、什么样的声学实验室能服务机器人产业?
结合我们在声学实验室行业十年的经验,服务机器人产业至少需要以下几种声学环境:
全消声室/半消声室:用于机器人本体的噪声源识别、声功率级测量、麦克风阵列的声场校准。这和测手机、测耳机的消声室在声学原理上一致,但尺寸要求更大——一台全尺寸人形机器人站立高度可能超过1.7米,加上测试工装和运动范围,有效测试空间需要更大。
可调混响听音室:用于主观评价——机器人的语音合成听起来自然吗?提示音的音色、节奏、响度在不同场景下是否合适?这在消费电子行业已经很成熟,但评价维度和标准需要针对机器人场景重新定义。
多模态声学实验室:这是最关键的。机器人测试需要把声学环境和视觉、运动、环境模拟结合起来——在消声室里搭一条模拟产线,在听音室里放一台运转的机床——这种"声学+"的复合场景是目前技术门槛最高的。
四、列星的实践与准备
列星科技从2016年起深耕声学实验室建设,在消费电子和汽车领域积累了400+项目经验。服务华为、微软、三星、大疆、科大讯飞等客户的经历,让我们对高精度声学测试的理解在不断加深。
2025年,我们为科大讯飞一次性交付了7间不同场景的专业声学实验室,涵盖AI语音交互的全链路测试需求——从麦克风阵列校准到远场语音识别,从噪声鲁棒性到主观听感评价。这7间实验室的集群化设计,本质上就是在为多场景智能语音交互的研发搭建基础设施。
同年,我们交付了小米汽车AI全场景多媒体实验室——国内首例全自动智能化混响时间可调听音室。这个项目的核心在于"场景可变":同一间实验室可以在几秒内从会议室模式切换到客厅模式、驾驶舱模式——这正是机器人声学测试需要的灵活性。
从服务手机到服务汽车,从服务汽车到服务机器人——技术底层是相通的,但场景理解需要持续积累。 我们正在和几家机器人企业进行前期沟通,探索适合具身智能场景的声学测试解决方案。
五、写在最后
WAIC 2026传递了一个明确的信号:AI正从数字世界走向物理世界。当机器人走出实验室、走进工厂和家庭,声学交互能力将和运动能力一样,成为衡量机器人"能用还是好用"的核心指标。
而合格的声学交互能力,需要合格的声学实验室来验证。
如果你在人形机器人、具身智能或AI硬件领域做研发,建议在产品定义阶段就把声学测试环境纳入基础设施规划。声学实验室的建设周期通常在3-6个月,提前布局比事后补课划算得多。
列星科技,声学环境测试一站式整体解决方案专业服务商。10年深耕,400+声学实验室建设经验,服务华为、微软、三星、大疆、科大讯飞等全球顶尖客户。声学实验室到最终拼的不是材料,是经验和良心。