
2028年机器人能在陌生环境独立完成哪些工作
王兴兴在2026年世界互联网大会上明确指出,具身智能的“ChatGPT时刻”最快将在2到3年内(即2028年前后)到来,届时机器人能在80%的陌生场景中通过语音指令独立完成80%-90%的任务,标志着机器人从固定产线走向开放场景的质变。
一、家庭服务场景
物品整理与收纳:机器人能根据语音指令,在从未见过的房间中自主整理衣物,将黑色衣物放入脏衣篓,并确认衣物数量。
物品取放与识别:可识别多层药盒中的颜色与数量,取出指定层数的药盒;也能从地面拾取白色抱枕并确认颜色。
厨房辅助:能够自主将盘子放入洗碗机,并识别内部透明玻璃杯的位置。
家居调节:通过语音指令调节病床高度,并在到达指定位置后停止响应。
日常保洁:在未见过的房间中,根据“帮忙整理一下这个房间”的指令,独立完成物品归位、地面清洁等基础家务。
二、工业与商业场景
工业巡检:在工厂、仓库等陌生环境中,机器人可自主完成设备巡检、异常报警等工作,无需预先编程或环境建模。
物流配送:在复杂的仓储或配送中心,机器人能根据语音或文字指令,完成货物分拣、搬运及定点投送。
医疗护理:在病房或养老院等陌生场景中,机器人可辅助完成物品传送、简单护理操作(如递送药品、调节床位)。
餐饮服务:在餐厅后厨或前厅,机器人能根据指令完成传菜、餐具回收等基础服务工作。

三、公共服务与特殊场景
会议与活动支持:在从未见过的会场中,机器人可听从“把这瓶水带给某位观众”等指令,自主规划路径并完成任务。
教育辅助:在教室或培训机构,机器人能根据指令协助教师分发材料、整理教具,或进行简单的互动教学。
零售与导览:在商场、博物馆等公共场所,机器人可提供导览讲解、物品指引、促销信息播报等服务,适应动态人流与环境变化。
四、实现路径与技术支撑
硬件已基本够用:王兴兴明确表示,当前机器人的整机、灵巧手等硬件已能满足通用任务需求,核心瓶颈在于AI模型而非硬件。
AI模型突破:他认为VLA(视觉-语言-动作)模型是“傻瓜式架构”,更看好视频生成模型驱动机器人控制的技术路径,有望更快收敛并实现泛化能力。
分布式算力:未来机器人将依靠工厂级或小区级分布式服务器提供算力,解决本体功耗限制与延迟问题,支撑复杂任务实时处理。
全球共创:王兴兴多次强调,技术进步需要全球开源社区、企业与高校协作,共同攻克模型架构与数据利用难题。
