阅读时间大约10分钟以上(4488字)
作者:吕鑫燚 出品:具身研习社
又是一个冷知识,2025年具身智能很多私下的声音指向了一个结论:今天的具身智能,没有审美。
这当然是一句打趣的话,但这也是几百款产品排排站,看起来像是“复制粘贴”的人形机器人行业中最精准的总结。
行业早期阶段,大家更多的注意力自然会放在“能不能做”,没人会要求一台机器人“外观好看”。相反,裸露的传动结构、棱角分明的工业造型,曾是功能优先时期中的一种实力叙事。这个时期内,外观的审美在研发排期里永远排在末位,很少有人会为了视觉观感再多做些加法。
变化发生在落地场景的迁移之中。2025 年,当越来越多的具身智能产品走出工厂,进入商场、酒店、写字楼,甚至开始试探家庭消费市场,这套工程导向的外观逻辑,第一次成了落地的显性障碍。
第一层障碍是,工业风的外观放在风格各异的商业空间中,略显“气质不搭”,人形机器人很难从观感上融入空间,更别提自然和人交互。第二层障碍也由此显现,线下空间中,人形机器人的出现大多停留在 “被围观” 的阶段。人们举着手机隔着安全距离拍摄、赞叹,却很少主动上前交互。冰冷的金属质感、强烈的工具属性,在人与机器之间划出了一道无形的安全边界。
千寻智能在 WAIC 2026 上发布的 Moz2,第一次让这个隐藏的行业反思,有了具象的解法。
不同于多数人形机器人被围在护栏之后、供观众远距离拍照观摩的常态,Moz2 的展位前没有生硬的隔离界线,人们会下意识凑上前招手、对着它比心,还有人自然地伸手轻触它温润的机身外壳。这是绝大多数同品类产品从未获得过的亲近感,它不是作为一件技术展品被仰望,而是作为一个可交互的实体,被人本能地接纳与靠近。

当然“好看”只是Moz2 的初印象。圆润过渡的轮廓、低饱和的暖调机身、克制收敛的结构细节,处处传递着 “可亲近” 的信号。它的设计逻辑从根源上反转了行业惯性,不是先做技术堆叠再包装外壳,而是先划定人与机器的舒适相处边界,再把所有硬核能力收敛进温柔的形态之中。
这种审美取向带来的改变,远不止视觉层面的 “好看”。Moz2 是面向商服场景的机器人,当Ta未来进入商超、酒旅、办公楼宇等公共服务场景,它将不再是一台等待呼叫的被动响应设备,也不是会让路人下意识避让的冰冷装置,而是一个人们愿意主动走上前、开口求助,甚至愿意停下脚步互动的服务节点。
人与机器的交互门槛,在外观被看见的第一眼,就已经被大幅拉低。这一次,人类开始触摸未来的伙伴,开始接纳和它的“共呼吸”图景。
回头再看 2025 年那句 “具身智能没有审美” 的调侃,更像是行业新旧范式交替的注脚。
当算力、运动控制、感知算法逐渐拉平到同一条基线,当 “能用” 已经成为行业入场券,真正拉开差距的胜负手,恰恰藏在那些曾经被轻视的关于 “美” 的细节里。它从来不是锦上添花的装饰,而是具身智能真正走入人类日常的必经之路。

关于人形机器人的本体设计,行业默认的起点永远是工程参数。
自由度、性能、场景动线适配、负载能力。所有设计优先服务于 “功能实现”,外观只是硬件的一层包装,先造出能干活的机器,再给它套上一层说得过去的外壳,是全行业心照不宣的通行路径。这条路径正确,但很难造出一个兼具美观和有“灵魂”的产品。
Moz2 的诞生,恰恰是对这套惯性的反向突围。
用千寻智能产品经理的话来说,Moz2 的起点是先想明白什么是“产品的DNA”,这决定了产品从出生到最后成长为现在所成为的样子。顺着这条路径,千寻智能的设计思路不是“它能做什么”,而是 “它是什么”?
这个问题让整个 ID 设计流程在一个月内推翻了 3 版方案。在内部看来被推翻的方案都只是“好看的外壳”,直到“IP化”的灵感出现,故事才迎来了新走向。
为什么很多IP能被所有人喜爱?答案从来不是 “外壳好看”,而是它们从诞生第一天起就有完整的人设、有性格、有自己的小世界,它们是被 “塑造” 出来的生命,而不是被 “设计” 出来的产品。
“脱离 IP 的外观设计是空洞的。” 千寻的产品经理意识到,造机器人和塑造 IP 本质上是同一件事。你得先想明白这个 “人” 是谁,它的性格是什么,它说话是什么语气,它有什么小习惯,然后它的长相、它的动作、它和人互动的方式,都会自然地长出来。
于是产品经理写了十几版机器人 IP 人物卡:灵动的精灵、绅士的管家、知性的女佣、拽拽的小伙…… 每个角色都有详细的年龄、MBTI、口头禅、生活习惯。最终留下来的,是一个 “ENFP 性格(偏内敛)、温柔好奇、有点害羞”的形象。

Ta是酒店里会默默帮你送东西、会提醒你 “三点有个会,外面太阳好,开完可以出去走走”的小同事;是超市里会帮你指路、会悄悄把乱掉的货架整理好的小店员。是和你共处一个空间时,分寸感刚刚好,丝毫不违和的存在。
它的定位从一开始就不是 “更聪明的工具”,而是 「贴心的助手 + 亲切的伙伴」。
这个定位决定了后来所有的设计细节,为什么选低饱和度的奶杏色而不是科技感的银灰色?因为温暖不刺眼,柔感材质让人想伸手摸;为什么全身上下都是圆角没有任何尖锐棱角?因为没有攻击性,老人小孩靠近都不会有压力;为什么要给它做不同颜色的小围脖?因为那是它的 “OOTD”,不同场景可以换不同风格,它不是千篇一律的机器,它可以有自己的小个性。
这是一次彻底的逻辑反转,这种产品哲学不是先造出机器再给它套上人的外壳,而是先定义好一个 “灵魂”,再让硬件和算法围着这个灵魂生长。

2026 WAIC上Moz2获得了众多观众的喜爱
如果说 IP 化设计是 Moz2 的“灵魂”,那么“AI 原生” 的联合设计理念,就是支撑这个灵魂真正活起来的骨骼。
行业里谈“AI 原生” 已经谈了很久,但大多数时候这个词的意思还是 “先把硬件做出来,再往上面装大模型”,硬件和软件、数据在某种程度上依然是上下游的角色,最后拼在一起。这种路径下,数据采集效率低,算法训练和硬件适配要反复磨合,AI 能力更像是后期打上去的补丁,而不是从骨子里长出来的本能。
Moz2 走的是另一条路:从第一天起,具身大脑、机器人本体、uDAS 数采设备三者就是联合设计、同构生长的。
这意味着人类示教的数据可以直接、高效地迁移到机器人本体上,不需要做复杂的格式转换和适配。硬件不再是 AI 的 “容器”,而是和 AI 共同进化的“身体”。数采不再是训练前的工具,而是和本体映射的 “镜像”。三者从设计之初就是一体的 。
这才是真正意义上的“AI 原生”。
IP塑魂,原生塑骨, Moz2 的本质都是在回答同一个问题:当机器人真正走进人的生活空间,它该以怎样的姿态存在?

当机器人以“IP化”逻辑设计,一条不易被察觉的新落地路径便跃然纸上。千寻智能产品经理对具身研习社表示“人形机器人落地,应该技术向内藏,温度向外露”。
温度在外,这一点已经能从 Moz2 的外观中看出,而技术向内,则体现在和 Moz2 的交互中,而这也是真正让人留下来的。
过去我们和机器人对话,总像是在和一个听力不好、记性也差的客服说话,你必须清晰地说出指令,它才能识别,你问一句它答一句,答完就忘。稍微换个说法,它就听不懂了。那种机械的、一问一答的交互,本质上还是在发出命令,而不是在和人说话。
Moz2 想做的,是 “让人慢慢忘记它是机器人”。
和它打过交道你就会明白,它的 “懂”从来不是卖点。你随口和它说一句 “帮我取一下刚洗好的衣服”,它会默默记在心里去做任务,也不会转头就忘。更难得的是这份 “懂” 自带恰到好处的分寸,它不会过度热情地凑上来搭话,不会在你想安静的时候打扰你,更不会刻意刷存在感。它只是把你的需求放在心上,等你需要的时候,一回头,它刚好就在旁边。
这种记忆,是曾经专属于人和人之间的情感连接。如今,当这份情感链接迁徙到Ta和你之间,这种 “被记住” 的感觉,恰恰成为了Ta和机器人之间真正的分水岭。
识别情绪、记住喜好,这些能力得益于千寻智能自研的具身基座模型Spirit v1.6,采用VLA与世界模型深度融合架构,打通了环境感知、任务理解、动作规划与状态预判的完整决策链路。在WAIC现场,Moz1 基于相同模型完成了“整理客厅”长程复杂任务,把可乐放在冰箱里、收拾碗、整理沙发,这一系列的动作中,即便面临观众的干扰,Moz1 都能记住自己的任务,实时感知变化。

Spirit v1.6不仅突破了行业具身模型普遍存在的“金鱼记忆”瓶颈,让机器人可以长时间在任务环境中工作,拥有记忆。还可以真正自主思考自主规划,让机器人成为人类伙伴与助手。
除了大脑赋予的聪明外,Moz 2温柔的体验背后,还有千寻智能硬核的技术在托底,只是这些技术从来不会跳出来刷存在感。
Moz 2整机全栈自研,每一处都是对作业能力的精准回应。全向舵轮底盘让Moz2人来人往的酒店走廊里穿梭,不会撞到人,不会卡在拐角,遇到小朋友跑过它会提前停下来。高功率密度一体化力控关节,构建起高可靠、高安全的力矩感知系统,让Moz2递东西给你的时候力度刚刚好,就算不小心碰到你,也会立刻停下来。
从能力适配角度来看,Moz 2的作业高度范围是0-2m,负载单臂可达3kg、双臂6kg,覆盖1.7m身高人的主要工作场景,这份作业物理半径,让Moz 2能在商服场景中具备和人类相似的作业范围,能执行整理衣服、收纳,还能帮你端茶送水。0-2m的作业空间超出人类上限,能轻松将衣服送到更高位置的洗衣机,还能弯下身收拾地面的垃圾。

据具身研习社了解,Moz2还支持激光雷达、深度相机、超声波传感器、鱼眼相机,这意味着,Moz2 能更精准地建图、避障,能看得见透明的玻璃门,能注意到脚边的纸箱,能在任何复杂的商用场景里安安全全地走,不会给任何人添麻烦。
这才是技术真正的意义,在商用场景里,一个好的服务者本来就该是这样的:你需要它的时候它就在,你不需要它的时候它就安安静静做自己的事,不刷存在感,不打扰别人,把该做的事情做好,把该给的温度给到。它不会时刻提醒你 “我是个高科技产品”,不会用夸张的动作吸引围观,它就像团队里那个话不多但很靠谱的同事,你一回头,它刚好在。
而做到这一切的前提,就是让技术退到后面,让温度走到前面,这也是Moz 2 的设计价值观。
就像最好的酒店服务是你感觉不到服务的存在,但所有需求都被满足了,最好的机器人也是你感觉不到技术的存在,但所有事情它都帮你做好了。
那些你看不见的地方,才是它最厉害的地方。

Moz2 的亮相,不是一个孤立的产品发布,而是千寻 “先工业、再商服、后家庭” 三步走战略的关键落子。
第一步的 Moz1,在宁德时代等严肃工业场景完成了落地验证;第二步的 Moz2,是把 Moz1 在工业场景里经过千锤百炼的技术能力,完完整整地继承下来,然后装进一个适合和人相处的产品形态里;第三步,则是沿着这条路径持续渗透,最终走进家庭。
值得注意的是,这三步棋在技术端一脉相承。
Moz 1 过去两年积累的真实操作数据,铸就了更聪明的大脑,也是 Moz2进入真实世界的基石。而硬件本体与数采体系架构同构,也为后续 Moz1 成熟的长程规划、精细操作能力快速平移提供了底层支撑,实现通用能力的跨产品复用。
也就是说, Moz 1和 Moz 2互相成就,共同在物理场景中进化,为后续家庭场景的新成员,奠定一个更懂任务规划、人类行为的基础。

不过, 前两步棋在产品形态端依旧有着不小区别。
Moz 1 走的是“工业风”,底盘、手臂自由度、末端执行器都是适配于工业场景,这些场景要的是高效率, Moz 1 的本体结构设计,能让它在严肃环境中,稳定、精准的执行任务,适配工业生产的节拍。而Moz 2 面向的是人流更多的服务场景,除了在技术和外观上要兼具温暖和安全,在产品形态上也要满足商超、酒旅、办公楼宇等角色的使用诉求。
为了满足B端使用的诉求,Moz 2 在机身预留多处磁吸扩展点位,这是业内首创的产品逻辑。它回应的是真实场景中,尚未得到满足的“既要又要”需求。一方面,B端对产品外观有定制化需求,当下常见的解决方案要么是穿上一件格格不入的衣服,要么就是用3D打印做一个“新壳”,都是费时、牺牲美观度的选择。而磁吸扩展可快速更换外观适配不同场景品牌风格。就连Moz 2 身上的“小围脖”,也可以根据品牌诉求随时更换。
更有实用价值的是,扩展点位还可外挂配送托架、巡检模组等功能配件,可以满足不同场景、不同任务的使用诉求。
从今天这个视角再来看千寻智能这三步棋的底层逻辑,其走的是从封闭到开放,从工具到伙伴,从 “被需要” 到 “被接纳”。
先在封闭的工业场景里证明技术是可靠的,再在半开放的商服场景里证明产品是被人接受的,最后才敢走进最开放的家庭场景,成为真正和人朝夕相处的伙伴。这是对技术、对产品、对用户的尊重。
今天很多人谈具身智能,总喜欢谈颠覆、谈革命、谈一夜之间改变世界,但千寻走的这条路,看起来一点都不性感:先在工厂里蹲两年磨技术,再做商服场景磨体验,一步一步往前走,不跳步,不冒进。等这些都验证完了,进家庭就是水到渠成的事情。而支撑这一切的,是从一而终的技术同构设计,所有产品共享同一个具身大脑,所有场景练出来的能力可以互相复用,越做越强,越做越懂人。
但恰恰是这条路,才是最有可能走通的路。
