Notes · · 9 分钟阅读

AI + 3D 打印:正在让更多的事情成为现实

Microduck、ESP-Mosaico,和我自己打印的那套水杯秤外壳:当开源软硬件、模块化与 AI 同时降低门槛,3D 打印改变的将不只是几件小东西,而是「从想法到实物」这条路的长度。

硬件 AI 产品思考

八月的最后一周,两件看起来毫不相关的事情几乎同时发生了。

8 月 27 日,Hugging Face 联合法国机器人公司 Pollen Robotics 发布了一只鸭形机器人 Microduck,售价 399 美元(约 2681 元人民币)。同月下旬,做 ESP32 芯片的乐鑫也发布了一款为 Coding Agent 设计的模块化开发板 ESP-Mosaico——摄像头、传感器、电机都做成了可拼接的模块,还能让 AI 参与开发。

一个是「能学会走路」的平价机器人,一个是「能组合出各种设备」的硬件积木。

表面上它们是两家公司的两款新品。但我更愿意把它们放在同一条时间线上看:制造实物的门槛,正在被一层一层拆掉。

而拆掉它的,是三件事的组合——开源软硬件、3D 打印,和 AI。

过去半年我一直在做自己的小硬件:智能水杯秤、桌面宠物。一个直接的体会是:阻碍你做出一件东西的,已经越来越不是「会不会造」,而是「想不想开始」。这篇文章想聊的,就是这种变化是怎么发生的,以及它可能带我们去哪里。

Microduck:399 美元,一台可以「学」的机器人

先说这只鸭子。

它高约 25 厘米、重不到 800 克,大概比一只手能托起的玩偶大不了多少。但这么小的身体里塞了一套完整的运动系统:15 个自由度分布在双腿、头颈和一只可开合的鸭嘴上,鸭嘴还能用来拾取小件物品。

项目 参数
高度 / 重量 约 25 cm / 不到 800 g
自由度 15(腿部、头颈、鸭嘴)
主控 Rockchip RK3566 平台(1GB RAM + 32GB 存储)
感知 单目摄像头、机身与头部两组 IMU
交互 麦克风、扬声器、头部与鸭嘴两组 NFC、Wi-Fi / 蓝牙
电池 可拆卸 2600mAh(NP-F550),续航约 1 小时
形态 双足,可加装轮子切换轮式形态
售价 399 美元(约 2681 元)

光看参数,它更像一个带摄像头的遥控玩具。真正值得注意的是软件侧。

Microduck 出厂就自带一批用强化学习训练出来的技能:站立、行走、踢球、轮滑、被推倒后自己爬起来。这些动作不是工程师一行行写死的运动学代码,而是在 MuJoCo 仿真环境里「摔」出来、再迁移到真机上的神经网络策略——官方把这套流程称为 sim-to-real,仿真到实机的迁移。

更关键的是,这套东西几乎全开源:软件栈、SDK、虚拟训练环境、强化学习训练脚本、一套经过验证的仿真迁移工作流,用户还能用 Python、JavaScript 编写自定义行为。也就是说,你拿到的不只是一只会做固定动作的鸭子,而是一个低成本物理 AI 实验平台——可以让它学任何新动作的平台。

Hugging Face 的人给这台设备起了个 slogan,叫「为运动而生,也准备好摔倒」(made to move, ready to fall)。这句话我很喜欢。它的意思是:机器人可以失败、可以犯错,而让它在试错中学会新技能,这件事本身就应该成为产品的一部分。他们甚至希望你教会它做任何事——包括重新站起来。

市场的反应也很诚实。开放预购后一度平均每 4 秒卖出一台,销售额很快达到约 50 万美元,官方目标销量超过 2 万台。负责生产的是深圳的开源硬件企业矽递科技(Seeed Studio)——中国供应链 + 全球开源生态,这个组合让 399 美元成为可能。

一件过去只属于实验室的事——让机器自己学会动作——第一次有了「买得起、拆得开、训得了」的形态。具身智能的入场券,正在从数万美元的科研设备,变成一张千元级的预购订单。

3D 打印 + 模块化:结构不再是「不敢改」的部分

Microduck 能做到 399 美元,除了软件开源,还有另一半原因:它身体里的电子部分其实并不神秘——主控是 RK3566 平台的现成小板,舵机、IMU、摄像头、麦克风都是开发板生态里常见的成熟型号,外壳与结构件再交给供应链批量生产。

这让我想到自己做设备时的一个变化。

我的智能水杯秤,最后做了一套 3D 打印外壳,大致四层:最上面是放杯子的承重面板,下面是传感器受力结构,再往下是电路与电池层,最底是防滑底壳。这个结构听起来简单,但它几乎决定了项目的成败——杯子放在面板哪个位置读数都准、承重面板不能碰到底壳、泼洒的水不能流进电路、传感器不能被侧向力顶偏。

如果没有打印机,这个项目大概会止步于「洞洞板 + 热熔胶」的实验状态:能验证算法,但没法长期摆上桌面。而有了 3D 打印,结构就不再是一个需要一次想清楚的决策,而是一轮可以快速重来的迭代——画图、打印、装上试、发现问题、改一版。一天可以跑好几轮,而每一轮的成本几乎为零。

过去一年,类似的变化其实一直在各个层面发生:

  • AI 让「软件」可以随时改——说一句话,Agent 就能改代码、加功能、重跑测试;
  • 模块化让「电子」可以随时换——摄像头、传感器、屏幕、电机变成即插即用的能力块,接线和驱动不再是重复劳动;
  • 3D 打印让「结构」可以随时变——外壳、支架、连接件,全部本地生产,不必开模、不必等供应商。

单看每一项,都是小改进。但它们叠加起来的效果是:「把一个想法变成实物」的过程中,最贵的三个环节——软件、电子、结构——都在同时变便宜。

以前做一件新东西,最难的不是想法,而是从想法到样机之间那段漫长的、充满返工的路。现在这条路正在被压缩成:想清楚要什么,然后快速把原型做出来,再看它哪里不对。

这正是 Microduck 这类产品出现的土壤:当每个人都能廉价地打印结构件、组合标准模块、再用 AI 写代码训练技能,个人开发者能做出的东西,正在逼近过去一个小团队才能做出的东西。

ESP-Mosaico:当「适配场景」变成「拼积木」

如果说 Microduck 代表了「买一台能训练的机器人」,乐鑫的 ESP-Mosaico 则代表了另一条路:「自己拼一台想要的设备」。

ESP-Mosaico 的主机是一块带屏的独立设备:ESP32-S31 主控(RISC-V 架构、最高 320 MHz),480 × 480 的 OLED 触控屏,内置电池,支持 Wi-Fi 6、双模蓝牙和千兆以太网,可以脱离电脑单独运行。而它真正的设计意图,藏在名字里——Mosaico,镶嵌画,无数小块拼在一起组成完整作品。

它的功能模块把摄像头、传感器、按键、灯光、电机等能力封装成了标准件。接入模块后系统会自动识别并完成适配,不需要反复接线、不需要自己写底层驱动——用官方的话说:Connect a module. Unlock a capability.(接上一个模块,就解锁一种能力。)

更进一步,多台 ESP-Mosaico 主机之间可以互相感知相邻关系和姿态,通过无线同步应用状态。拼合、分开、重新排列,本身可以成为应用的一部分——跨屏游戏里,不同设备分别显示角色、地图和道具;信息面板场景里,几块屏可以按需组合。

但我觉得最有意思的,是它把 AI 拉进了硬件开发。

乐鑫为它设计了两条创作路径:Chat Coding,从一句自然语言需求出发,内置的 Coding Agent 直接在设备上生成并运行应用——你可以对它说「帮我写一个俄罗斯方块小游戏」,它就在设备上写出来、跑起来;Vibe Coding,则让 Agent 参与开发、部署、真机验证的完整闭环——改代码、构建、烧录、观察反馈、继续修,由 Agent 持续迭代。

过去一年我们反复讨论「AI 让软件可以随需生成」。但一个被忽略的问题是:软件能随时变,硬件却不行——每次想加一种能力、改一次形态,都要重新选型、重新接线、重新适配驱动。ESP-Mosaico 想解决的正是这个错位:当软件可以持续变化时,硬件也要变得可以组合、可以扩展。

它更像一个信号:芯片公司不再只卖芯片和开发板,而是开始搭建「AI + 硬件」的创作平台。乐鑫手里有十多年积累的 ESP 开发生态——GitHub 上围绕 ESP32 的项目超过 20 万个,文档、组件、工具链都是现成的——这些工程积累,正在变成 Agent 也能调用和验证的基础设施。

当然,模块化能覆盖的是「能力」,覆盖不了「形态」。而形态的部分,恰好可以交给 3D 打印。你可以很容易想象:把一块 ESP-Mosaico 主机、几个功能模块,装进自己打印的壳子里,得到一台从里到外都是自己定义的小设备。乐鑫没有做打印机,但这并不妨碍两件事拼在一起——标准的能力块负责「好用」,3D 打印负责「长成你想要的样子」。

AI 负责「想」,3D 打印负责「做」,模块化负责「复用」

把这三件事放在一起看,一个比较清晰的图景就出来了。

AI 降低的是「想」的门槛。 你不会写代码,可以用自然语言让 Agent 生成;不懂算法,可以让机器人通过强化学习自己学动作;不知道怎么设计界面,可以让 Agent 按规范生成。过去需要几年训练的技能,现在变成了一句需求。

模块化降低的是「用」的门槛。 摄像头、屏幕、传感器、电机这些重复出现的能力,被封装成标准件之后,任何人都可以组合它们,而不必从零搭建。经验以模块的形式被复用,而不是被锁在某个工程师的脑子里。

3D 打印降低的是「做」的门槛。 它是这三者里最「物理」的一环:把数字世界里的设计,变成手里能拿到的实物。而且它足够便宜、足够快,让人敢于尝试——敢于做一件可能失败的东西,因为失败的代价只是一次打印。

这三件事不是三个独立趋势,而是一个互相放大的系统:

AI 负责想象,3D 打印负责成形,模块化负责复用。当一个想法能用一句话描述出来,这个系统就能把它变成一件真实、可用、可以持续演化的东西。

具体会发生什么,我倾向于做一点更谨慎的推演,而不是宏大叙事。

首先,长尾需求第一次有了经济性。 过去只有销量足够大的产品才值得开模量产,而 3D 打印让「只做一件」和「做一万件」的边际成本差距大幅缩小。那些太小众、不值得大公司做的设备——某种特定病情的辅助工具、某种特殊工艺的夹具、某个教室需要的教具——会越来越多地以极低成本出现。

其次,桌面级机器人会先于家用全能机器人普及。 Microduck 卖爆说明了一件事:人们不一定需要一台帮你做家务的机器人,但很多人愿意拥有一台可以观察、可以训练、可以失败再爬起来的小机器。它会先以玩具、宠物、教具的形态进入家庭和课堂,把「训练一个智能体」这件事变成日常经验。

第三,学习的门槛也会跟着降。 现在想让学生理解双足机器人,需要昂贵的实验室;想让人理解强化学习,需要数学和代码基础。而一只 399 美元的鸭子,可以让一个孩子亲眼看到「机器人摔倒——试错——学会站起来」的完整过程。这种直觉,是任何课本都给不了的。

写在最后

文章开头我说,八月最后一周的两件事看起来毫不相关。但把它们放到更长的时间尺度上,它们其实是同一个进程的两条支线:软件在变得可以对话,硬件在变得可以拼装,实物在变得可以打印,而 AI 把这三者缝在了一起。

我的智能水杯秤早就打完了外壳,放在工位上每天安静地记录着喝水量。桌面宠物还在桌上,等着自己的屏幕、表情和动作。我越来越觉得,这几年最奢侈的变化不是某个模型又变强了,而是:当我想做一件东西的时候,「做出来」这件事本身,已经很少再成为拦路的问题。

也许再过一两年回头看,2026 年八月那只 399 美元的鸭子,会像当年第一台桌面级 3D 打印机一样,被看作一个再普通不过的起点。

AI + 3D 打印,正在让更多的事情成为现实。而这其中最先成为现实的,可能就是你最近想做的那个东西。