到现在,还没有一款AI硬件卖出过100万台
"没有百万台的爆款,也许恰恰因为此前的AI硬件都在卖功能,没人在经营数据回路。"
AI Pin凉了,Rabbit R1凉了,Lookie和Nuna吃灰率也很高。就算是Plaud,也还是23年底录音笔+AI总结的形态。
一个扎心的事实是:到现在为止,全球没有一款主动式多模态Agent硬件卖出过100万台。AI硬件的概念现在吹的很玄幻,但落地的产品却都很接地气
这是星穹方舟CEO段然在一场圆桌上说的话。按常理,这个数字应该让在场的硬件创业者悲观。但同一张桌子上,做力控机械臂的、做教育机器人的、做脑机接口的、做家庭陪伴硬件的,没有一个人悲观。
原因很简单:他们赌的都不是模型,是数据。

工厂不是具身智能的应许之地
先说一个反直觉的判断。
现在具身智能赛道最热的故事是:大模型带来泛化能力,机器人从此什么都能干。但非夕科技胡晓平当场泼了盆冷水:大部分工厂要的是专业和稳定,跟大模型"既做A又做B"的泛化目标,根本是错配的。
非夕出身斯坦福机器人实验室,十年死磕力控,让机械臂像人手一样做灵巧作业。胡晓平举了个特别形象的例子:人插USB,根本不知道接口的精确位置,但每次都能插进去。力的感知、手法,这些东西刻在人的骨子里,可放到机器人身上,难如登天。

传统工业机械臂走精准位置路线,结果就是只能在固定场景干活,开放场景一律抓瞎。这就是为什么工厂里还有那么多劳动密集型环节,机器人始终啃不动。
"他的结论很直接:未来三年,工厂是大模型和具身智能的试验场,不是放量场。真正先产生规模化收入的,是把操作能力做到极致的机械臂,而不是会聊天的机器人本体。良率、可靠性只是入场券,最终促成采购的只有一个指标:回本周期。"
Context is all you need
段然是全场最敢说的。
他做AI可穿戴,眼镜、吊坠、戒指全在布局。外界看这是资源分散,他的回答特别祛魅:根本没有什么"寻找最佳载体"的宏大叙事,就是不知道哪个品用户喜欢,多开几个,能收回成本就行。

为什么敢这么干?因为深圳。芯片统一用恒玄那几款芯片统一用恒玄、杰理、炬芯、全志那几款,传感器供应链也是歌尔、AAC那几家;未来五年,会出现一款像电脑一样,sensor供应链不变,多开一个SKU增加的成本不是80%、100%,只有20%左右。做生意第一考虑成本管控,就这么接地气。
祛魅归祛魅,判断不含糊。他认为未来三年,会出现一款像电脑一样、70%以上年轻人人手一台的AI原生硬件。具体形态?不说,"要知道我就该上市敲钟了"。
"但他敢说的是方向:下一代AI硬件的核心是context。基模能力相同的情况下,谁掌握用户全天候的上下文数据,谁的服务能力就比别人高出40%以上,用户就再也离不开你。而所有产品形态里,只有可穿戴硬件能做到这一点。"
巨头环伺怎么办?他给了两条路。一条是学Even Realities,切欧洲商务人士这个高端净值人群,两个月前刚拿了10亿人民币融资。另一条更直白:抱大腿。新品9月在华为HC全连接大会发布,欢迎大家到时候来体验。
整场圆桌我最想记住的一句话也来自他:"没有窄的赛道,只有你窄的眼界。"再窄的品类,第一天就go global,基数也足够养活一家公司。
硬件不是护城河,这话是硬件公司老板说的
鲸鱼AI贾昕东抛出了一个更反直觉的观点。
鲸鱼做青少年教育机器人,400多款产品卖到81个国家,连续7年盈利,挺过疫情、挺过双减。按理说,硬件是它的命根子。但贾昕东说:硬件放眼海外确实是优势,可内容才是更深、更长远的护城河。

逻辑很妙。正因为中国有珠三角、长三角这样全世界独一份的供应链,硬件成本谁都能做低,反而构不成壁垒。只做硬件出海,很难出圈。
真正硬核的是内容和数据。自研AI平台过滤所有不适合孩子的内容,价值观上不卷分数、培养AI思维;自办的ENJOY AI全球青少年AI机器人科创比赛办了七年,每年全世界超过15万青少年参加;国内3万多所学校、1万多家机构在用他们的方案。
接下来打C端家庭市场,他明说对标小天才:家长侧打安全焦虑,孩子侧打社交和娱乐,两头都抓住。而在AI时代,深耕七年的青少年数据,会是这家公司最值钱的资产。
两种"笨办法",同一条数据路
还有两位,一个往家庭里钻,一个往人脑里钻,打法看似最慢,逻辑却一模一样。
风火轮萤图孔维刚做的是主动交互:大部分智能硬件还是"你叫它它才动",他们要让设备自己感知情境、主动服务。他的拆解很硬核:手机是为通信设计的,熄屏了怎么持续感知?手机没法固定在一个场景里长时间解决角度问题,数据源天然有缺陷。主动交互的主要载体,一定是新形态的智能体硬件。

但卖硬件不是目的。他真正看重的是硬件背后的回路:真实需求带来高频使用,高频使用产生真实场景数据,数据反哺主动交互大脑,大脑再让硬件更聪明。
神舞科技李杨做的是脑机接口。商业化路径同样"笨":先不碰C端,先卖科研。清华北大等高校都在建脑机接口学科,用他们的设备做实验。因为脑电大模型是行业的必经之路,谁先占据数据质量、建起数据平台,谁就占据行业上游。

写在最后
五个人,五条路。机械臂、眼镜、教育机器人、陪伴硬件、脑电头环,产品形态毫无关系。
"但把每个人的话拆开看,底层是同一个判断:模型能力会趋同,供应链会被拉平,唯一拉不平的,是谁离真实世界的数据更近。没有百万台的爆款,也许恰恰因为此前的AI硬件都在卖功能,没人在经营数据回路。下一款真正破圈的AI硬件长什么样,没人知道。但它的主人,大概率是那种从第一天起就在攒数据的人。"
更多对话细节
Speakers|嘉宾
风火轮萤图 创始人&CEO 孔维刚
星穹方舟 CEO 段然
非夕科技 集团副总裁 胡晓平
上海鲸鱼AI机器人 海外2C市场负责人 贾昕东Slade
神舞科技 合伙人兼副总裁 李杨
Host |主持人
非凡产研 深圳负责人 康正中

康正中:正式讨论前,每人用一分钟左右介绍自己和业务。孔总先?
孔维刚:大家好,我是风火轮萤图创始人&CEO 孔维刚。我们基于主动交互大脑、真实场景交互数据,以及家庭陪伴智能体硬件构建商业闭环。核心是通过底层技术,推动智能体硬件和机器人本体从指令感知走向主动交互。
胡晓平:大家上午好,我是非夕科技胡晓平。非夕2016年成立,源自斯坦福机器人实验室。我们主要解决机器人操作能力问题。智能体未来落地跟物理世界接触,操作能力赋能非常关键。核心逻辑是让机械臂更接近人手,突破在力控维度的技术创新,让机器人像人手一样完成灵巧柔性作业。
贾昕东:大家好,我是上海鲸鱼AI海外市场部负责人贾昕东。我们专注 AI+教育,2017年成立,商业化非常成功。公司有400多款机器人,涵盖人形、飞行型、模组型、陪伴移动型,在全世界81个国家有合作。
李杨:我是神舞科技李杨。我们做脑机接口,背靠清华神经工程网络实验室,把技术应用到现实生活。希望借助脑机接口让人脑更健康更强大,连接你我,连接世间万物。
工厂不是具身智能的应许之地
康正中:第一个视角,智能体跟新载体融合,AI 跟硬件融合创新怎么看。先问胡总。非夕目前处于最热的具身智能赛道,大家都在追逐人形机器人整机,非夕选择把仿人类能力放到七轴机械臂里,通过力控、力学、视觉、AI,把不确定性变成可自适应。从具身智能或机器人板块,标准化场景还是智能工厂。工厂需要稳定产出,不会为形态或想象力买单。未来三年,能先产生规模化收入的,是人形机器人本体,还是更智能的机械臂?真正拉开差距的,是大模型能力,还是力控、可靠性?
胡晓平:这个问题目前具身智能赛道大家比较关注。工厂确实是自动化最早落地、产生社会价值的场景,新技术迭代也会考虑快速部署。早期自动化用工业机械臂,大型笨重,做人力不能及的事,比如节拍很快或搬运很重。但技术路线追求精准位置精度,导致只能在固定场景完成任务,无法放到开放场景做柔性、变化场景的适配。应用有局限,工业机器人占比依然很低,需要技术突破。突破方向想到人,工厂还有很多劳动密集型产业,靠人力解决工业机械臂无法实现的。人力和工业机器人的差异在工作模式上。人对绝对精度和位置无感,比如插 USB,不知道准确位置但每次都能完成。力的感知、手法刻在骨子里,反映到机器人身上很难。要突破自动化升级,力控路线必然要走。非夕从一开始选这个路线,看到在工业现场复杂工艺解决的能力,既做柔性装配,又做复杂表面处理。
回到具身智能赛道。大具身智能随大模型发展,希望泛化能力赋能机器人解决各种场景。但目前出发点,大模型带来泛化目标,希望既做 A 又做 B。大部分工厂应用要求专业和稳定,两个方向存在差异。执行能力、操作能力升级,相对于智能体,在工厂应用优先级更快。预计大模型或具身智能,工厂是试验场景,不是目前放量场景,更多需要解决机械臂本身操作能力升级。
康正中:我4月份去胡总公司参观过,当时说的自适应机械臂,不去体验对"自适应"感受不深。有个场景是按摩机器人,每个人骨架、体型不一样,很多人担心力道不一致、挤压身体。体验后他们通过力控、视觉、AI 把不确定性变成自适应。产品体验了,才体会到"用10年时间把不确定性变成可自适应"。操作能力提升后,再结合具身智能模型泛化,才能真正成为机器人赋能千行百业的目标。
教育机器人:硬件不是护城河
康正中:第二个问鲸鱼AI贾总。你们产品形态以硬件为主,3-22岁全年龄段全场景机器人都有,核心可能是教育编程机器人。现在大模型把知识问答变得非常便宜,如果教育机器人只是会回答问题,硬件反而变成拖累、昂贵外壳。你们的 Pubbo、教育机器人相比传统 AI 学习 APP,不可替代价值是什么?模型能力趋同时,护城河是硬件还是内容生态?
贾昕东:日常很多人问我们:区别于其他 AI 学习 APP,差异化优势是什么?未来硬件和内容哪个是护城河?
第一,鲸鱼机器人专注青少年教育。青少年用 AI 对话、AI 软件时,和成年人非常不同在于数据安全和内容敏感性。成年人用 APP 不会在意成人内容,暴力、色情、政治,不适合小孩提前掌握的知识没有过滤。鲸鱼AI机器人在2024年决定提高产品力时,专门自研 AI 平台。小孩子使用机器人、软件、内容生态时,所有提问问答经过平台筛选,对小孩学习不利的东西会被筛掉。这是非常大差异点。
第二,很多传统 AI 学习 APP 着重 K12 教育,底层价值观还是让孩子学习更好、考更高成绩、掌握在家长面前展示的技能。这和鲸鱼AI价值观完全不同。我们希望培养孩子拥有 AI 思维,不是让孩子继续卷考试、卷分数、卷成绩。在座很多朋友都很优秀,一定经历过考试和学历的痛苦之路。鲸鱼AI的理想是不要让下一代再经历这样的痛苦,希望通过硬件和软件帮助孩子找到适合并且属于自己的人生道路。不是每个人以后都要成为科学家、编程者,而是希望孩子找到属于自己的领域。
关于硬件和内容哪个是护城河。国家在硬件层面非常强大,全世界找不出任何一个国家有像珠三角、长三角这样深刻完整的供应链。美国、欧洲人力成本、工程师成本、硬件生产成本都远远比不上。硬件成本放眼海外是非常强大的护城河。但内容其实是更深刻的护城河。正因为硬件成本对比国内友商已经很低,如果未来竞争国际市场,只做硬件很难出圈。内容才是长远真正的护城河。
这些内容围绕教育内容。公司成立以来连续7年盈利,商业模式非常完备,挺过疫情、挺过双减。能盈利是因为内容非常硬核。过去有传统编程机器人内容,2024年着手开发新 AI 通识课,让孩子在 AI 时代有很好启蒙,通过自然语言、编程或其他方式和硬件互动。这是未来鲸鱼AI真正的护城河。
康正中:鲸鱼已经融资7轮,欢迎投资人交流。还有一个新业务,未来要在全中国开100家 AI 科技体验馆,做中国 AI 的迪士尼乐园,有兴趣的朋友欢迎交流。
贾昕东:是的,这也是我们努力的方向。
主动交互:手机做不到的事
康正中:第三个问孔总。现在多数智能体还是"你叫他他才能动",你们强调主动交互,需要持续感知或理解情境,但也会带来隐私问题、成本压力。主动智能必须依托专属硬件,还是手机加摄像头就可以?最终会卖陪伴产品,还是可复用的具身智能大脑和数据能力?
孔维刚:现在所有智能硬件,包括具身本体,大部分还是依靠指令或遥控器完成任务。我们通过对大量真实场景交互数据收集,构建数据集,实现主动交互能力泛化。
数据价值非常重要。手机量非常大,但在低端场景或测试场景可以走通。真正实现意图识别、主动感知和主动执行,一定需要新形态智能体硬件或机器人。手机设计基于通信和信息交付,摄像头、麦克风矩阵、熄屏等是为了这个需求。但主动感知核心——持续感知,熄屏了怎么持续?意图判断,手机无法固定到场景里长时间解决角度问题,获取源有问题。主动执行,输出指令包含动作、语言。手机能在小场景试用测试,但新形态智能体、机器人才是主动交互最主要载体,能从固定场景或特定需求持续感知外在变化,形成从感知到交付的闭环。
风火轮策略是以主动交互载体作为切入,形成真实数据采集,通过模型到泛化,形成整体闭环。未来基于主动交互技术,新形态智能体硬件会越来越多,也会帮助现有智能体硬件从结构和使用场景上实现升级。
康正中:手机不一定最适配,专属硬件更好实现?
孔维刚:对,载体设计出发点完全不同。也许主动交互技术下一代巨大升级后,手机设计原理也会出现变化,符合下一代交互和技术实现。
AI可穿戴:Context is all you need
康正中:段总到了,先介绍一下自己。
段然:不好意思,从深圳过来,上海比深圳还热。我是星穹方舟段然,做 AI 可穿戴,包括 AI 眼镜、吊坠、戒指等。在深圳和上下游工厂协同,产品线比较多。
康正中:你提到做 AI 可穿戴形态多,眼镜、吊坠,可能还在布局戒指。形态多意味着资源分散。除了赚钱,同时布局多种可穿戴,是在寻找最佳载体,通过不同形态试验?还是有大梦想,构建多网络 agent 设备,设备间有协同?另外,AI 可穿戴入口,最终由佩戴位置决定,还是由 agent 能力(长期上下文理解)决定?
段然:先从成本考虑。在深圳,芯片统一用恒玄、杰理、炬芯、全志那几款,今年统一供货。成本无论多矩阵还是单矩阵,BOM 一定,只是出货量多少。PCB 板主要在几个 sensor 上,麦克风传感器、NPU/VAD,sensor 供应链不变,因为我们定义的是 always on 的 context device。供应链没多大改变,不会增加源头 SKU,只是外观设计和 PCB 设计有变动。整体成本不像大家以为每开一个 SKU 增加80%或100%,而是可能只有20%成本在产品线管控上。做生意第一考虑成本管控和供应链复杂度。
是不是像媒体一样多矩阵传播?没有。只是不确定哪个品用户喜欢,每个品成本和利润风险可控情况下多开几个,能收回成本就行。这是第一个,比较接地气。
第二个,入口问题。AI 入口不是新鲜词,agent 入口讨论了两年、三年,可能还要再讨论一两年。毕竟现在没有原生 AI 硬件破百万台销售。原生 AI 硬件定义为非传统大 SKU(手机、手表、耳机),而是新 SKU,比如 AI Pin、Rabbit R1、Plaude 等。Plaude 也算很爆款,录音卡加 AI 功能。但什么时候出现像电脑一样,70%以上年轻人人手一台新的 AI OS 原生硬件?我认为可能未来三年。具体形态没法说,要知道就该上市敲钟了。只能说目前可穿戴设备潜力比较大,包括眼镜,或别在胸前的,豆、针、pin 等形态。下一代 AI 硬件最核心在于 context——context is all you need。谁能掌握用户全天候上下文数据,包括线下真实物理世界信息(和谁聊了什么、去了哪里),还有线上信息(工作传递了哪些代码、文档)。掌控一个人全部 context,在基模能力相同情况下,一定比其他服务提供商表现能力高出