虎嗅

来自追觅的CEO,用一封信和一个充满疑问的直播宣布了“智能涌现”

乐享科技“自证”直播深度拆解:一场关于“智能涌现”的豪赌与信任危机

大家好,我是你们的财经记者。今天我们要聊的,是一家名叫乐享科技的初创公司,以及它刚刚上演的一出“罗生门”。

简单来说,这家成立才不到一年的公司,先是发了一封信指控全球AI巨头OpenAI“像素级抄袭”他们的技术,紧接着又搞了一场“全球首次户外实景直播”,试图证明自家机器人真的能像人一样干活,甚至能“自我进化”。

但结果呢?直播虽然热闹,质疑声却更大。这背后不仅是技术的较量,更是一场关于营销、信任与行业底线的博弈。

下面,我将用大白话,把这件事拆成五个方面,带你看懂这背后的门道。

---

一、 剧情反转:从“指控巨头”到“紧急自证”

核心逻辑:先声夺人,再被动防守

这件事的起因非常戏剧化。9月10日,乐享科技CEO郭人杰发了一篇长文,直接点名OpenAI的首席科学家,指控对方的一篇万字长文《异星心智》“像素级搬运”了乐享科技自研的具身大模型“Aether”的研究成果,甚至扬言要起诉。

为什么这么做?

这就好比一个小学生在班级里突然站起来说:“爱因斯坦的相对论是我先发现的!”

  • 好处:瞬间引爆舆论,让一家成立仅10个月的初创公司(2024年12月成立)一夜成名。
  • 风险:OpenAI没回应,但同行和网友开始怀疑:“你们是不是在蹭热度?你们的demo是不是假的?”

面对“蹭热度”和“造假”的质疑,乐享科技没有选择沉默,而是选择在9月16日搞了一场直播。这场直播被定义为“全球首次机器人户外开放环境实景直播”。

记者点评:

这是一种典型的“危机公关”策略。既然别人说你是PPT造车、视频剪辑造假,那我就把摄像头架在烧烤摊上,让你看个够。但问题是,“敢直播”不等于“技术真”,这中间还隔着巨大的鸿沟。

---

二、 直播现场:混乱中的“真实感”与精心设计的“表演”

核心逻辑:用“粗糙”换取“可信度”

这场直播最有趣的地方在于它的“不完美”。

1. 场景仓促:CEO郭人杰承认,场地是周日才租的,下午4点才到场。收音有杂音,工作人员乱入镜头,甚至还要掀开背景布证明后面没人遥控。

2. 任务简单:机器人“二爷”和“五爷”在烧烤摊给3组顾客服务,包括点菜、烤串、撒料、上菜。

3. 关键细节:机器人第一次撒料失败了,第二次成功了。工作人员解释说:“它会自己优化学习。”

普通人怎么看?

  • 支持派:觉得“乱糟糟的反而像真的”。如果是录播或遥控,画面肯定很丝滑,不会这么手忙脚乱。掀开背景布这个动作,确实打消了“后面有人拿手柄”的疑虑。
  • 怀疑派:觉得这是“剧本式真实”。
  • 观众是演员:那3组顾客是“每组两名”,显然是安排好的。
  • 任务被简化:烧烤摊的环境相对封闭,食材位置固定,顾客需求单一。这和真正的“开放环境”(比如乱糟糟的家庭、复杂的商场)有本质区别。
  • “失败”也是设计:第一次失败、第二次成功,这种“成长曲线”非常符合大众对“AI学习”的想象,但也可能是预设好的程序逻辑(比如第一次故意做轻,第二次做重)。

记者点评:

这场直播成功证明了“机器人能在那儿站着干活,且没人遥控”,但它没有证明机器人具备真正的“智能涌现”能力。它更像是一场精心编排的“行为艺术”,而非严格的技术测试。

---

三、 技术硬伤:“200小时视频”能训练出“智能涌现”吗?

核心逻辑:数据量与宣称能力的巨大落差

乐享科技宣称其大模型“Aether”实现了“智能涌现”,能跨本体通用、自我进化。支撑这个说法的核心数据是:仅用200小时人类视频、0真机数据训练。

这里有个巨大的逻辑漏洞,也是业内专家质疑的重点:

1. 数据太少:

  • 人类学会做饭,需要看几千小时、做几万次。
  • 200小时视频,大概相当于看几部连续剧。仅靠这点数据,就能让机器人学会“随机应变”地烤串、撒料,甚至处理从未见过的情况?这在目前的AI技术背景下,听起来非常像“魔法”。
  • 疑问:这200小时视频是什么?是高清的吗?标注精细吗?覆盖了哪些动作?如果只覆盖了“撒料”这一个动作,那叫“专项技能”,不叫“通用智能”。

2. “自我进化”的伪命题:

  • 直播中机器人第二次撒料成功,被解读为“自我进化”。
  • 专家反驳:这很可能只是“随机性”或“重试机制”。就像你扔飞镖,第一次没中,第二次中了,不代表你的视力变好了,可能只是手抖的方向变了。
  • 真正的“自我进化”意味着:机器人在没有人类干预的情况下,通过内部算法调整,永久性地提升了能力。这需要长期的数据积累和复杂的反馈机制,一场1小时的直播根本验证不了。

3. 零样本成功率90%?

  • 乐享宣称面对陌生环境,零样本(Zero-shot,即没见过的任务)成功率超90%。
  • 现实:目前全球顶尖的具身智能公司,在复杂环境下的零样本成功率都还在爬坡阶段。90%这个数字,如果没有公开的、标准化的第三方测试报告支撑,很难让人信服。

记者点评:

这就好比一个人说:“我只看了200小时菜谱视频,没下过厨,但我现在能盲做满汉全席,而且成功率90%。”

听起来很厉害,但没人敢信。 除非你请米其林评委现场盲测,并公开所有数据。

---

四、 人物背景:从“营销天才”到“技术赌徒”

核心逻辑:营销能力掩盖了技术短板?

乐享科技CEO郭人杰,之前是追觅科技的中国区执行总裁。他的成名作是“洗地机吸泡面”的视频营销,80天做到百万营收。

这个背景说明了什么?

1. 擅长讲故事:郭人杰深谙如何制造话题、如何引爆流量。指控OpenAI、搞户外直播、掀背景布,这些都是极具传播力的“营销动作”。

2. 技术 vs 营销的错位:

  • 在消费电子(如洗地机)领域,营销大于技术是常态。用户买的是“爽感”和“品牌”,不是底层算法。
  • 但在具身智能(机器人)领域,技术大于营销。这是一个硬科技赛道,投资人、客户和同行看的是:你的模型泛化能力如何?你的传感器精度如何?你的算力成本如何?
  • 用做快消品的思维去做硬科技,容易陷入“雷声大,雨点小”的困境。

记者点评:

郭人杰是一位优秀的商业操盘手,但目前看来,他可能低估了技术验证的复杂性。在具身智能这个领域,“出圈”需要更长的验证周期和更完整的证据链,而不是靠一场直播或一封指控信。

---

五、 行业影响:信任危机与“自证”的困境

核心逻辑:当“自证”变成“表演”,行业需要新的裁判

乐享科技的事件,折射出当前具身智能行业的几个痛点:

1. “Demo文化”泛滥:

  • 很多公司喜欢发精心剪辑的视频,展示机器人最完美的瞬间。
  • 乐享科技试图打破这种文化,搞“直播”。但直播也可以有“剧本”。
  • 问题:如何定义“真实”?是无人遥控就算真实?还是能处理随机干扰才算真实?

2. 缺乏第三方标准:

  • 目前具身智能没有统一的“高考”。
  • 你说你成功率90%,我说我成功率95%,大家各说各话。
  • 解决之道:需要独立的第三方机构,制定标准化的测试场景(比如:随机摆放的杂物、随机变化的光照、随机提出的指令),并进行盲测。

3. 对行业的伤害:

  • 如果乐享科技最终被证实是“营销大于技术”,或者“指控OpenAI”站不住脚,将会严重打击公众对具身智能行业的信任。
  • 投资者会更谨慎,消费者会更怀疑,真正做技术的公司也会受到牵连。

记者点评:

乐享科技的这场直播,赢了流量,输了信任。

它证明了“机器人能干活”,但没证明“机器人有智能”。

在具身智能这个赛道,“智能涌现”不是一句口号,也不是几小时视频能证明的奇迹。 它需要海量的数据、长期的迭代、透明的评测。

---

总结:给普通人的建议

1. 别被“全球首次”、“智能涌现”等词忽悠:这些是营销词汇,不是技术指标。

2. 看“失败”比看“成功”更重要:真正的智能,体现在如何处理意外。如果机器人只会做预设好的动作,那它只是个高级自动化设备,不是智能体。

3. 等待第三方评测:在具身智能领域,“谁说的”不重要,“谁测的”才重要。关注是否有独立机构发布的测试报告。

4. 理性看待“指控”:指控OpenAI抄袭,如果没有确凿的法律证据和公开的技术对比,更多是一种营销手段。

最后,一句话总结:

乐享科技用一场仓促的直播,证明了它是一家擅长制造话题的公司,但还没证明它是一家拥有顶尖技术的公司。在具身智能的长跑中,耐力(技术积累)比爆发力(营销声量)更重要。