万博manbext体育官网(中国)官方网站登录入口-现金万博manbext体育官网app平台在觅蜂派的数据众包平台上-万博manbext体育官网(中国)官方网站登录入口

现金万博manbext体育官网app平台在觅蜂派的数据众包平台上-万博manbext体育官网(中国)官方网站登录入口

发布日期:2026-10-11 07:27  点击次数:86

现金万博manbext体育官网app平台在觅蜂派的数据众包平台上-万博manbext体育官网(中国)官方网站登录入口

定焦One(dingjiaoone)原创 作家 | 王汉星 剪辑 | 魏佳现金万博manbext体育官网app平台

2016年,自动驾驶公司Comma.ai推出了一款行车纪录诳骗Chffr。用户下载装配后,手机就变成一个行车纪录仪,把它架在挡风玻璃前,诳骗会自动录制驾驶过程中的数据,随后上传至公司的云表管事器,用于自动驾驶模子测验。

这是AI在物理世界较早的一次数据众包尝试。按照首创东说念主的设念念,只消实足多的车装上这款诳骗,公司就能攒下海量行车数据,在短时刻内测验出庞杂的自动驾驶模子,然后再搭载回每一台汽车上,实现营业化闭环。

十年往常,这家公司莫得成为自动驾驶的主角。行业接洽的焦点早已换成特斯拉FSD,着实真义上的自动驾驶也迟迟莫得到来。

如今,具身智能行业把这套派遣又搬了出来。国际有Figure AI的Index平台,国内则是智元旗下觅蜂科技的觅蜂派。

9月末,觅蜂科技雅致发布具身数据众包平台觅蜂派,包括自研的MEgo数采斥地、觅蜂派App和数据管理引擎MEgo Engine三个组成部分,并自称为“大家首个全品类高质地物理AI数据众包管事平台”。

众包这一见地在外卖平台上最为常见,它主要通过一种低门槛、快速变现的形状在短时刻内承接大批的东说念主力,在觅蜂派的数据众包平台上,用户不错接取机器东说念主测验所需的数据任务,采集数据换钱,觅蜂在收到这些数据之后,会进行管理、分级等操作,再打包用于机器东说念主测验。

问题在于,众包贬责的仅仅“量”。具身智能是一个远比自动驾驶复杂的物理世界AI诳骗场景。它不仅需要具备和自动驾驶相似的Local Motion才智,还需要进行致密的桌面操作,领会更复杂的物理定律。自动驾驶的数据众包作念了十年皆没跑通,换到更难的具身智能,真实能作念好吗?

01.一小时赚20块,具身数据参加众包时间

物流中心的快递小哥戴着头显斥地分拣一个小时的快递,宝妈戴着斥地作念一顿饭,旅游景区一位责任主说念主员纪录下我方日常打价与贴方向过程。这些数据上传审核后,不错按每小时10到20元结算酬报。

这就是觅蜂派的玩法。下载掀开这款App后,会先看到一个任务大厅,其中有22个场景大类,包含出产类、糊口管事类、餐饮类、物流类、医疗类、居住类等等。每一个场景对应几十致使上百种任务,标着可申领的剩余限额,以及每采集一小时数据的酬报,每每在10到20元不等。

如果念念要赚取这一份外快,需要先去申领一套数据采集斥地。具体过程是议论当地管事网点,审核通事后交纳一定的押金和房钱,然后通过现场自提或快递的形状取得斥地,下载觅蜂派App并绑定斥地后,就不错初始接取具体的任务。斥地的房钱为每天39元,实行期19元,任务酬报则由城市基础订价加动态补贴组成。如果按每小时10到20元算,实行期也要先作念满一到两个小时有用数据才能挣回本日房钱,恢规复价后则要两到四个小时。

当今觅蜂派派发的数采斥地是一个孤立的头显,接收EGO的数采阶梯进行数据采集。用户每天采集完毕数据并上传后,恭候平台审核通过,就不错取得相应的酬报。

从当今App明白的情况来看,一些热点的任务场景,尤其是居家糊口场景的任务皆依然被认领完毕,莫得过剩限额,出产、物流分拣场景的剩余限额还比较多。多位体验过觅蜂派的用户告诉「定焦One」,许多热点任务的单价依然比上线之初下调了许多,比如一些居家糊口的日常场景,从20元降到了10元,然则限额依旧很抢手。

官方给出的数据是,觅蜂派内测一个月内,注册用户约2万东说念主,累计提交任务1.3万份。不外简单换算下来,东说念主均提交不及一份任务。注册之后还要租斥地、过审核,着实执续采集的东说念主,可能远比注册数字少。

具身智能缺数据,当今依然不是什么崭新事。行业里的共鸣是,具身智能模子要达到像谎言语模子中GPT-3.5那样的才智,约略需要一亿小时量级的数据。觅蜂科技董事长兼CEO姚卯青曾提到过,当今大家有用的具身智能数据仅约几十万小时,中间还有两到三个数目级的差距。

本年上半年,不少具身智能公司初始对外宣传领有百万小时量级的数据,但距离一亿小时依然有不少距离。一位具身智能数据公司首创东说念主告诉「定焦One」,如果只贪图清洗后的高质地数据,从百万小时到一亿小时的时刻跨度,至少是三年到五年。

这亦然觅蜂科技发动如斯大鸿沟数据众包的根柢原因。如果只依靠行业内的实质公司、数据公司、模子公司来出产数据,那么具身智能的泛化将驴年马月。

觅蜂科技缔造于2026年2月,由智元控股。从2025年4月起,智元先后拆分出多家子公司,包括作念营业清洁机器东说念主的智鼎机器东说念主、作念机器东说念主租借平台的擎天租、作念智谋手的临界点、作念四足机器东说念主的智元酷拓,觅蜂则是其中负责具身数据的一家。但这些子公司均由智元控股,外界很出丑清各自的孤立造血才智。

觅蜂主要向大模子、机器东说念主、科研机构等数据需求方提供数据管事,同期向数据采集商、场景方与硬件商提供订单与器具。此外,它还宗旨引入其他第三方数据公司入驻,搭一套自营加第三方的数据管事平台。

现阶段,觅蜂科技提供的数据管事主要分为三类,真机遥操、仿真和无实质数据,其中无实质又包含UMI(手执夹爪采集)和EGO(第一东说念主称视角)两条阶梯。众包平台觅蜂派所使用的数采斥田主淌若MEgo View,它属于EGO类斥地,完好形态由3个鱼眼相机和1组双目相机组成的头戴斥地,加上一双腕部相机,但当今在觅蜂派上出租的斥地只包含头显。

另外,觅蜂科技也有UMI阶梯的夹爪斥地MEgo Gripper。比拟只用一个头显纪录第一视角视觉数据的EGO,MEgo Gripper的操作门槛更高,并不适用于大鸿沟的数据众包。

模式自己并不复杂,着实决定这门生意能走多远的,是它地方赛说念的容量,以及赛说念里其他玩家的竞争。

02.三种数据阶梯与三类玩家

谎言语模子建造在互联网大批文本数据的基础上,比拟较而言,具身智能行业所需要的物理世界数据,比如视觉、触觉、力觉、要津角度、空间通顺轨迹等,短长常匮乏的。

机器东说念主念念要着实结束价值,无非需要解释我方能作念两件事,参加家庭场景作念家务,或者进厂干活,这皆需要机器东说念主具备泛化才智,而泛化才智依赖大批的物理世界数据来实现。

需求撑起了一个正在延迟的市集。左证亿欧智库测算,2024年大家具身智能数据采集市集的鸿沟梗概是7.37亿好意思元,到2031年,这一鸿沟预测将达到70亿好意思元,复合增长率38%。

动作对比,宇树科技的招股书明白,预测到2030年东说念主形机器东说念主市集鸿沟会达到150亿好意思元,扫数数据采集市集的体量,差未几是机器东说念主实质市集的一半。

供给端的竞赛火热。限制本年4月,天下贪图或建成的具身智能数据采集测验场依然跨越64座。智元在上海浦东建造4000平方米的专属数采工场,京东晓谕将建成堪称大家鸿沟最大、场景最全的具身智能数据采蚁合心,并宗旨两年内积聚1000万小时真实场景视频数据,帕西尼感知科技在天津落地1.2万平方米超等数据工场,预测年产出近2亿条数据等等。

当今行业内贬责数据不及问题的形状主要有三种。真机遥操作阶梯的数据质地最高,但产出量最有限。无实质数据采集由东说念主来捎带斥地进行数采,比如UMI、EGO等,产出量更多,但数据需要通过清洗、标注、管理等多个次序才可用。终末是仿真数据和互联网视频数据,量最大,但质地最差,不错用来援手测验,有用的数据量很少。

大多数数据采集厂商不会押注单一的数据阶梯。从行业竞争的角度来看,当今的数据厂商不错大致分为三类。

第一类是机器东说念主实质公司自有的数据和模子业务,代表是宇树、星海图、星河通用等。它们的上风在于闭环,实质公司不错通过出租或出售机器东说念主实质再回购真机数据,同期我方也不错执续产出真机数据,况且由自家真机产生的数据不存在构型上的相反,更容易适配自家产物。

第二类是专科数据管事商,包括光轮智能、帕西尼、灵初智能、它石智航、手亿科技和觅蜂科技等。这类公司的数据不错卖给险峻游不同的公司,身份更通达,变现渠说念也更丰富,不错是实质厂商的供应商,也不错平直管事模子和科研机构。需要得当的是,当今纯正的数据采集管事商依然越来越少,因为作念数采的公司最终皆但愿往模子层靠,单纯卖数据的议价空间有限。

第三类是互联网大厂的数采平台,当今比较有代表性的是京东。大厂的上风是有场景和充足的东说念主力,仓储、门店、配送汇注自己就是自然的数据采集场,但问题在于只作念数据采集这一层的价值比较低,更多承担的是合作自身机器东说念主生态的配套变装。

三类玩家各有筹码,方法远不决型。觅蜂科技在其中的派遣显得另类,它把数据出产澈底通达给社会众包,这也让它的处境值得单独谛视。

03.一亿小时数据仅仅起头

觅蜂科技在这个行业里的站位比较罕见。自然定位是孤立的数采平台,然则与智元的议论紧密,董事长姚卯青同期亦然智元合资东说念主、具身业务部总裁。

这层关系给觅蜂带来了订单、场景和背书,也带来一个绕不开的疑问。智元既是控股推动又是潜在大客户,其他实质厂商是否闲隙把数据需求交给一家智元系公司,将平直决定觅蜂第三方定位的成色。

在数据众包层面,当今跑出后果的案例是国际具身智能公司Figure AI。它在本年8月推出了Index款式,并在iOS和安卓平台同步上线,大家用户皆不错通过Index上传真实的任务数据。

Index上线后依然隐敝了大家108个国度和地区,累计取得跨越26.4万次诳骗下载,跨越4.4万名周活跃用户参与数据孝敬,上传视频跨越1600万条。

本年9月,Figure AI发布了具身模子Helix 2.5,模子是在Index上完成的预测验。在测试中,莫得经过Index预测验的对照模子只收效了约9%,Helix 2.5的收遵循则达到56%,一定程度上解释了数据众包的价值。

觅蜂科技是国内具身行业内数据执有量居前的玩家。左证其官方说法,限制8月31日,觅蜂采集的无实质有用数据累计达百万小时,为国内首个达到这一鸿沟的无实质数据集,8月底,第20000套MEgo斥地也依然下线。通达数据众包后,数据累积量将会进一步加速。

然则在着实造成数据鸿沟壁垒前,觅蜂科技还要算清几笔账。

第一笔是经济账。一位具身数采从业者告诉「定焦One」,据他了解,觅蜂科技不仅在作念数据众包,还在为一些出产场景披发数采斥地来采集数据。普通来说,一套头戴加腕部的EGO数采斥地,本钱就在2万元傍边,单头显的本钱会低少许,也有几千元。

扫数数采的完好产业链会波及OEM和ODM的数采斥地供应商、中介、数据分发处理商等多个次序。觅蜂科技通过大批免费披发斥地,会挤压这些次序其他公司的利润空间、抢走客户,这显著不是一个不错长期执续的形状。

价钱层面相似不乐不雅。当今行业内的行情是,高质地的无实质数据每小时不错卖到200到300元,而觅蜂科技数据众包作念的纯头显EGO数据,价钱差未几是每小时10到15元,跟觅蜂派内部的酬报水平基本执平,如果卖价约等于付给采集者的酬报,再加上斥地、审核和存储本钱,算下来是亏欠收数据。而国外依然初始有公司把上百万小时的纯头戴第一视角数据集平直开源、免费商用。因此,觅蜂科技通过数据众包采集上来的数据到底有若干价值,存疑。

第二笔是数据有用性的账。EGO的克己是不错模拟机器东说念主的传感器责任形状,依靠东说念主类来采集数据,但问题在于EGO有许多信息是捕捉不到的,比如触觉,或者一些责任场景比如打字这些不符合捎带腕部斥地的场景,纯头显很难精准捕捉班师部的完好动作,这些皆导致EGO数据的有用率不高。

当今单一头显的EGO数据有用率差未几在10%到20%,也就是说1小时的数据内部,可能只消10分钟傍边是有用的。在这个基础上还要磋议数据类似的问题,比如叠一稔的数据当今在行业内依然泛滥,再多采集几百小时基本上莫得太大真义。

第三笔账最容易被淡薄,就是数据的存储本钱。上述具身数采从业者告诉「定焦One」,当今行业内的数据和存储有着终点明确的对应关系,约略是每50小时数据需要1.4T傍边的存储空间,100小时需要至少3T。这个存储的本钱短长常高的,如果将来一家公司的数据量达到千万、致使亿级,那么存储本钱也会情随事迁。

觅蜂科技通过免费发斥地和数据众包的形状,也许不错在短时刻内积聚起很漂亮的数据。有从业者估算,按照当今的程度,觅蜂科技拿到一亿小时的数据约略只需要不到2年时刻。但数据的量上去了,有用性、经济性、存储本钱问题奈何贬责,可能才是更大的训导。

即等于数据众包这条路自己,行业内的质疑声也莫得停过。在Figure AI发布基于Index预测验的模子后,Sunday Robotics长入首创东说念主Tony Zhao平直指出,420次测试,收效237次,完好任务收遵循56%,也意味着机器东说念主接近一半的时刻会失败。也有从业者以为这组数据正值解释,Figure AI使用的师法学习系统不成泛化。

回看自动驾驶的数据众包历史,Comma.ai自后的走向是废弃纯数据生意,转型卖后装驾驶援手硬件,首创东说念主半途一度淡出公司运营,当年设念念的众包数据闭环,最终以车队每天回传数据的形状,动作硬件产物的副产物存在。十年前的自动驾驶数据众包于今莫得系数跑通,如今的具身智能数据竞赛才刚刚初始。

*题图来源于觅蜂科技官网现金万博manbext体育官网app平台。



相关资讯
热点资讯
  • 友情链接:

Powered by 万博manbext体育官网(中国)官方网站登录入口 @2013-2022 RSS地图 HTML地图