Token导航 LogoToken导航

觅蜂科技姚卯青:数据需求达千万小时级

更新时间 2026-09-23来源 澎湃新闻正文 1535字阅读约 5分钟1 张图片

“预计今年年底产能达到千万小时级别,在2027年将提升一个数量级。”

9月23日,具身智能数据采集平台觅蜂科技董事长兼CEO姚卯青在接受澎湃新闻等媒体采访时,透露了觅蜂科技未来的产能目标。

当天,觅蜂科技发布全球首个全品类物理AI数据众包服务平台“觅蜂派”,用户下载该应用后可以领取数据采集任务,并佩戴MEgo设备在零售、仓储、制造、家庭等真实场景中完成指定操作,按照审核后的有效数据时长获得报酬,这也意味着真正的具身智能数据采集将走进千家万户。

数据采集是具身智能产业发展的核心门槛之一,将极大程度影响机器人在具体任务上的未来表现,据悉,在为期1个月的内测期间,觅蜂派注册用户数达2万人,采集提交总量为1.3万份。

图片

觅蜂科技董事长兼CEO姚卯青 沈玥彤 摄

谈安全问题:后台人工不会看到采集画面

姚卯青表示,今年上半年以来已有近百家团队入局具身数据采集,多以技术背景创业,早期靠相机原型设备快速切入。但他认为,真正比拼的是规模化运营人和场景的能力,以及资金厚度。

“我们今年应对1000万小时数据,固定资产级投入是大几个亿。”姚卯青说,“这不适合几个人出来融个几百万、一千万就想把这事规模干起来。”

他给出的行业淘汰标准相当具体:头部客户当前交付节奏为一周5万至10万小时,“很多小团队你给他1000小时订单,他一个月都交不出来。”在他看来,未来行业将出现分工:有公司做硬件、有公司做运营、有公司做后处理,端到端全包的模式难以持续。

据介绍,一套数据采集设备每天工作4小时、一年250天,年产约1000小时。据此,1000万小时约需1万套设备满负荷运转,1亿小时约需10万套设备。

目前觅蜂设备保有量为2万台,月产能达几万套。姚卯青透露,今年底公司计划产出近千万小时数据,明年将再上一个数量级。

数据质量方面,据了解,觅蜂派结算环节以自动化质检为主,一天内完成反馈并结算;结算后经过标注、轨迹提取和人工抽检,超过95%的数据最终可用于模型训练。虽然行业标准尚未完全收敛,但已形成三点共识:必须真实场景、2D素材需反解出毫米级空间精度、动作层面需自动化语义标签。

谈到外界关注的数据隐私安全问题,发布会上介绍,觅蜂派设置多重信息安全机制:众包人员注册APP时需要签署个人信息授权协议;领取设备后,端上采集瞬间即做脱敏处理;数据上云后再由云端自动脱敏和自动预防机制二次过滤。姚卯青对此回应称,脱敏由自动化系统完成,后台人工不会看到采集画面。

具身智能不是在走自动驾驶的老路

谈到具体的商业模式,姚卯青介绍,目前觅蜂派客户包括:本体具身公司、做预训练的世界模型公司、需要进入物理世界做闭环决策的大模型厂商。他透露,去年上半年行业数据需求还在几万小时级别,年底到20万小时,今年已有多家客户提出千万小时级预算。

一个值得注意的趋势是,他观察到头部客户已从年初同时找几十家供应商试训转向独家定点,原因是多源数据混在一起清洗、训模型,质量不可控。

谈到觅蜂科技与母公司智元机器人的关系,姚卯青表示,智元是客户之一,所有数据需求均走正常采购单,“先看存量数据能不能覆盖,不能覆盖再派单”,流程与其他客户无区别。

值得注意的是,对于头部数据厂商而言,达到亿小时规模后,比设备和人力更难突破的是场景准入。

澎湃新闻记者了解到,目前觅蜂科技客户需求已从L1级泛类场景细化到L3级具体产线。场景数据联盟对工厂、社区、商店、快递分拣中心等开放,未来平台将开放众包者自主申报场景,平台审核后对接客户需求。

值得注意的是,姚卯青在接受采访时还回应有关自动驾驶的问题,“具身智能不是在走自动驾驶的老路。”姚卯青表示,“自动驾驶产品形态单一,且不敢将主功能交给大模型,相比之下,具身智能应用场景多样,在室内低速环境下更适合大模型部署和试错。”

文章标签AI资讯
资讯来源:由AI资讯编辑整理自互联网公开内容,版权归原作者所有,未经许可,不得转载。

继续浏览更多资讯

返回资讯目录

相关资讯

更多