作者|华卫 “过去是人定义机器人,接下来则是 AI 定义机器人。
”在星海图办的第一届全球开发者大会上,CEO 高继扬与 CTO 赵行首次完整披露了公司具身智能技术路线,提出具身智能正经历“本能智能—作业智能—进化智能”的三重跃迁。
高继扬认为,今天机器人的身体仍由人类工程师设计,而未来 AI 将围绕应用场景与任务,去定义和设计机器人自己的身体。
本能智能直接作用于本体,让机器人像人一样天然学会驾驭身体,保持平衡、行走、奔跑;作业智能建立在本能智能之上,解决像人一样有序作业和操作的问题,语言是它的重要接口,星海图的 G 系列模型正是作业智能模型;进化智能则指向更深的问题:AI 能不能定义最优生产力形态。
会上,星海图发布新一代 VLA 基础模型 G0.5 并宣布开源,公布世界模型 Fast-WAM 与全身控制基础模型,自研双足人形机器人 Kengo(行客)现场首秀。
它身高 1.4 米,以高性能运动小脑与具身大脑为核心,既能完成四连踢等高难度全身动作,也能胜任递物、搬箱、叠衣等贴近真实场景的双臂作业。
不同于大部分具身智能大脑企业从智能开始,星海图第一天就从整机做起,开辟了轮式双臂品类。
做整机后发现制约性能的关键在于动力模组,于是自研动力模组,到今天 80%的动力单元是自研或与产业链共研的。
再后来发现光做整机不够,又决定在 2025 年春节前后启动双足人形项目。
同时,星海图联合北京亦庄共建的数据公司“亦数智能”正式揭牌,启动“100 万小时超高质量真实数据计划”规划今年完成百万小时、未来三年迈向千万小时。
星海图是行业内最早押注真实数据的公司。
2025 年 8 月开源的数据集 GOD 是全球第一个开放场景具身操作数据集,下载量接近 60 万次。
“在百万小时到千万小时之间的数据量训练出来的具身基础模型,会带来非常突破性的改变。
”高继扬算了一笔账:一个人从 0 到 18 岁,醒着和物理世界交互的总时长约 12 万小时。
也就是说,人的大脑用了 12 万小时学会了怎么驾驭自己的身体。
100 万小时相当于约 8.3 个人的学习总时长,1000 万小时相当于约 83 个人。
而 GPT 等大语言模型的训练 Token 数,转换到具身基础模型训练上,大概就落在百万小时到千万小时之间。
之后他做出一个明确判断:依托数据供应链与整机供应链的叠加优势,未来两到三年,中国的具身基础模型能力有望整体超过美国,拿到世界第一的位置。
整机、模型、数据之外,星海图打出的第四张牌是生态。
数据生态由亦数智能承载,星海图还联合凯辉基金发布创业孵化项目“星途计划”,面向具身智能早期创业团队提供资本、技术与场景支持,未来 3-5 年计划投资 30-50 家企业。
“没有任何一家公司能够独自定义具身智能。
" 而星海图所做的一切,都围绕同一个核心:具身智能基础模型。
在他们看来,硬件与数据都服务于模型,而模型最终要回答的,是机器人如何在真实世界里创造生产力。
“具身智能的‘GPT 时刻’可能不会像大语言模型那样明显,它的落地过程是随着能力边界逐个场景解锁的。
若干年之后回头一看,原来机器人已经无处不在了,但我们已经记不得是哪一年开始。
”高继扬在演讲中表示。
🔗 原始来源
如果你要核对细节,可以再看原文: InfoQ AI原文链接
AI热榜