
A |

新智元报道
中国机器人的AstraTennis时刻,来了。 上周我去了两个很多人都陌生的地方,甚至不知道在哪里。齐齐哈尔的名气大一些,加格达奇就很少有人知道了。
东北有几个独有的少数民族,比如鄂伦春族、鄂温克族、达斡尔族、赫哲族以及起源于东北的满族,这几个民族除了满族之外都是人口很少的,特别是鄂伦春,目前不到一万人,居住在离加格达奇很近的鄂伦春自治旗。
这次旅程虽很短暂,但是深入到了大兴安岭地区,很冷,很值得。

B | 8月22日,第二届世界人形机器人运动会开幕,中央广播电视总台面向全球直播。 a、加格达奇是大兴安岭地区最大的城市,大兴安岭地区行政公署是一个类似地级市的行政单位,属于黑龙江省管理,但是其中加格达奇和另外一个松岭区在内蒙古境内,这两个地方是属于黑龙江的飞地。 作者供图 b、加格达奇这城市名一听肯定有来头,是鄂伦春语里“有樟子松的地方”的意思,紧挨着呼伦贝尔市的鄂伦春自治旗,基本上想体验鄂伦春人的民俗就是先到加格达奇,再开车到隔壁的鄂伦春旗。 c、喜欢历史的朋友肯定知道南北朝的北魏是拓跋鲜卑族开创,而鲜卑人的起源就在鄂伦春旗的嘎仙洞,这里是鲜卑人的祖庭,龙兴之地,曾经是北方中原的霸主上百年。 今天的鄂伦春族和历史上鲜卑人有非常紧密的连接,虽不能说就是今天的鲜卑人,但生活的区域、习俗、宗教信仰都是一样的,鄂伦春人很可能是鲜卑人的一个分支延续至今。 d、鹿是鄂伦春人的图腾,他们平时会戴鹿角帽子,我这次参加了一个和鄂伦春政府合作的商业综艺节目的录制,基本上全程都是鄂伦春元素的展示,他们的民歌、舞蹈、射箭和传统服饰等等,在森林河水旁,听他们唱着传统的民歌,对这个目前只有9000多人的民族有了点了解。 e、真人体验性的综艺节目我知道是如何制作的了,基本上先要在很多场景里拍摄素材。比如这次,找了很多商业界的代表来到鄂伦春,和当地文旅部门一起给当地文旅和农产品出点子,参加综艺的人已经在这里待了半个月,记录下所有的素材,后期制作至少两个月,一个季度播一季,下一季再换一个地方合作,比如云南、西藏某地文旅部门。 过程中有常驻嘉宾,这个要求是最高的,因为需要全程参与,比如这次要两周多,就时间配合这一点就很难做到,中间会有一些重要嘉宾来客串下,比如待个1~2天。

C | 当镜头扫过赛场,全场的呼吸仿佛都停滞了。 综艺如何赚钱? (1)靠合作的地方政府给钱,比如鄂伦春需要扩大影响力,增加文旅流量。他们需要媒体平台,需要创新的内容。球网两侧,一边是人类网球名将,另一边,是一台人形机器人。这一刻,标志着中国技术创新迎来足以载入史册的具身智能奇点。全球第一场真正意义上的人机网球对战,正式开打!

世界首次人机对战网球赛一上来,就是精彩的人机混合网球双打。

D | 令人意外的是,银河星仔的表现非常精彩:它步法矫健,根据需要迅速前后移动,打得十分流畅。虽然综艺已经不新鲜了,但是信息是有代际的,不是平的。
而且,星仔和人类搭档非常默契地形成了一前一后的站位,全力应战对面的对手。
(2)这次综艺节目的制作方会通过芒果和湖南卫视播出。
接下来,由网球名将郑洁和银河通用机器人,开展了全世界第一次人机对战的网球单打比赛。实际上综艺制作方是工厂,生产的节目是产品,卖给电视台和网络平台播出,通过平台方和自己的广告招商拿到收入的分成或者一次性打包卖给平台方。
无论是正拍还是反拍,机器人都和人类打得有来有回。
今天的综艺太多太多了,美食的、户外生存的、厨艺的、旅行的、亲子的、商业文旅的等等,基本上就是类似流水线的生产一样,和电视剧、电影一样被一批一批地制造出来。
f、深秋的大兴安岭从飞机要降落加格达奇机场开始,满眼的金黄色,飘着一层薄雪。

E | 从色彩来说,非常美,只是很冷,冷到我在户外坐着的时候需要贴好几个暖宝宝,特别是起风的时候,会深刻体会到这就是东北。格外佩服冬天在户外狩猎的鄂伦春人,他们千百年来生活在森林里度过漫长的冬季,鲜卑人能够征服中原,能征善战,生命力顽强一定是有原因的。
g、周五晚我登上绿皮火车从加格达奇到齐齐哈尔,穿越茫茫山林,400多公里用了6个半小时。今天我看到短视频说加格达奇火车站之后就要拆除重新盖,在这个森林小城的车站里候车居然成为了历史的绝唱。然后,郑洁决定上点难度,打出一个月亮球。
结果,在被对手左右调动的过程中,机器人不小心摔了个四脚到底。出乎意料的是,下一秒,它居然立刻调整姿势站了起来。

F |
而面对郑洁的切削和旋转,机器人的判断居然也很不错。
终于,郑洁知道不能放水了,开始左右前后分点调动,机器人出人意料地完成一个精彩的跨步,赢得现场喝彩。
h、这个小城和中国大多数县城差异不大,商业业态都有,除了一些不会辐射到这里的连锁品牌之外,餐厅里是东北风格,菜量大一定的,餐厅阿姨让我就点一个菜,这当然不行,还是要多尝两样。
比赛结束,机器人的表现让所有人欢呼。

G | 作者供图 足疗店里的老板非常的悠闲,有客人就不急不慢地伺候着,没客人就看短视频看剧。

H | 整场比赛里,屈膝、抛球、转体这些动作全都由人形机器人自己完成。而且,发球时速达到一百多公里,留给它的反应时间只有零点几秒,它却几乎没有掉链子。这台机器人,正是来自银河通用。十年前,AlphaGo赢了李世石。十年后国产机器人与网坛顶尖运动员同台竞技。如果说AlphaGo证明AI能征服数字世界,那么今天,银河通用的国产机器人证明:AI能扛住物理世界的极限压力测试。它第一次从代码里站了起来,在真实的对抗中奔跑、挥拍、博弈,甚至摔倒后自己爬起,继续战斗。如此精彩的具身智能AstraTennis时刻,被全球同时见证!

中国机器人的AstraTennis时刻为什么这场网球赛,能引起全球科技圈的巨大地震?因为网球,是对具身智能极致的压力测试。由于反应时间只有零点几秒,这项运动,同时将机器人的感知、决策、全身运动控制和实时博弈能力逼到了物理极限。而且,打网球比下围棋对AI来说难得多。 最大的区别就是他们呼吸的空气中负氧离子爆表,每天都被洗肺,想必这里患呼吸道疾病的人应该很少。

I | 毕竟,AlphaGo面对的是19路网格上361个确定的交叉点,对手落子后,它有几十秒甚至几分钟来推演下一步。那是数字世界的博弈,解空间虽大,但边界清晰,规则恒定。整个世界是静态的、离散的,AI对此一览无余。 i、这里有火车到漠河、齐齐哈尔、哈尔滨,绿皮火车居多,还没有高铁,估计也不会建高铁。

J | 虽然这道题的解空间比宇宙原子数还多,但对AI而言这也不过是道难度更大的「数学题」。 作者供图 这里有一个机场,航班不多,直飞的航线只有哈尔滨、大连和海拉尔,到北京和上海是经停的航线,虽然航线少,航班少,但至少和大城市连接起来了。

K | j、六个半小时的绿皮火车从加格达奇到齐齐哈尔,开车只要四个多小时。齐齐哈尔是达斡尔语“天然的牧场”的意思,所以这里一定有达斡尔族,这里能出一个飞鹤品牌也是必然的。
但网球场不一样。
达斡尔族人也不多,但还有十几万人,在齐齐哈尔就有达斡尔族区。球以每小时一百多公里的速度过来,落点受旋转、风、场地摩擦影响,每一拍的物理参数都不重复。
k、齐齐哈尔是黑龙江第二大城市,我感觉像一个大号的县城,可能北方的城市都差不多吧。曾经的重工业基地,曾经的黑龙江省会,出过很多名人,梁龙、毛不易和最近被禁言的张雪峰,还有上太空的航天员等等,是个人杰地灵和历史悠久的城市。机器人必须在几百毫秒内完成感知、预测、决策、全身协调,同时保持自己不摔倒。
每个城市应该都有齐齐哈尔烤肉吧,但估计大多数人不知道齐齐哈尔在哪。
两三年前我做过一次大兴安岭的自驾计划,当时就有加格达奇和齐齐哈尔,但没能成行,明年夏天肯定会出发。对手是打活人,会骗机器人,还会变节奏。
这里的元素很多,民族、历史、自然的元素都有了,而且路况好,没有压力。这,就是莫拉维克悖论的现场版。
人进入大自然心情就会爽,无论是森林、湖泊、草原还是沙漠,或者是海边。1988年,卡内基—梅隆大学移动机器人实验室主任汉斯·莫拉维克就指出过:「让计算机在智力测验或下跳棋时表现出成人水平的表现相对容易,但要赋予它们一岁儿童在感知和行动方面的技能则困难甚至不可能。
大兴安岭好像很远似的。」
三十多年过去,前半句早已兑现,但后半句却很难实现。其实不远,飞几个小时就到,落地就开车出发。所以,这次网球赛真正的意义,要远远大于「机器人会不会打球」。大部分人总是想要准备的十分充分才会动身,往往就预设了太多前置条件,比如时间、同伴、攻略计划和心情等等,其实没有什么绝对的准备好,出发是最重要的。它问的是:这一次,AI究竟能不能从数字世界走出来,把感知、决策、运动控制和实时博弈在真实物理环境里闭环跑通?AI不能止步于思考,而是要完成从认知决策到全身执行的完整闭环。
本文来自微信公众号:泰格说实话,作者:嘟嘟2013。这一次,中国企业率先交卷了!赛场上,银河通用机器人的表现,实在令人惊艳。发球、正手、反手、底线调动、网前截击这些单项能力,在比赛里全部出现了,而且全都是超常发挥。而双打,考验就更大了。机器人和人类队友同场,要实时判断谁去接这个球、谁补位,动态调整打法和。

L | 所以,它要理解的不只是球,还有队友下一步想干什么。高速攻防里,还出现了极限救球的场面。摔倒之后,机器人自己站起来,继续打。很多人第一反应是:这些单项动作,之前机器人不是做到了吗?投篮、踢球、跑百米,过去两年人形机器人的视频里似乎什么都有。但其中最大的差别在于,网球是两个玩家在对抗。

M | 跑步的环境是确定的,网球的每一拍都是对手临时出的新题。跑步可以一个动作练一万遍,网球没有两个完全一样的来球。能在对抗中站住,才是真正的智能。

N |

大脑和小脑,第一次装在同一个模型里背后支撑这一切的,是银河通用自研的具身智能大模型「银河星脑」AstraBrain。它最大的亮点之一,就在于架构选择。过去行业里的主流做法是分层:一个「大脑」模型负责理解任务、做高层决策,一个「小脑」模块负责实时运动控制,两者之间用接口传递指令。这种架构的弊端也很直接:大脑想得再清楚,传到小脑已经慢了半拍;小脑动作再标准,不知道大脑为什么要它这么动。更隐蔽的问题是信息断层。大脑下指令的时候,不知道此刻自己的重心压在哪条腿上、右臂还有多少发力余量;小脑执行动作的时候,不知道这一拍是想调动对手还是想直接得分。

o | 两边各自最优,合起来却是一个「想得到做不到」或者「做得到想不到」的系统。

p | 在打网球这种任务上,稍微慢半拍,结果就是输球。银河星脑的做法是把大脑层(任务理解与战术决策)、小脑层(高动态全身运动控制)和神经控制集成在同一个模型里。按银河通用的说法,这是全球首个模型能同时负责「想清楚」和「做出来」,中间不再有信息损耗。

q | 从网球这个任务倒推,这可能是唯一的解法。战术决策离不开对自己身体极限的实时感知,运动控制也离不开对战术意图的理解,两者本来就不该分家。

从不完美的人类数据里学
在虚拟球场里对打一千万次架构之外的另一个问题是:这个模型怎么练出来的?机器人领域的一个传统难题就是——没有数据。

r | 语言模型可以吃掉整个互联网的文本,机器人没有这样的互联网。真机采一小时动作数据要一小时,还要人盯着,还会摔坏硬件。
这也是为什么过去几年具身智能的进展总是慢于大家的预期。这背后,离不开银河通用核心技术平台「银河星坊」 的支撑。接下来,分两个步骤。第一步,是从「不完美人类数据」里学。人类打网球的动作数据可以采,动作捕捉、视频、穿戴传感器都行。但人类的动作本身不标准,业余选手的确很业余,有多余动作。

s | 而职业选手的动作最大化个人运动素质,别人做不来,而且每个人的身高臂展关节角度都跟机器人对不上。传统模仿学习要求示范数据干净、对齐、高质量,这种要求在人类数据上几乎不可能满足。银河星坊数据平台要做的,就是从这堆带噪声、不对齐、良莠不齐的示范里提炼出有用的先验:什么时候该启动,挥拍的大致节奏,身体重心怎么转移,真正学会其中的运动规律。这一步的价值在于冷启动。机器人不用从随机乱动开始摸索,它一上来就大概知道「打网球长什么样」。第二部,就是进虚拟网球世界。在仿真环境里,多个智能体互相对打。不是一个机器人对着发球机练,而是若干个策略各自演化、互为对手。一方学会了压边线,另一方就被迫学会横向大范围移动;一方学会了放小球,另一方就被迫学会快速上网。

t | 在这海量的虚拟博弈中,奇迹发生了——「技能涌现」。工程师没有教过它怎么滑步救球,但在无数次没接到球的失败后,模型自己「领悟」了极限伸展的姿态。工程师没有写下倒地后起身的硬代码,但在虚拟世界摔了千万次后,模型自己「学会」了如何调动全身电机重新站立。

u | 技能无需手工设计出,在对抗压力下AI学会自学。

v | 最后,当这些在虚拟世界中练就神功的「灵魂」,被无损迁移到物理世界的真实机器人躯体中时,一个网球大师,就此诞生!放在整个机器学习的谱系里,这条路走在两个极端中间。纯模仿学习的天花板是示范者的水平,人类教练教不出超过自己的学生,而且人类示范里根本没有「摔倒后怎么爬起来继续打」这种数据。纯强化学习从零开始探索,在网球这种动作空间巨大、奖励稀疏的任务上,搜索成本高到不现实,而且容易学出一些人类完全看不懂的怪异动作,能赢球,但不像打球。先用人类先验打底,再用自主进化拔高。这本身不算新,AlphaGo当年也是先学人类棋谱,再自我对弈。

w | 新的地方在于,十年前这套方法在棋盘上跑通,十年后它第一次在需要身体的任务上跑通。

x | 某种意义上,这正是AstraTennis与AlphaGo之间最迷人的技术呼应。AlphaGo的时代,智能在棋盘上思考;而这一次,智能开始进入物理世界。这绝不仅是一场网球赛。这个AstraTennis时刻证明:在碳基与硅基共生的新纪元里,中国力量,开始创造更多奇迹。

y |
Current article:http://pvi02w2.cheshenzhuaduanza.buzz/list_na9/iyya9.html
Published on:00:00:00