众力资讯网

9B 小模型干翻大模型?紫东太初开源这步棋太狠 你家那台扫地机器人总是卡在沙发

9B 小模型干翻大模型?紫东太初开源这步棋太狠

你家那台扫地机器人总是卡在沙发腿下面绕不出来吗?明天开始,它的 "大脑" 可能就要换了。
9 月 17 日,中科院自动化所紫东太初团队往开源社区扔出一颗炸弹:ZDTaichu5.0-9B。听名字你可能觉得平平无奇,不就是个 9B 参数的多模态模型吗?但它的真正分量,藏在 "物理世界空间具身任务" 这几个字里 —— 这是给机器人用的脑子。
9B 凭什么打 100B?小参数里的空间直觉
先给不熟悉参数的读者补个课:大模型圈里,参数就像人的脑容量,9B 大约是 90 亿个 "脑细胞"。这个数字在今天动辄千亿参数的时代,简直是 "小身板"。但紫东太初偏偏用这副小身板,在九大国际权威空间基准测试里拿了 8 个同参数组全球第一。
这就好比一个中学生,在数学竞赛里把一帮博士生全比下去了。为什么?因为它不是在背课文,而是在练 "空间想象力"—— 把一个房间的俯视平面图、一段机械臂的运动轨迹、一堆零件的装配关系,在脑子里像搭积木一样推演出来。这种能力,恰恰是过去大模型最薄弱的环节。
机器人不缺嘴,缺的是 "方向感"
现在的 AI 其实很能说。你问它 "帮我把桌上的杯子拿给我",它能给你写一篇关于杯子的小作文。但真要装到机器人身上,它连杯子在哪个方位都判断不清。这就是为什么人形机器人走了这么多年,还是只能在实验室里走直线。
ZDTaichu5.0-9B 要解决的就是这个问题。它不是来跟 ChatGPT 比谁会聊天的,它是来当机器人的 "视觉皮层 + 小脑" 的。在复杂空间推演任务 MindCube-tiny 上,它拿到了 78.2 分 —— 这个分数在小参数通用组里是断层领先。
开源意味着什么?小厂也能用得起
更关键的是 "开源" 两个字。过去这种专门针对具身智能的模型,要么锁在大厂手里按调用收费,要么只有论文没有权重。现在中科院直接把模型权重放进了智源社区,任何一个做机器人的小团队、高校实验室,甚至一个车库创业者,都能免费下载、二次训练、部署到自己的机械臂上。
这对行业的意义,堪比当年 Android 把智能手机的门槛拉到几百块钱。以前你想做一个能在仓库里搬运货物的机器人,得先养一个几十人的大模型团队;现在你只需要把这个开源模型接到自己的硬件上,调一调,就能用。
我的判断:具身智能的 "iPhone 时刻" 可能真的要来了
很多人担心小模型干不过大模型,但我想说一句可能得罪人的话:在物理世界这件事上,参数规模从来不是核心瓶颈,空间推理的准确度才是。一个能精准判断 "杯子在桌子左边还是右边" 的 9B 模型,比一个能写一万字科幻小说的千亿模型,对机器人公司值钱一百倍。
紫东太初这步棋,本质上是在告诉整个行业:别再堆参数了,把模型做小、做准、做给机器人用,才是真正能落地的方向。
开放问题: 如果一个 9B 的开源模型就能让机器人拥有空间直觉,那未来机器人公司之间拼的到底是模型能力,还是硬件制造和场景落地?你觉得机器人的 "iPhone 时刻" 会在 2027 年来吗?