众力资讯网

过去半年,不少老板都被同一个问题问过,咱们要不要搞一个自己的大模型。 这个问题

过去半年,不少老板都被同一个问题问过,咱们要不要搞一个自己的大模型。

这个问题难答,难就难在「专有模型」四个字,现在被用成了一个筐,什么都往里装。拆开看,是四样东西。

自己训,从零练权重,入场券是一亿到十亿美元的学费,加一支几百人的队伍,全世界真干成的,一只手数得过来。

微调,一张卡几天功夫,就能改出一个「自家模型」,听着又便宜又体面,可拉到生产里,73% 的项目死在半路。

私有部署,模型还是人家的,只是搬进了自家机房,这是合规的账,不是聪明的账;上下文,你的数据、口径、规矩,还有老师傅没说出口的判断,这件买不来,只能自己养。

前三样是商品,买得到,会贬值,别人也有。第四样是资产,会复利,只属于你。

彭博够有资格了吧,四十年的金融数据,2023年真金白银训了个 500 亿参数的模型,三年后,自己人讲,没在任何产品里用过。现在它终端里跑的,是商业模型加开源模型的混合。

账这么难看,为什么还在买?因为出钱的是公司,拍板的是个人,买错了是公司的损失,不买,是个人担着落后的责任。

但模型会过时,专有不会,大企业建本体,中小企业借本体,现用的软件里,就躺着半个本体。

企业真正该干的,是边买边养,把每一单、每个例外、每个老师傅的判断,一点点存进自己的账本。

判断就一条,能下单的都会贬值,唯一会涨的那件,不在货架上。下次再有人聊起专有模型,别急着问价钱,先问一句,说的是哪一件。