我觉得美国大模型应该不行了,中国大模型才是正确路线。当然,都需要算力,但也需要低成本算力
最近仔细学习了大模型的基础知识、开发知识,应该是没有技术秘密了,圈里扩散了。美国Anthropic、OpenAI说得很神秘,中国公司直接开源,性能追上,美国头部大模型逼格马上就没有了,装不下去了。中国几家不断更新,谷歌的Gemini新模型出不来,“御三家”地位就不行了。
到Agent这波,应该是一个质变,就是成本一下爆炸了。所谓Agent智能体,就是AI自己规划to do list这些工作计划,大计划里面还有小计划,然后还看搜索与执行反馈不断改计划。这种工作规划“工作流”是没完没了的,可以一直自主执行下去,一堆大模型都能搞几个小时了,以后迟早都能搞一天。这么长时间闹腾,大模型又不在乎多耗token烧钱,开支就爆了,算力需求也爆了。
可以肯定的是,美国和中国都受不了高成本。美国钱多,但也经不起让机器么胡烧钱,所谓的Agent探索,绝大部分就是失败的瞎试,没什么生产力。美国公司也开始控制token开支了,美国个人用户、中国公司早就精打细算了。
因此,token开支下降是必须的。不是百万token单价下降,而是总开支要降。高价的,你得用少量token解决问题,可以;低价的,多花些token解决问题,也行。总之,成本已经变成大模型的最重要考虑了。因为性能明显很趋势,谁也拉不开谁,没有技术秘密了,美国出个新的厉害的大模型,别家琢磨以后,就能搞明白怎么做的。讲成本,那美国大模型就是大劣势了,不是技术路线问题,而是公司文化,就不可能和中国公司斗成本。
算力需求,Agent狠拉了一波。但潜在公司用户、个人用户还有很多。这是最容易判断的,肯定还是要的,算力投资不会停。问题是算力成本爆涨,存储芯片价格爆涨,原因是Agent这波拉太狠了,狂吃存储。这也到了吃不消的阶段,算力不能只讲投资不讲成本,也需要控制支出。
这种情况下,算力开支也是需要精打细算的,不能一味大手笔投资。中国应该是坚定走算力自主路线了,首先一条就是内部不亏钱,买自己生产的算力,肉烂在锅里,而不是交大钱给英伟达。中国算力基本闭环了,全产业链都有了,就是算力芯片产能受限。卡点是芯片设备,这方面是发展重点,不会松。
美国公司如果还是高价抢芯片,那等于高价买一些会过时的资产,折旧成本不低。天天在那跑,3-5年应该芯片就废了。这么下去迟早受不了,估计很快业界就会开始谈算力成本了。资本市场已经警惕了,花高价买算力,就是公司利空。买算力的公司就会去自己研发芯片。
先不说回本问题,中美大模型都看不到回本路线,收入远远不足以覆盖投资。也暂时不用谈回本,融资热情还很高。其实钱多得是,中国这边几万亿投大模型、算力、芯片根本不是事,居民存款170多万亿,股市融资、风投融资都没问题。但高成本和低成本算力是不同的,大钱是投了,但也不想乱投,成本太高投资人也会毛,会要求控制成本。
大模型和算力都要考虑成本了,这是中国擅长的。美国大模型应该是不行了,算力也有压力。中国渐入佳境,大模型和算力自主的好消息不断。当然股市是另一回事,考虑成本会给一些股价大涨的公司带来利空。芯片设备公司是确定利好。
