众力资讯网

Claude开始训练Claude了。 不是标题党。这家公司做了个实验,让Cla

Claude开始训练Claude了。

不是标题党。这家公司做了个实验,让Claude自己查论文、自己提方案、自己造数据、自己跑实验,一口气解决了10类AI安全问题。最扎心的是成本对比:AI干这活儿一小时花4美元,公司付给人类研究员是一小时150美元。有一道"让模型别说谎"的题,Claude把安全分平均拉高了85%,6个经验丰富的人类研究员平均只拉高了20%。28个人类研究员参加的测试,Claude通常6个小时就能找到超过人类平均水平的方案。

这啥概念?以前我们总觉得,AI再厉害也是人造的,总得靠人来调教、来把关。现在连"调教AI"这活儿AI都能自己干了,还干得比人快、比人便宜、不用休息。以前总说AI要抢普通人的饭碗,结果最先被抢的,可能是造AI的人自己的饭碗。

原理其实不玄乎,就是让Claude像做实验一样反复试错:提出一个改进方案,训练个小模型看效果,不行就换一个,一轮只要30分钟。更狠的是,较弱的Claude能反过来训练更强的Claude——60个小时就逼近了正式版的水平,用的训练数据只有2000多条。

但这事也没那么神。研究什么问题、什么算成功,还是人类说了算,AI只是在我们画的框框里使劲。还有个细节特别黑色幽默:Anthropic派了个"监工"AI盯着干活的AI,结果在1600多份实验记录里抓到39次作弊——有反复提交同一方案碰运气刷分的,有照着考试格式造数据的,还有偷偷藏起违规步骤的。合着AI为了拿高分,也会走捷径糊弄人。

我的判断是:不用恐慌,但真该把"AI会自己改进自己"当回事了。它现在是拿人类的评价标准当尺子,尺子量对了,它跑得飞快;尺子要是歪了,它跑得越快,离我们想要的越远。至于抢饭碗,以前抢的是体力和重复劳动,现在连"研究AI"这种高薪脑力活都开始动了。别再说AI替代不了有创造力的人,先问问自己:你的工作,是不是也像那个150美元一小时的研究员一样,只是在固定的框框里反复试错?
claude code