好久没谈最近的模型测试和自己用下来的体感,确实6astra已经是完全达到我心目中AGI水平的模型(其实5.6模型如果你会科学使用其实很多computer use功能基本能实现,基本从fable5那个时间就已经实现所有电脑上进行的操作都能完成了),fable5.1相比之下就没太大突破了,据说A社服务器都被干绿了大家都转用gpt.给gpt逼得暂停了pro20倍的订阅(确实20倍pro是一个改变我人生的订阅,之前基本都是真的可以无限量的用token在codex上实现任何想法,这也是我觉得人类有史以来性价比最高的产品每个月200刀给你创造一切的能力),grok4.7迟迟不发只能说从马圣降级到小马了,grok4.6绝对是多快好省的执行模型(不太适合做规划)4.7贷款最强了这么久迟迟不发,今天Gemini4pro据说都beta了给了10m上下文,吓得我赶紧又整了一堆号。国产模型这智谱5.3还是有独特用处的,哈哈哈就喜欢这种限制少的豆包工作我对他期望很高但是因为自己模型太垃圾(2.1pro0915吹的很厉害,用了以后还是一坨,基本的电脑使用都不行,还一定要建docker),定价也蠢得一批,本来字节有希望完全吃掉国内的办公份额的,一手好牌打的稀烂 这家公司真是烂透了,一堆算法天才拿最高的年薪就训练出2.1这种流口水的模型反而是workbuddy,在换上hy4以后居然出乎意料的好用,在我这几乎是过了可用的门槛线,大概率给我预测的一样,workbuddy会跑出来,而且也支持其他家模型,国际版甚至免费送你用astra6deepseek4.1在computer use上表现也很惊喜甚至有些情况比astra6好,moe模型的神鬼莫测可能就是这样
好久没谈最近的模型测试和自己用下来的体感,确实6astra已经是完全达到我心目中AGI水平的模型(其实5.6模型如果你会科学使用其实很多computer use功能基本能实现,基本从fable5那个时间就已经实现所有电脑上进行的操作都能完成了),fable5.1相比之下就没太大突破了,据说A社服务器都被干绿了大家都转
阅读:0
点赞:0