48小时,AI编码榜换了三次老大。
Meta甩出Muse Spark 1.3,放话编码能力超GPT-5.6 Sol,token还省25%。阿里Qwen3.8-Max当天反超,CodeArena前端总榜1691分登顶。Anthropic又用Claude Fable 5.1压轴反击,Terminal-Bench 4.0拿下55.8%。
分数贴着天花板互啄,三家报的还不是同一张卷子。
这到底是技术竞赛,还是刷分大赛?你押谁:Meta、阿里、Anthropic,还是都不信?评论区见。
AI编程人工智能

48小时,AI编码榜换了三次老大。
Meta甩出Muse Spark 1.3,放话编码能力超GPT-5.6 Sol,token还省25%。阿里Qwen3.8-Max当天反超,CodeArena前端总榜1691分登顶。Anthropic又用Claude Fable 5.1压轴反击,Terminal-Bench 4.0拿下55.8%。
分数贴着天花板互啄,三家报的还不是同一张卷子。
这到底是技术竞赛,还是刷分大赛?你押谁:Meta、阿里、Anthropic,还是都不信?评论区见。
AI编程人工智能
