众力资讯网

26 款商用大模型按每百万 token 混合成本从低到高排下来,Grok 4.6

26 款商用大模型按每百万 token 混合成本从低到高排下来,Grok 4.6 的输入只要 2 美元、输出 6 美元,而榜单顶端的 Claude Fable 5 Max 输入 10 美元、输出 50 美元——同样写一段话,结账时 Grok 能省下 80% 到 88% 的钱,差不多是五分之一到八分之一的价。

更扎心的是 Fable 5 智能指数上的那一分:Grok 4.6 拿 61 分,Claude Fable 5 Max 拿 62 分,差距只有 1.6%。换句话说,多花 5 到 8 倍预算,你换回来的并不是另一档智能,而只是同档里最贵的那一款。

机制也不复杂:榜单口径是每百万 token 混合成本,输入输出按一定比例加权,定价低的模型天然往上爬,能力相近的就被挤到一起。Grok 4.6 之所以能在 26 款里被标成"智能-价格比最强",就是因为它正好卡在那条帕累托前沿上——再往左挪一格能力就掉档,再往上挪一档价格就翻倍。

对正在选 API 的人来说,这道选择题其实很具体:长文本总结、批量客服回复、日志归因这类任务,智能差一点几乎无感,账单差五倍却是每月都在的。只有那种真的对顶格智能敏感、又不差钱的产品,才该为那 1 分去多掏钱。

需要提醒的是,这份结论只基于 Fable 5 一个评测分数,榜单也只按 API 标价算,企业折扣和批量承诺价都没算进去,便宜幅度未必能原样搬到你的合同里。

你现在的 LLM API,如果按这套混合成本重排一遍,还会继续选原来那款吗?