众力资讯网

K3和V4都发布了首日横评结论很明确

最近一周是AI行业有史以来最挤的一周。 Kimi K3在7月17号发布了。2.8万亿参数,100万Token上下文,Co
最近一周是AI行业有史以来最挤的一周。
Kimi K3在7月17号发布了。2.8万亿参数,100万Token上下文,Code Arena登顶全球第一。72小时内服务器被挤爆,月之暗面被迫暂停新用户注册。DeepSeek V4在7月20号发布了。峰谷定价,V4 Pro平时0.87美元每百万Token,高峰1.74美元。价格是Fable 5的3.5%。Anthropic吓得当天宣布Fable 5永久免费开放。
两颗核弹,三天之内,同时引爆。
这几天我把两个模型都测了一遍,也看完了国内外所有的主流评测。结论可以一句话说完:K3是性能怪兽,V4是价格屠夫。但它们真正的区别,不在参数表里。
先说你最关心的跑分。
K3的综合能力在国产模型里排第一。投研推理领先GPT-5.5超过15分。前端代码生成能力独一档,做出来的游戏界面比其他模型高一个层级。多模态、长文本、复杂推理,都是一流水平。V4的综合能力接近Opus 4.8,编码直追GPT-5.6 Sol。SWE-bench得分80.6%,长文本MRCR 1M得分83.5分。同样是顶级。
光看跑分,V4打不过K3。
但跑分不是全部。
在实际使用中,两个模型的体验差异非常大。K3的思路极其清晰。跨文件理解能力极强。代码结构优雅。但稳定性波动明显。用户暴增之后速度骤降,偶尔卡顿。就像一个天才程序员,灵感来了写出来的代码让你拍案叫绝。但他状态不好的时候,你得等他。
V4走的是另一条路。速度极快。性价比极高。峰谷定价让它在非高峰时段几乎等于白送。但低级错误多。编译报错、类型不匹配、变量名拼错。你需要花时间debug。就像一个极其勤奋的程序员,产出量惊人。但你得仔细检查他的每一行代码。
K3适合什么事?适合创意型工作。前端开发。游戏设计。投研分析。需要深度思考和创造性输出的场景。你把最难的活扔给它,它能给你惊喜。V4适合什么事?适合批量型工作。标准化任务。大批量评测。API调用量巨大的场景。你不在乎它偶尔出小错,因为你可以用极低的成本跑十遍,取最好的那一次。
这两个模型的定位差异,其实反映了中国AI两条完全不同的路。
月之暗面选的是"性能优先"。把模型做到最强,然后宣布开源。7月27号,K3的完整权重将向全世界开放。你可以下载回家,自己部署,自己微调。不是给一个API让你调用。是把整个模型给你。
DeepSeek选的是"普惠优先"。把价格打到极致。峰谷定价的本质,是把AI推理从"奢侈品"变成"自来水"。用得起的人越多,用AI的场景就越多。用AI的场景越多,算力需求就越大。算力需求越大,规模效应就越明显,价格还能再降。这是一个正向飞轮。
这两条路没有谁对谁错。大家都在服务同一件事:让AI从少数人的特权变成所有人的工具。
但如果你问我,中国AI这次最大的突破是什么。不是K3的参数多了一个数量级。不是V4的价格又降了一半。是这两个模型的配合。一个做性能的上限,一个做价格的下限。一个证明了中国AI可以跟世界最强掰手腕,一个证明了中国AI可以把成本打到让对手无法竞争。
上限和下限同时被拉高。这才是真正可怕的。
写到这儿,我想起一周前那篇文章。Anthropic被逼到把Fable 5永久免费。当时我的判断是这不是一次战术调整,是一个信号。今天K3和V4同时站在场上,这个信号已经变成了大喇叭。中国AI不是在追赶。中国AI是在用自己的方式,重新定义这个行业的竞争规则。
而你,不管你用K3还是V4。不管你追求质量还是性价比。你都是赢家。因为选择权,第一次回到了你手上。