【Kimi K3:游戏显卡堆出的“平民”算力奇迹】技术圈正在围观一场暴力美学:开发者Ning利用80张RTX 5090游戏显卡,成功跑通了拥有2.8万亿参数的Kimi K3模型,并在未调优状态下实现了20 Token/s的推理速度。这标志着顶级模型首次在完全脱离HBM(高带宽内存)——这种目前AI界最稀缺、最昂贵的硅资源——的情况下,仅靠普通显存和以太网连接就能展现出“前沿级”智能。这件事的深层意义在于,它打破了“顶级AI必须依赖昂贵企业级算力”的垄断逻辑。虽然80张显卡的电费和硬件成本对个人依然高昂,但对任何实验室或初创公司来说,这比排队数月去抢购受限的专业计算卡要现实得多。这种架构证明了通过优化软件栈,廉价的消费级硬件也能承载起巨量参数的MoE架构。它让“拥有并私有化部署”一个世界级模型从实验室神话变成了工程可行性方案,算力民主化的边界正被这群硬核玩家向外暴力推行。x.com/totheagi/status/2081855316443205717
