DeepSeek 披露:正用国产芯片训练下一代模型,"必须成功"9 月 20 日,DeepSeek 举办投资者活动,梁文锋通过网络电话参会。为防泄密,投资者到场需上交手机和所有电子设备,只发纸笔记录 —— 这阵仗本身就说明内容分量。会上披露的关键信息:▫️ 用更多国产芯片训练模型,是 DeepSeek 当前最重要优先级之一▫️ 梁文锋原话:在华为芯片或其他国产 GPU 上训练模型,是公司 "最大的赌注之一","必须成功"▫️ 预计华为最早今年第四季度开始向 DeepSeek 交付训练芯片▫️ 正在训练 2 万亿参数模型(现有旗舰 V4 为 1.4 万亿)▫️ 后续还计划开发 8 万亿参数的更大模型参数路线图从 1.4 万亿 → 2 万亿 → 8 万亿,而训练底座正从海外芯片切换到国产芯片。这一步走通,意义远超一家公司的模型迭代。极客头条
