众力资讯网

「The Information」援引知情人士爆料,在上周日的一场线下闭门会上,

「The Information」援引知情人士爆料,在上周日的一场线下闭门会上,DeepSeek CEO 梁文锋对投资者表示,采用更多国产芯片训练大模型是公司的当务之急。

眼下 DeepSeek 正处于敲定第二轮融资的最后阶段,计划以 5000 亿元人民币的估值募资 500 亿元(约合 75 亿美元)。

据悉本次闭门会只对经过审核的特定投资人开放。投资人必须亲赴 DeepSeek 位于北京或杭州的办公室,梁文锋本人则线上接入。

为严防首轮融资时的泄密重演,参会投资者被要求交出手机、随身电子设备和背包,现场只提供纸笔用于记录。

知情人士透露,梁文锋在周日会上将基于华为芯片或其他国产处理器的模型训练列为 DeepSeek 押注最大的方向之一,并明确强调:“这件事必须成功。”

他还预计,公司将在今年第四季度或明年一季度迎来新一批华为芯片,以支撑最新一代模型的训练,不过,他并未透露华为能够保障的实际供货规模。

梁文锋还对投资者称,公司正投入约 300 亿元人民币扩充算力。DeepSeek 曾于今年 6 月完成一轮 500 亿元的融资。

此外,DeepSeek 目前正在训练一个 2 万亿参数的模型,规模超过了其 1.4 万亿参数的现役旗舰模型 V4,公司还计划研发一个高达 8 万亿参数的超大模型。

模型体量越大,无论是训练还是在推理阶段(即模型执行任务、回答用户问题的过程),所需的芯片数量和算力规模就越庞大。

今年 5 月,在 DeepSeek 与投资人召开的线上会议中,梁文锋曾做过一笔算力测算:若想训练一个能与 OpenAI 最新顶级系统比肩的超大模型,要么需要大约 5 万颗英伟达 GB300 处理器,要么需要 20 万颗华为昇腾 950 芯片。

梁文锋当时坦承,DeepSeek 极度渴望引入更多华为芯片投入训练,但华为自身的产能根本无法满足需求。由于难以获取先进存储芯片(用于 AI 处理器高速传输海量数据的核心部件),加之其他元器件短缺,华为同样面临产能受限的问题。

虽然梁文锋没有指明 DeepSeek 预计接收的具体芯片型号,但这批芯片的交付时间与华为上周公布的产品路线图大体吻合:华为专为模型训练及部分推理场景打造的昇腾 950DT 预计将于今年四季度面世,而性能更为强悍的 960DT,则计划于 2027 年一季度登场。

华为曾于今年 4 月披露,旗下 AI 芯片已实际承载了 DeepSeek 轻量级模型 V4-Flash 的部分训练任务,双方也一直在推进深度协同,确保 DeepSeek V4 全系模型能平滑适配华为昇腾计算生态。