众力资讯网

#触动心灵[超话]# 很多模型一上视觉,文本推理就缩水感觉跟换了脑子一样。但是DeepSeek这次明确说是在 V4-Flash 原有架构上“加入视觉模块”,然后持续训练出图像理解,同时保留原来的文本、推理和 Agent 能力,这点就很关键了。在实际场景里,你需要的不是一个只会看图说话的玩具,而是一个能看图、 ​

触动心灵 很多模型一上视觉,文本推理就缩水感觉跟换了脑子一样。但是DeepSeek这次明确说是在 V4-Flash 原有架构上“加入视觉模块”,然后持续训练出图像理解,同时保留原来的文本、推理和 Agent 能力,这点就很关键了。在实际场景里,你需要的不是一个只会看图说话的玩具,而是一个能看图、能推理、还能接着干活的Agent。如果多模态是长出来的而不是换掉的,那这个实验方向就对了。期待后续跑一下Agent任务看看稳定性。