从做大模型量化、端侧推理和Agent应用的从业者视角看,未来三年消费级硬件能跑的20B-40B专精小模型,大概率能在写代码、个人知识库问答这类细分能力上追平甚至超过当前的GPT-6,但全面追平的概率很低。