17岁深圳少年陈广宇,作为Kimi K3核心架构技术“注意力残差”的共同一作,改写了大模型底层逻辑。他仅用一年深耕AI领域,靠研读论文、追踪开源项目快速成长,休学加入月之暗面实习,提出的分块注意力残差设计,以不到2%的额外成本,换来25%的训练效率提升。这项技术支撑起2.8万亿参数的全球最大开源模型,让K3在国际盲测编程榜登顶,连马斯克都公开点赞。面对赞誉,他始终强调团队协作,拒绝“造神”,成为中国AI新生代的亮眼注脚。AI博士生 MIT天才 AI人才洞察 卓越课手智能

17岁深圳少年陈广宇,作为Kimi K3核心架构技术“注意力残差”的共同一作,改写了大模型底层逻辑。他仅用一年深耕AI领域,靠研读论文、追踪开源项目快速成长,休学加入月之暗面实习,提出的分块注意力残差设计,以不到2%的额外成本,换来25%的训练效率提升。这项技术支撑起2.8万亿参数的全球最大开源模型,让K3在国际盲测编程榜登顶,连马斯克都公开点赞。面对赞誉,他始终强调团队协作,拒绝“造神”,成为中国AI新生代的亮眼注脚。AI博士生 MIT天才 AI人才洞察 卓越课手智能
