数据世界
产业资讯 宏观经济 企业动态 人物动态 科技数码 数据洞察 AI前沿 行业峰会 热点资讯

17岁深圳少年陈广宇:从普通好奇少年到AI核心架构贡献者之路

2026-08-07来源:快讯编辑:瑞雪

2026年7月,人工智能领域迎来重磅消息:中国公司“月之暗面”推出新一代大模型Kimi K3,其参数量达2.8万亿,成为全球首个开放权重的3T级模型。这一突破性成果引发行业震动,特斯拉CEO马斯克在相关评测报道下留言称赞“令人印象深刻”,这也是他第二次公开认可该团队的技术实力。更令人瞩目的是,支撑K3模型的核心技术之一——Attention Residuals(《注意力残差》)研究论文中,三位并列第一作者里出现了一位年仅17岁的高三学生陈广宇。

陈广宇的成长轨迹打破了人们对“天才少年”的固有认知。他既没有奥赛金牌傍身,也未经历过跳级加速,甚至直到2024年才通过一本人工智能安全书籍正式接触该领域。这位来自深圳的少年在个人博客中坦言,高中阶段曾陷入“机械完成升学任务”的迷茫,直到决定暂停所有不感兴趣的活动,转而全身心投入计算机科学探索。这种纯粹由好奇心驱动的学习模式,让他在短短两年内从“刚搞懂Transformer”的新手,成长为国际顶尖AI团队的核心成员。

转折点出现在2025年5月。当时正在钻研线性注意力机制的陈广宇,在社交平台分享了技术分析博客,意外获得麻省理工学院博士杨松琳的回应。这条互动引发连锁反应:他的文章浏览量激增十倍,更被美国AI初创公司Tilde Research的CEO注意到。面对实习邀约,陈广宇选择先夯实基础——他花费数月掌握自定义Triton内核开发技术后,才于2025年7月飞赴硅谷开启实习生涯。在帕洛阿尔托的七周里,他每天工作15小时,与顶尖研究员共同完成内存优化混合专家模型项目,同时快速适应租房、公司运营等现实课题。

硅谷经历成为陈广宇科研生涯的跳板。回国后,他受邀加入“月之暗面”团队,与知名算法研究员苏剑林、苏州大学博士张宇同展开合作。在2026年1月至3月期间,三人共同攻克Attention Residuals技术难题。苏剑林在回忆录中详细记录了分工:自己提出初始构想后,陈广宇与张宇负责大规模模型验证,并共同设计出区块化信息压缩方案,在保持效果的同时将计算成本降低40%。这项成果直接应用于K3模型架构,而陈广宇此前加速KDA计算内核的工作,更使他成为两大核心技术的共同贡献者。

陈广宇的科研方法论颇具特色。他拒绝系统化学习Triton编程语言,而是通过研读论文、分析GitHub开源项目来掌握技术要点。这种“问题导向”的学习模式,让他在2025年2月的中学生编程马拉松中脱颖而出——其设计的“人类第三只机械辅助手”项目获得评委董科含高度评价,并因此入选全球未来领袖计划。在DeepSeek研究员袁境阳指导下,陈广宇以Gemini为辅助工具,通过追踪前沿论文快速建立机器学习认知体系,这种能力在传统教育体系中难以培养。

国际学校的教育背景为陈广宇提供了独特优势。高一时期,他通过记录室友鼾声与生活习惯的关联数据,训练出准确率达70%的预测模型,这项源于对抗失眠的实践项目,成为他首个AI应用案例。探月学校创始人王熙乔指出,AI技术正在重塑人才培养路径:当知识获取变得扁平化,快速进入陌生领域并解决问题的能力,比单纯积累知识更具价值。这种趋势在陈广宇身上得到印证——他既没有传统意义上的“天才光环”,却凭借持续探索的韧性和务实的学习态度,在17岁时站到了全球AI研究的前沿。

目前,陈广宇已回归校园完成高三学业,但他的科研轨迹仍在延续。在K3模型发布后,团队透露正在探索将Attention Residuals技术应用于多模态大模型的可能性。这位少年研究员的故事,为人工智能时代的人才培养提供了新范本:当技术变革加速知识迭代,保持好奇心与行动力,或许比遵循既定路径更重要。

字节AI“慢”行道:张一鸣划红线,梁汝波布长局,以长期主义筑技术壁垒
但更令外界瞩目的,是一则几乎同步传出的消息:向来低调的创始人张一鸣,在内部会议上罕见地为AI路线定调:字节拒绝走“模型蒸馏”这条捷径,即便这意味着短期内会落后于竞争对手。 而新部门负责人谭待则以视频生成模型…

2026-08-07

马斯克Terafab AI芯片超级工厂在得州开建,自建电力体系,初期投168亿美元
SpaceX与Tesla将初期投资168亿美元,在得克萨斯州GrimesCounty建设Terafab——一座先进的人工智能半导体综合工厂,以抢占马斯克所称对其公司未来至关重要的芯片产能。 这座垂直整合、占…

2026-08-07

REDMI新机命名引热议 胡馨心回应或暗示K200系列成后续旗舰新选择
IT之家 8 月 6 日消息,小米将于 8 月 11 日发布 REDMI K100系列手机,虽然新机还未正式登场。但目前已有不少米粉提前展开下一代 K 系列手机命名的讨论,有网友建议将后续机型命名为 K20…

2026-08-07

华为存储与手机业务应对涨价潮:存储供应稳如山 手机成本压力大
终端业务说“扛不住了”,存储业务说“没问题”,一天之内的两种声音,折射出华为内部不同业务线的处境差异——手机靠规模走量,成本一涨利润就薄;企业存储面向B端客户,利润空间更厚,抗压能力也更强。 吴俊杰透露,华为…

2026-08-07

AI Agent手机新阶段:国标L3启幕,未来体验升级尚需时日
大模型负责理解语言、识别图像和规划任务,是手机的核心能力来源;但模型再强,如果只能困在聊天框里回答问题,依然不足以让整台手机成为 L3。换句话来讲,L3 级别的 AI Agent 的手机仍是一名助手:它能拆…

2026-08-07

字节跳动高层发声:张一鸣倡长期主义,梁汝波强调自研深耕AGI未来
快科技8月6日消息,据媒体消息,在字节跳动近日举行的内部会议中,创始人张一鸣表示,做模型要坚持长期主义、延迟满足感,而不是用别人的输出,换一时的榜单排名。 梁汝波表示,在大语言模型上,接下来字节跳动还是会坚持…

2026-08-07

孙正义贝佐斯黄仁勋齐聚首:机器人“大脑”成资本新宠,价值几何?
公司以具身智能大模型为技术原点,向本体设计、数据采集与场景应用反向延伸,形成“大模型—本体—数据”三者相互驱动的全栈闭环:大模型牵引本体架构与数据需求,本体提供物理载体与实时反馈,数据则为模型迭代提供持续养料…

2026-08-07

中希AI合作:以创新为笔 共绘全球人工智能发展新画卷
彼得罗切洛斯表示,“在这些理念背后,中国采取了一系列切实可行的行动”——于2023年提出了《全球人工智能治理倡议》;2024年在联合国大会推动通过了加强人工智能能力建设国际合作决议,并随后与赞比亚共同发起设…

2026-08-07

字节跳动调整AI战略:坦然面对大语言模型落后 发力B端整合资源谋发展
字节跳动CEO梁汝波在8月6日的公司年中全员会上总结称,2026年上半年,豆包在C端应用上保持了竞争力,视频生成模型Seedance维持了SOTA(最先进)地位,但大语言模型面临被海外先进模型拉开差距的问题…

2026-08-07