一篇改写大模型底层逻辑的论文、一位未满18岁的深圳高三生,连特斯拉、xAI创始人马斯克都主动转发点赞,这项国产AI底层突破瞬间引爆全球科技行业,刷新所有人对青少年科研能力的认知 。
全网刷屏名场面:马斯克公开认可中国少年科研成果
2026年3月,国产AI企业月之暗面(Kimi)发布重磅论文《Attention Residuals(注意力残差)》,直接重构沿用近十年的Transformer核心结构。论文发布当晚,马斯克在社交平台转发全文,配文Impressive work from Kimi(Kimi这项研究令人印象深刻),单条帖子曝光量突破450万,全球AI从业者集体围观 。
真正引爆舆论的是论文作者名单:陈广宇,17岁,深圳贝赛思国际学校高三在读生,位列论文共同第一作者,与RoPE旋转编码发明人苏剑林、Kimi首席架构师张宇三人标注“同等贡献”,37位作者里,唯有他是在校高中生 。
7月Kimi K3大模型正式发布,依托这套注意力残差架构登顶伯克利全球匿名AI评测榜单,综合性能超越GPT-5、Claude顶尖版本,马斯克再次在第三方评测下留言肯定,这位深圳少年彻底出圈。
17岁少年干了什么?解决全球AI行业十年痛点
所有大模型都基于2017年谷歌提出的Transformer架构,传统“残差连接”存在致命短板:模型层数越深,早期关键信息会被层层信息稀释,AI出现严重“健忘症”,想要提升推理能力只能疯狂堆砌算力,成本居高不下。
陈广宇主导参与的注意力残差机制,彻底改变信息传递逻辑:
1. 让AI具备“选择性记忆”,自主筛选关键历史信息,不再无差别堆叠全部数据;
2. 他与团队提出分块注意力残差落地方案,只用极低算力成本,就让48B参数模型训练效率提升25%,数理推理能力上涨7.5%;
3. 该技术无行业壁垒,可适配所有开源、闭源大模型,被业内评价为深度学习2.0标志性突破 。
简单来说:过去想要AI变聪明,只能砸钱堆显卡;陈广宇团队改写底层算法,花更少算力,做出更强的人工智能。
不靠天赋滤镜:深圳少年的硬核成长路径
很多人将他标签化为“天才神童”,但他的科研之路有清晰轨迹,也是深圳科创土壤孕育的结果:
1. 扎实编程底子:美国计算机奥林匹克铂金选手,国际算法竞赛顶级段位,自学深度学习、翻阅上千篇AI前沿论文;
2. 提早接轨产业:2025年参加青少年黑客马拉松崭露头角,远赴硅谷完成AI实验室实习,同年11月加入Kimi团队实习;
3. 5个月攻克核心难题:入职仅半年拿下团队内部黑客松冠军,随后深度参与底层架构攻关,拿出落地性极强的优化方案;
4. 清醒低调,拒绝造神:走红后他公开表态,希望媒体少聚焦个人,这项成果是整个团队共同努力,不能单纯放大少年身份制造热点 。
为何这件事震动全球科技圈?三重深层意义
1. 打破年龄偏见:高中生站上全球AI底层研发舞台
以往大模型底层架构革新,参与者清一色名校博士、行业资深研究员;17岁高中生跻身核心一作,与全球顶尖AI学者共享同等科研贡献,证明前沿科创不再有严苛年龄门槛。
2. 国产AI底层技术实现世界级突围,获西方顶尖大佬认可
长期以来,大模型基础架构、核心算法话语权掌握在美国企业手中。此次由中国团队主导、本土少年深度参与的底层革新,不靠模仿、不靠引进,原创技术被马斯克、前OpenAI高管集体称赞,标志中国AI从应用层突破走向底层技术自主。
3. 深圳科创生态的缩影:包容年轻人、产学研无缝衔接
深圳完善的青少年科创培养、开放的AI企业实习通道、自由的技术交流氛围,让在校生不用等到大学、不用走出国门,就能直接参与全球顶尖科研项目。少年科研出圈,背后是城市完整的创新土壤。
马斯克一句点赞,只是这场技术突破的缩影。真正震撼科技圈的,从来不是“17岁高中生”的噱头,而是一名中国少年深度参与改写AI底层规则的硬核实力。
当越来越多年轻人提前站上全球技术博弈的赛场,意味着中国人工智能的创新梯队,已经迎来全新的时代。