华为诺亚方舟实验室前主任、盘古大模型核心负责人,兼擅模型压缩理论与大规模工业落地的深度学习研究者,现任 AI Agent 创业公司基元律动联合创始人兼 CEO。
| 出生 | 1991年,中国 |
| 国籍 | 中国 |
| 所在机构 | 基元律动(联合创始人兼 CEO,2026年4月–);原华为诺亚方舟实验室(主任,2025年3月–2026年3月) |
| 研究方向 | 深度学习、模型压缩与量化、神经网络架构搜索(NAS)、计算机视觉、大语言模型、AI Agent |
| 博士导师 | 许超(北京大学)、陶大程(澳大利亚科学院院士) |
| 个人网站 | wangyunhe.site |
| 知乎 | YunheWang |
| GitHub | YunheWang |
| Google Scholar | 王云鹤 — 3.3万+引用,h-index 68 |
人物简介
王云鹤是中国深度学习领域兼顾学术产出与工业落地的代表性研究者之一,以高效神经网络架构和模型压缩研究见长。在华为诺亚方舟实验室任职近九年间,他从实习生晋升至实验室主任,期间主导了 GhostNet、AdderNet 等被业界广泛采用的轻量化架构,并出任华为盘古大模型核心负责人,主持推出盘古 5.5 系列。2026年3月离开华为后,他随即创立专注企业级 AI 智能体落地的公司基元律动,首轮融资后估值达 1 亿美元。其 Google Scholar 引用量逾 3.3 万次,h-index 为 68,在国内工业界研究员中属于第一梯队。
成长与教育
王云鹤本科就读于西安电子科技大学数学与应用数学专业,打下扎实的数学基础。本科毕业后,他考入北京大学智能科学系攻读博士学位,师从许超教授与澳大利亚科学院院士陶大程(Dacheng Tao)教授,研究方向聚焦深度学习与模型压缩。
博士在读期间,他已在顶级学术会议上开始发表成果,包括 NeurIPS 2016 的 CNNpack(频域神经网络压缩)和 ICML 2017 的 Beyond Filters(紧凑特征图),展示了将频域理论与深度学习工程高度融合的研究风格。2017年,尚未毕业的他以华为诺亚方舟实验室北京部门首位实习生身份加入华为,开启了学术与工业双轨并进的职业路径。2018年博士毕业,正式入职华为。
在读期间先后获得谷歌博士奖学金(Google PhD Fellowship,2017)、百度奖学金(2017)、北京大学校长奖学金(2017)及两届国家研究生奖学金(2016、2017),是博士阶段获奖最密集的一届之一。
职业经历
华为诺亚方舟实验室(2017–2026)
王云鹤于 2017 年以实习生身份加入华为诺亚方舟实验室,是该实验室北京部门成立初期引进的第一位实习研究员。2018年博士毕业后正式入职,从高级工程师起步,历任主任工程师、技术专家,在实验室内部以"每年一升"的节奏稳步晋升。
高效深度学习架构研究期(2018–2021)
在此阶段,王云鹤参与主导了华为诺亚方舟实验室若干具有标志意义的基础架构研究。GhostNet(CVPR 2020)提出以廉价线性运算生成"幽灵特征图",在相同精度下大幅削减端侧模型的参数量与计算量,迅速成为业界引用最广的轻量化架构之一,该成果在其 Google Scholar 上的单篇引用超 6000 次。同年,AdderNet(CVPR 2020 口头报告)在深度网络中以纯加法运算替代乘法,从硬件功耗层面重新定义高效 AI,两项成果共同斩获华为第四届十大发明大奖,并通过算法优化落地中国天眼 FAST 射电望远镜,辅助科研人员高效识别数百个全新快速射电暴(FRB)样本。
此外,视觉 Transformer 的工业应用也是这一时期的重要方向。王云鹤与团队发表了 Transformer-in-Transformer(TNT, NeurIPS 2021)、图像超分 Pre-trained Image Processing Transformer(IPT, CVPR 2021)等工作,并主持撰写了引用量极高的综述《A Survey on Visual Transformer》(IEEE TPAMI 2022),系统梳理了 ViT 系列研究的发展脉络。
算法应用部部长(2021年末–2025年初)
2021年底,王云鹤升任华为算法应用部(后改称小模型实验室)部长,全权负责高效 AI 算法的研发落地。在此职位上,他持续推进模型轻量化技术向终端产品的转化,相关成果被应用于华为 Mate 30 等旗舰手机及多个行业解决方案中。
华为诺亚方舟实验室主任兼盘古大模型负责人(2025年3月–2026年3月)
2025年3月,原诺亚方舟实验室主任姚骏内部调岗,王云鹤临危受命,接任实验室主任并同步出任盘古大模型核心负责人,成为华为 AI 研发体系的最高技术掌舵人,业内称为"盘古少帅"。
接任后约三个月内,他快速推动盘古 5.5 系列发布。盘古 5.5 采用混合专家(MoE)架构,旗舰版本"Pangu Ultra"参数量达 718B,激活参数约 39B;引入自适应快慢思考机制,整体推理效率较前代提升 8 倍;同时推出深度检索 Agent 能力模块 DeepDiver,可在 5 分钟内完成超过十跳的复杂问答并生成万字级专业报告。盘古大模型在此期间深度落地一汽、广汽、长安、赛力斯、比亚迪等主流车企,贯穿整车研发、生产、售后全链条。
2026年3月28日,王云鹤在朋友圈发文确认离职,告别华为,他写道:“8年了,准确来说是9年了(2017年北京第一个实习生),怀着不舍的心告别曾经奋斗过的地方。”
基元律动(2026年4月–)
2026年4月8日,上海基元律动科技有限公司正式注册成立,同月17日北京基元律动科技有限公司亦完成工商登记,法定代表人均为王云鹤。原华为诺亚方舟实验室首席研究员韩凯加盟担任 CTO,其长年与王云鹤共同研发 GhostNet 等算法,二人在技术方向与工程实现上具有高度默契。
基元律动核心赛道锁定产业落地型企业级 AI 智能体(AI Agent),以王云鹤在华为积累的轻量化大模型与低功耗算法技术为底层支撑,主攻帮助制造、金融、汽车等传统行业企业构建专属 AI 智能助理,着力解决企业 AI 落地成本高、部署难、算力消耗大的行业痛点,刻意避开通用大模型的巨头竞争红海。
2026年6月2日,新浪科技独家披露,基元律动已完成一轮融资,投后整体估值达 1 亿美元,出资方由国内一线知名风险投资机构及多家头部互联网企业共同组成,同时已锁定数家国资背景大厂的稳定合作订单,首款商用 Agent 产品计划于数月内对外发布。
主要贡献
- GhostNet(CVPR 2020)— 提出以廉价线性运算生成"幽灵特征图"的轻量化网络架构,相同精度下参数量与浮点运算量均大幅低于此前最优方案,成为端侧 AI 主流技术路线之一,单篇引用超 6000 次,是王云鹤引用量最高的论文。
- AdderNet(CVPR 2020 Oral)— 在深度网络中以纯加法运算替代乘法卷积,从算子层面大幅降低 AI 芯片运算功耗与电路面积,获华为十大发明奖并落地中国天眼 FAST,辅助发现数百个新快速射电暴样本。
- VanillaNet(2023)— 贯彻"少即是多"的极简设计哲学,通过减少深度和复杂操作(如自注意力)构建高效主干网络,6层 VanillaNet 超越 ResNet-34,13层版本达到约 83% Top-1 准确率,在硬件效率上具有显著优势。
- PanGu-π / 盘古 5.5(2023–2025)— 主导华为盘古大模型架构创新;PanGu-π 通过非线性补偿模块显著提升 7B/1B 规模 LLM 的表达能力;盘古 5.5 采用 MoE 架构实现 8 倍推理效率提升,推动大模型在汽车、制造、金融等行业的商业落地。
- 视觉 Transformer 体系研究 — 参与发表 TNT(NeurIPS 2021)、IPT(CVPR 2021)、CMT(CVPR 2022)等系列工作,并主持撰写 ViT 综述(IEEE TPAMI 2022),是国内最早系统整理视觉 Transformer 研究图谱的工作之一,引用量持续居高。
- 模型量化与剪枝系统方法 — 在 NeurIPS、ICML、CVPR、ICCV 等顶会发表多篇量化(AdderQuant、低比特搜索)、剪枝(SCOP、ManiDP)及知识蒸馏(数据无关蒸馏 DAFL、解耦特征蒸馏)工作,系统性地推进了高效 AI 的基础方法论建设。
社会影响与荣誉
- Google PhD Fellowship(2017) — 谷歌博士奖学金,当年度获此奖学金的中国研究生极为稀少。
- 百度奖学金(2017) — 每年仅授予全国约10名顶尖博士生。
- 北京大学校长奖学金(2017) — 北大研究生最高荣誉奖学金之一。
- 国家研究生奖学金(2016、2017) — 连续两届获奖。
- 华为第四届十大发明大奖 — 因《高效能乘法器与加法神经网络》斩获华为最高级别创新发明奖项,是少数能在企业内部同时实现高学术影响力与商业价值的成果。
- WAIC 杰出青年论文奖提名(2020) — 入围世界人工智能大会最佳青年论文。
- CVPR 2024 最佳学生论文提名 — 团队论文获国际计算机视觉顶会最高荣誉候选资格。
学术与人际网络
- 许超 — 北京大学博士导师;北京大学智能科学系教授,模型压缩与高效深度学习领域资深学者,奠定了王云鹤研究方向的学术基础。
- 陶大程(Dacheng Tao) — 北京大学博士联合导师;澳大利亚科学院院士,统计机器学习与计算机视觉领域国际权威,后续多篇 Huawei 论文中仍有合作。
- 韩凯(Kai Han) — 华为诺亚方舟实验室前首席研究员,GhostNet、TNT 等核心论文共同作者;现任基元律动 CTO,长期最重要的合作伙伴与创业搭档。
- 田奇(Qi Tian) — GhostNet、AdderNet 等多项工作的共同合作者,华为诺亚方舟实验室资深研究员。
- 陈汉汀(Hanting Chen) — AdderNet、IPT 等多篇顶会论文的核心共同作者,华为诺亚方舟实验室研究员。
- Chang Xu — 南洋理工大学教授,王云鹤博士期间学术合作者,二人在模型压缩方向合发多篇高影响力论文。
个人风格
王云鹤的研究路径呈现出鲜明的"数学直觉驱动工程落地"风格:AdderNet 的灵感源于一次爬山途中对乘加运算本质的思考,GhostNet 则从"冗余特征图"这一统计观察出发直接给出可量化的工程方案,两者均展现出从朴素数学洞察跨越到可规模化部署方案的能力。在知乎等平台,他保持着与学术同行和工程师的公开交流,技术表达直接、不做过度包装。九年间从华为首位北京实习生晋升至实验室主任,再到以1亿美元估值创业,其路径折射出国内新一代 AI 领军人物在大厂技术积淀与独立创业窗口之间进行自主抉择的典型轨迹。
参考资料
- 个人主页:wangyunhe.site
- Google Scholar:scholar.google.com/citations?user=isizOkYAAAAJ
- DBLP:dblp.org/pid/63/8217-1.html
- 知乎主页:zhihu.com/people/YunheWang
- 华为诺亚方舟实验室:noahlab.com.hk
- 新浪科技独家报道(2026-06-02):独家|原华为盘古"90后少帅"离职创业
- 凤凰网科技报道(2026-06-02):华为90后"盘古少帅"出走创业 资本抢投 新公司估值1亿美元
- 量子位报道(2026-03-28):华为盘古大模型负责人王云鹤离职
- 智源社区深度报道:华为 AI,迎来大变