泡泡资讯网

华为做AI确实远早于Transformer 往前查华为的研究历史,会发现一条非常

华为做AI确实远早于Transformer
往前查华为的研究历史,会发现一条非常清晰的脉络:
2012年:华为诺亚方舟实验室成立
诺亚方舟实验室隶属于华为"2012实验室",2012年在香港科学园正式成立,是华为从事AI基础研究的专门机构。
创始主任是杨强(华人界首个AAAI院士),2012-2015年执掌实验室。
2012-2017年的首席科学家、实验室主任是李航(原微软亚洲研究院高级研究员,信息检索、NLP、统计机器学习领域权威)。
2012年成立时的五大研究方向:
自然语言处理和信息检索
大规模数据挖掘和机器学习
社交媒体和移动智能
人机交互系统
机器学习理论
2014年:诺亚方舟实验室已在系统做大数据挖掘和AI研究
实验室主任张宝峰在2014年高交会上系统介绍了诺亚方舟的大数据挖掘工作,包括迁移学习、终身学习、数据平台等。
2016年:已有系统的深度学习布局
2016年的报道显示,诺亚方舟实验室已有完整的五大部门架构,包括NLP、大规模数据挖掘、人机交互、机器学习理论等,在全球多地设有分部。
2017年6月:Transformer论文发表
Google发表"Attention Is All You Need",Transformer架构诞生。
2018年:华为已在跟进预训练模型
诺亚方舟实验室在NLP领域持续产出,NeurIPS 2018上华为共有11篇论文被接收,其中一篇获得最佳论文。
2019年:发布哪吒(NEZHA)中文预训练模型
2019年9月,华为诺亚方舟实验室在arXiv发布哪吒(NEZHA)中文预训练语言模型论文,这是华为自研的中文预训练模型,比盘古对外发布早了一年半。
同期,诺亚方舟实验室首席科学家刘群在2019年AI ProCon大会上介绍,他们已经重现了BERT、实现了GPT-2,并在几百到上千个GPU上跑通了多卡多机并行训练。

2019年9月:在 arXiv 上发布了 哪吒(NEZHA) 中文预训练语言模型论文,这是华为诺亚方舟实验室自研的中文预训练模型。
2019年10月:华为诺亚方舟实验室首席科学家刘群在 AI ProCon 2019 大会上系统介绍了他们的预训练模型工作,包括:
自研中文预训练模型 哪吒
实体增强预训练模型 ERNIE
诗歌生成模型 乐府
内部已经重现了 BERT、实现了 GPT-2,并且在几百到上千个 GPU 上跑通了多卡多机并行训练
还在做模型压缩,希望把这些模型部署到华为手机上
2020年,继续推进:
诺亚方舟实验室继续做 TinyBERT、DynaBERT、TernaryBERT 等模型压缩工作
推出多语言版本 MultiNEZHA
把预训练模型移植到华为自研的昇腾芯片上

盘古大模型的内部立项——2020年11月就在华为云内部正式立项,由田奇博士组建团队推动,经过约半年的研发后于2021年4月对外发布。
此后盘古大模型经历了多次迭代:
2022年4月:升级到盘古2.0
2023年7月7日:发布盘古大模型3.0,采用"5+N+X"三层架构,定位"AI for Industries"
2024年6月:发布盘古大模型5.0
2025年6月:首次开源盘古7B和盘古Pro MoE 72B模型