91金属网

产品报价

电解铜 铝锭 铅锭 锌锭 锡锭 电解镍 黄金 白银 铂金 钯粉 铑粉 精铟 锂电 碳酸锂 镁锭 电解钴
当前位置: 首页 » 资讯头条 » 产业终端 » 半导体 » 正文

天垓100率先完成百亿级参数大模型训练,天数智芯迎来新的里程碑

放大字体  缩小字体 2023-06-13    来源:中国电子报、电子信息产业网    作者:编辑部

6月10日,在第五届智源大会AI系统分论坛上,上海天数智芯半导体有限公司(以下简称“天数智芯”)对外宣布,天垓100加速卡的算力集群,在基于北京智源人工智能研究院(以下简称“智源研究院”)70亿参数的Aquila语言基础模型上,已使用代码数据进行继续训练稳定运行19天,且模型收敛效果符合预期,该项测试证明天数智芯有支持百亿级参数大模型训练的能力。

在北京市海淀区的大力支持下,智源研究院、天数智芯与爱特云翔共同合作,联手开展基于自主通用GPU的大模型CodeGen(高效编码)项目,通过中文描述来生成可用的C、Java、Python代码以实现高效编码。智源研究院负责算法设计、训练框架开发、大模型的训练与调优,天数智芯负责提供天垓100加速卡、构建算力集群及全程技术支持,爱特云翔负责提供算存网基础硬件及智能化运维服务。

在三方的共同努力下,在基于天垓100加速卡的算力集群上,100B Tokens编程语料、70亿参数量的AquilaCode大模型参数优化工作结果显示,1个Epoch后loss下降到0.8,训练速度达到87K Tokens/s,线性加速比高达95%以上。与国际主流的A100加速卡集群相比,天垓100加速卡集群的收敛效果、训练速度、线性加速比相当,稳定性更优。在Humaneval基准数据集上,以Pass@1作为评估指标,自主算力集群训练出来的模型测试结果达到相近参数级别大模型的SOTA水平,在AI编程能力与国际主流GPU产品训练结果相近。

基于天垓100算力集群的AquilaCode大模型训练性能采样

天垓100率先完成百亿级参数大模型训练,迈出了自主通用GPU大模型应用的重要的一步。这一成果充分证明了天垓产品可以支持大模型训练,打通了国内大模型创新发展的关键“堵点”,对于我国大模型自主生态建设、产业链安全保障具有十分重大的意义。

接下来,天数智芯将与合作伙伴们继续深入合作,建设更大规模的天垓100算力集群,完成更大参数规模的大模型训练,以自主通用GPU产品更好支持国内大模型创新应用,进一步夯实我国算力基础,助力人工智能产业自主生态建设。

 
版权说明:本文已注明来源和作者,且版权均归原作者所有,文章仅供参考学习使用,文中出现的商标、图像版权属于原合法持有人,仅限非商业用途使用(本文涉及的任何内容都不作为或视为投资建议)。91金属网原创信息未经授权,任何网站、个人不得以任何形式传播、发布、复制(包括但不限于价格行情、市场报价等)。如本文涉及版权等问题,请与91金属客服联系QQ:2272797343删除处理!
免责声明:文章内容仅代表原作者个人观点,不代表91金属立场;91金属网站系信息展示平台,仅提供文章信息存储空间服务。91金属对本文全部或部分内容、文字、图片的准确性、真实性、完整性、有效性、及时性、原创性等不作任何保证或承诺,请自行核实相关内容,因此所引起的后果与91金属无关。 图片声明:如本站原创文章内容使用了您的图片,请作者3周内与本站联系索取稿酬。
 

电话咨询

咨询电话:
021-60820701

微信客服

微信咨询

微信咨询

在线客服

返回顶部