天数智芯：天垓100完成百亿级参数大模型训练

时间：2023-06-13 16:22:01 来源: 经济参考网

(资料图片)

日前，在第五届智源大会AI系统分论坛上，上海天数智芯半导体有限公司（以下简称“天数智芯”）宣布，在天垓100加速卡的算力集群，基于北京智源人工智能研究院（以下简称“智源研究院”）70亿参数的Aquila语言基础模型，使用代码数据进行继续训练，稳定运行19天，模型收敛效果符合预期，天数智芯有支持百亿级参数大模型训练的能力。

据悉，在北京市海淀区支持下，智源研究院、天数智芯与爱特云翔共同合作，联手开展基于自主通用GPU的大模型CodeGen（高效编码）项目，通过中文描述来生成可用的C、Java、Python代码以实现高效编码。智源研究院负责算法设计、训练框架开发、大模型的训练与调优，天数智芯负责提供天垓100加速卡、构建算力集群及全程技术支持，爱特云翔负责提供算存网基础硬件及智能化运维服务。

在三方努力下，在基于天垓100加速卡的算力集群上，100B Tokens编程语料、70亿参数量的AquilaCode大模型参数优化工作结果显示，1个Epoch后loss下降到0.8，训练速度达到87K Tokens/s，线性加速比高达95%以上。在HumanEval基准数据集上，以Pass@1作为评估指标，自主算力集群训练出来的模型测试结果达到相近参数级别大模型的SOTA水平，在AI编程能力与国际主流GPU产品训练结果相近。

天垓100完成百亿级参数大模型训练，迈出了自主通用GPU大模型应用的重要一步。据介绍，接下来，天数智芯将与合作伙伴继续深入合作，建设更大规模的天垓100算力集群，完成更大参数规模的大模型训练，以自主通用GPU产品更好支持国内大模型创新应用，助力人工智能产业自主生态建设。

（文章来源：经济参考网）

标签：

上一篇：趣味民俗活动展魅力桂林龙胜梳秧节引客来全球热讯

下一篇：最后一页

精彩推送

X 关闭

品牌

更多>

X 关闭

产品

更多>

评测

更多>

天数智芯：天垓100完成百亿级参数大模型训练

相关文章

社会面清零后第十天，三问吉林省复工复产怎样了

青海海北州门源县发生3.9级地震震源深度10千米

山西太原万柏林区报告1例无症状感染者公布行程轨迹

上海战疫：从严从重从快查处食品安全违法行为

杭州本轮疫情已发现98例阳性感染者有进一步扩散可能

精彩推送

设计

天数智芯：天垓100完成百亿级参数大模型训练

相关文章

社会面清零后第十天，三问吉林省复工复产怎样了

青海海北州门源县发生3.9级地震 震源深度10千米

山西太原万柏林区报告1例无症状感染者 公布行程轨迹

上海战疫：从严从重从快查处食品安全违法行为

杭州本轮疫情已发现98例阳性感染者 有进一步扩散可能

精彩推送

设计

青海海北州门源县发生3.9级地震震源深度10千米

山西太原万柏林区报告1例无症状感染者公布行程轨迹

杭州本轮疫情已发现98例阳性感染者有进一步扩散可能