天数智芯:天垓100完成百亿级参数大模型训练
2023-06-13 16:17:59 经济参考网


(资料图片仅供参考)

日前,在第五届智源大会AI系统分论坛上,上海天数智芯半导体有限公司(以下简称“天数智芯”)宣布,在天垓100加速卡的算力集群,基于北京智源人工智能研究院(以下简称“智源研究院”)70亿参数的Aquila语言基础模型,使用代码数据进行继续训练,稳定运行19天,模型收敛效果符合预期,天数智芯有支持百亿级参数大模型训练的能力。

据悉, 在北京市海淀区支持下,智源研究院、天数智芯与爱特云翔共同合作,联手开展基于自主通用GPU的大模型CodeGen(高效编码)项目,通过中文描述来生成可用的C、Java、Python代码以实现高效编码。智源研究院负责算法设计、训练框架开发、大模型的训练与调优,天数智芯负责提供天垓100加速卡、构建算力集群及全程技术支持,爱特云翔负责提供算存网基础硬件及智能化运维服务。

在三方努力下,在基于天垓100加速卡的算力集群上,100B Tokens编程语料、70亿参数量的AquilaCode大模型参数优化工作结果显示,1个Epoch后loss下降到0.8,训练速度达到87K Tokens/s,线性加速比高达95%以上。在HumanEval基准数据集上,以Pass@1作为评估指标,自主算力集群训练出来的模型测试结果达到相近参数级别大模型的SOTA水平,在AI编程能力与国际主流GPU产品训练结果相近。

天垓100完成百亿级参数大模型训练,迈出了自主通用GPU大模型应用的重要一步。 据介绍, 接下来,天数智芯将与合作伙伴继续深入合作,建设更大规模的天垓100算力集群,完成更大参数规模的大模型训练,以自主通用GPU产品更好支持国内大模型创新应用,助力人工智能产业自主生态建设。

热门推荐

文章排行

  1. 2023-06-13天数智芯:天垓100完成百亿级参数大模型训练
  2. 2023-06-13英国男子徒手攀登韩国乐天世界大厦被抓 有123层高555米-视讯
  3. 2023-06-13时讯:国家能源局:6月至9月在全国范围开展电力系统调节性电源建设运营综合监管工作
  4. 2023-06-13全球快消息!看一次动辄上千元 宠物医疗怎成“糊涂账”?
  5. 2023-06-13曹桥镇(关于曹桥镇介绍) 环球热点
  6. 2023-06-13热门看点:南财研选快讯丨天风证券:预计2025年中国车载显示市场规模将达1100亿元左右
  7. 2023-06-13李斌低头,来得及么?
  8. 2023-06-13600+269+190!掘金夺冠约老师刷爆纪录,多项数据NBA历史首次 天天观天下
  9. 2023-06-13世界热点!平煤股份:拟向中国平煤神马集团购买产能指标
  10. 2023-06-13世界热议:国家发展改革委:中职、高职毕业生就业率分别超过95%和90%
  11. 2023-06-13全球即时:食品饮料行业周报:白酒底部 零食及乳制品逐步迎布局期
  12. 2023-06-13世界聚焦:信阳职业技术学院固始校区正式揭牌
  13. 2023-06-13热文:2014巴西世界杯主题曲詹妮弗洛佩兹_2014巴西世界杯主题曲
  14. 2023-06-13惠民携手爱奇艺推出《狂飙》系列数字藏品_世界报道
  15. 2023-06-13环球资讯:三亚市文化中心预计今年7月完成项目主体结构施工
  16. 2023-06-13高盛集团下调油价预期 国际油价12日显著下跌
  17. 2023-06-132023上半年四川遂宁市“遂州英才”考核招聘射洪市引进高层次人才和急需紧缺专业技术人才第一批(往届毕业生)拟聘用公示
  18. 2023-06-13报道:石四药集团(02005)取得国家药监局有关胞磷胆硷钠注射液(4ml:0.5g)的药品生产注册批件
  19. 2023-06-13全球头条:复活节人们都干些什么_复活节人们做什么
  20. 2023-06-13什么叫内业资料_内业资料是什么意思-焦点精选