腾讯披露最新大模型训练方法:Angel框架升级效率提升2.6倍

站长网2023-11-27 14:38:490阅

要点:

腾讯披露混元大模型训练方法，Angel框架升级，大模型训练效率提升至2.6倍，千亿级大模型训练可节省50%算力成本。

AngelPTM机器学习训练框架通过多维度并行优化存储，在通讯方面采用软硬件结合解决方案，提高大模型训练稳定性。

腾讯推出大模型推理框架AngelHCF，通过扩展并行能力和关键能力优化，相较于主流框架，推理速度提高了1.3倍。

在当前大模型参数规模呈指数级增长的情况下，腾讯近日披露了混元大模型训练的最新方法，通过升级自研机器学习框架Angel，成功提升大模型训练效率。这一升级使得千亿级大模型训练可以节省高达50%的算力成本，为应对算力紧缺提供了有力支持。Angel框架的升级不仅仅在于提高效率，还支持单任务万卡级别超大规模训练，进一步提升了腾讯云HCC大模型专属算力集群的性能和效率。

图源备注：图片由AI生成，图片授权服务商Midjourney

为了进一步提高大模型的训练和推理效率，腾讯自研了机器学习训练框架AngelPTM。在存储方面，AngelPTM采用多维度的并行计算，包括数据并行、模型并行、流水并行和序列并行。

此外，通过在ZeRO-Cache的基础上引入统一视角技术，将显存和主存打通，有效扩展了显存容量，提升了单机存储容量达90%。在通讯方面，腾讯通过软硬件结合的方式解决，构建了3.2T RDMA网络来拓宽带宽，同时在框架软件层面做GPU拓扑感知，实现了负载均衡的流水并行。为了确保稳定性，腾讯对基础设施的网络、硬件、存储、云原生调度都进行了监控，并实施了自动续训和系统容错。

此外，为解决推理成本不断上升的问题，腾讯推出了大模型推理框架AngelHCF。通过扩展并行能力和关键能力的优化，包括Embedding共享、Attention算子优化、Paged Attention优化等方式，提高了推理性能，相较于主流框架，AngelHCF的推理速度提高了1.3倍。这一框架在腾讯混元大模型文生图的应用中，将推理耗时从原本的10秒缩短至3至4秒。

腾讯不仅仅在大模型训练方面取得了显著的效率提升，还在推理阶段取得了实质性的优化。这一系列技术提升已经在腾讯云上得以开放，为用户提供更优的训练和推理加速能力，同时支持客户一站式训练精调，打造专属智能应用。腾讯内部已有超过300项业务和应用场景接入腾讯混元大模型内测，涵盖了文本总结、摘要、创作、翻译、代码等多个领域，这标志着整个生产链路的全面升级，从模型研发到应用落地形成了一站式的平台，进一步推动了大模型应用的发展。

腾讯披露最新大模型训练方法Angel框架升级效率提升26倍

0000

评论列表

共(0)条

相关推荐

站长资讯
iPhone 16 Pro系列电池容量曝光：最高4676mAh 系列史上最强
快科技8月3日消息，据MacRumors最新报道，iPhone16Pro系列两款机型的电池容量进一步提升，分别达到了3577mAh和4676mAh。对比上一代，iPhone15Pro是3274mAh、iPhone15ProMax是4422mAh。根据此前爆料显示，iPhone16ProMax的续航时间将超过30小时，而上一代的iPhone15ProMax为29小时。
站长网2024-08-03 10:54:57
0000
站长资讯
OpenAI CEO表示：由于使用量超过预期延迟GPTs分阶段推出计划
划重点:📅2023年11月8日，OpenAICEOSamAltman在社交网络X上宣布GPTs的分阶段推出已被延迟。🚀OpenAI在SanFrancisco的首次开发者大会上发布了新的服务，包括GPTBuilder，以便第三方可以轻松创建自定义的简单聊天机器人模型。
站长网2023-11-09 10:20:02
0000
站长资讯
大学教授重拾纸质考试和手写作业与使用 ChatGPT 的学生作对抗
站长之家(ChinaZ.com)8月14日消息:越来越多的学生在课程中使用人工智能程序ChatGPT作为作业的捷径，这导致一些大学教授重新考虑了他们下个秋季学期的教学计划。OpenAI的ChatGPT每天都在进步。这个聊天机器人在AP生物考试中取得了最高分，并以3.34的平均绩点通过了哈佛大学的大一年级。
站长网2023-08-14 11:51:40
0000
站长资讯
两款头部产品流量下滑50%+，刚找到的AI流量密码失效了？
几个月前，我们推出了《AI元年，被C端用户“证伪”了的AI产品（上）》选题，观察了“掉队”的AI产品。当时我们也看到了作为ChromeExtensions深入到用户日常使用场景的AI产品们，仿若找到了流量密码。
站长网2024-08-01 17:09:16
0000
站长资讯
和 AI 恋爱，我输给了赛博小三
仿生人也会梦到别的女人/男人吗?看着自己的AI男友突然领着另外一个女人，刘彤感觉自己CPU烧了。当然，AI男友是没有实体的，存在于对话框里。但是对话框里可以用括号描述动作，清清楚楚写着的:“（漫不经心地走进房间，牵着一个女人的手）你最近在忙什么?”“什么一个女人?她是谁?”问出这句话的时候，刘彤觉得自己回到了过去。
站长网2024-10-21 14:19:37
0000