腾讯披露最新大模型训练方法:Angel框架升级 效率提升2.6倍
要点:
腾讯披露混元大模型训练方法,Angel框架升级,大模型训练效率提升至2.6倍,千亿级大模型训练可节省50%算力成本。
AngelPTM机器学习训练框架通过多维度并行优化存储,在通讯方面采用软硬件结合解决方案,提高大模型训练稳定性。
腾讯推出大模型推理框架AngelHCF,通过扩展并行能力和关键能力优化,相较于主流框架,推理速度提高了1.3倍。
在当前大模型参数规模呈指数级增长的情况下,腾讯近日披露了混元大模型训练的最新方法,通过升级自研机器学习框架Angel,成功提升大模型训练效率。这一升级使得千亿级大模型训练可以节省高达50%的算力成本,为应对算力紧缺提供了有力支持。Angel框架的升级不仅仅在于提高效率,还支持单任务万卡级别超大规模训练,进一步提升了腾讯云HCC大模型专属算力集群的性能和效率。
图源备注:图片由AI生成,图片授权服务商Midjourney
为了进一步提高大模型的训练和推理效率,腾讯自研了机器学习训练框架AngelPTM。在存储方面,AngelPTM采用多维度的并行计算,包括数据并行、模型并行、流水并行和序列并行。
此外,通过在ZeRO-Cache的基础上引入统一视角技术,将显存和主存打通,有效扩展了显存容量,提升了单机存储容量达90%。在通讯方面,腾讯通过软硬件结合的方式解决,构建了3.2T RDMA网络来拓宽带宽,同时在框架软件层面做GPU拓扑感知,实现了负载均衡的流水并行。为了确保稳定性,腾讯对基础设施的网络、硬件、存储、云原生调度都进行了监控,并实施了自动续训和系统容错。
此外,为解决推理成本不断上升的问题,腾讯推出了大模型推理框架AngelHCF。通过扩展并行能力和关键能力的优化,包括Embedding共享、Attention算子优化、Paged Attention优化等方式,提高了推理性能,相较于主流框架,AngelHCF的推理速度提高了1.3倍。这一框架在腾讯混元大模型文生图的应用中,将推理耗时从原本的10秒缩短至3至4秒。
腾讯不仅仅在大模型训练方面取得了显著的效率提升,还在推理阶段取得了实质性的优化。这一系列技术提升已经在腾讯云上得以开放,为用户提供更优的训练和推理加速能力,同时支持客户一站式训练精调,打造专属智能应用。腾讯内部已有超过300项业务和应用场景接入腾讯混元大模型内测,涵盖了文本总结、摘要、创作、翻译、代码等多个领域,这标志着整个生产链路的全面升级,从模型研发到应用落地形成了一站式的平台,进一步推动了大模型应用的发展。
AI音乐生成器Beatoven.ai:适用于生成视频、播客和游戏背景音乐
**划重点:**1.🌐利用AI轻松生成适用于视频、播客和游戏的免费背景音乐。2.🎨创作者可选择音乐风格、剪辑内容,并在16种心情中选择,通过一键生成独特音轨。3.🚀应用广泛,适用于制作广告、YouTube、播客、游戏等多种创作场景。站长网2024-01-22 14:26:540000法拉第未来面临退市危险,贾跃亭、陈雪峰降薪买股票
凤凰网科技讯北京时间9月22日,贾跃亭创建的电动汽车公司法拉第未来周四宣布,多名公司高管已自愿签署了降薪和股票购买协议计划,其中包括创始人贾跃亭和新任CEO马提亚斯艾德特(MatthiasAydt)、现任CEO陈雪峰。站长网2023-09-22 09:18:040000独立开发变现周刊(第96期):一个课程学习网站,月收入2.6万美元
目录1、TTime:一款开源简洁截图、划词翻译软件2、Memberstack:轻松在你的网站上集成会员服务3、web-check:一站式全面了解分析网站4、ShortGPT:一款开源强大的视频创建框架5、一个后端课程学习网站,月收入2.6万美元1、TTime:一款开源简洁截图、划词翻译软件站长网2023-07-21 16:46:440000文本生成高清、连贯视频,谷歌推出时空扩散模型
谷歌研究人员推出了创新性文本生成视频模型——Lumiere。与传统模型不同的是,Lumiere采用了一种时空扩散(Space-time)U-Net架构,可以在单次推理中生成整个视频的所有时间段,能明显增强生成视频的动作连贯性,并大幅度提升时间的一致性。站长网2024-01-30 09:26:230000小米汽车三名员工未经许可参与研讨会被辞退
小米公司近日发布声明,针对小米汽车相关的恶意泄密和谣言采取法律行动。声明中指出,媒体“ZAKER”员工包某某和“小白买车”员工关某某未经许可有意泄露了保密拍摄内容。小米公司表示将追究两人及所属媒体的泄密责任,包括公开道歉、罚金等措施。站长网2023-12-20 08:58:140000