DeepSparse:利用稀疏性加速神经网络推理
站长网2023-10-26 12:02:070阅
DeepSparse是一种突破性的CPU推理运行时,采用了复杂的稀疏性技术,从而实现了神经网络推理的加速。稀疏性是指神经网络中存在许多连接权重为零的情况。
DeepSparse充分利用了这些零权重的连接,以跳过不必要的计算,从而有效地提高了推理速度。作为一个开源项目,DeepSparse的代码库可以在GitHub上找到。

项目地址:https://github.com/neuralmagic/deepsparse
目前,DeepSparse已经成功集成到了TensorFlow中,并成为了TensorFlow不可或缺的一个组件。
最新的DeepSparse LLM支持以稀疏内核进行加速,实现从非结构化稀疏权重中的速度提升和内存节省,同时支持8位权重和激活量化以及高效使用缓存的注意力键和值,从而减少内存移动。不仅如此,DeepSparse还支持多种计算机视觉和自然语言处理模型,包括BERT、ViT、ResNet、YOLOv5/8等等。
核心功能:
稀疏性加速: DeepSparse使用稀疏性来加速神经网络推理,从而提高性能。
LLM支持: 支持性能卓越的LLM推理,包括稀疏内核、8位权重和激活量化,以及缓存注意力键和值的高效使用。
模型优化: 与SparseML合作,DeepSparse可以进行模型修剪和量化,以优化神经网络模型。
多种模型支持: 支持多种计算机视觉和自然语言处理模型,适用于各种任务。
多层次API: 提供引擎、管道和服务器等多层次的API,以满足不同应用场景的需求。
0000
评论列表
共(0)条相关推荐
三星电子在「2023 三星晶圆代工论坛」公布 AI 时代的代工愿景
在日前加州硅谷举办的「2023三星晶圆代工论坛」上,三星发布了瞄准人工智能时代的最尖端晶圆代工流程路线图,并宣布将以最高新的半导体技术引领人工智能时代。在主旨演讲中,三星电子晶圆代工业务部门社长崔时荣表示,客户公司正在积极开发人工智能专用芯片。为引领人工智能技术模式的变化,三星电子将采用最优化的全环绕栅极(GAA)晶体管技术创新。站长网2023-06-29 15:45:570001小米双11战报公布:全渠道支付金额破224亿元 创历年大促新纪录
快科技11月12日消息,据小米公司官微消息,小米公布了双11销售业绩。截至2023年11月11日23:59:59,小米双11全渠道支付金额破224亿元,创历年大促新纪录。值得注意的是,在这个双11期间,小米14获四大平台国产手机冠军,销量爆火。站长网2023-11-12 10:15:050000MIT微软证实GPT-4具备自我纠错能力 较弱的模型则没有这种能力
最近,麻省理工学院(MIT)和微软的研究学者发现,GPT-4在自修复方面表现出了有效能力,而GPT-3.5则没有。此外,GPT-4还能够对GPT-3.5生成的代码提供反馈。大型语言模型(LLM)已经被证明可以从自然语言中生成代码片段,但在应对复杂的编码挑战,例如专业竞赛和软件工程专业面试时,仍然面临巨大挑战。最近的研究试图通过自修复来提高模型的编码性能,自修复是指模型反思并纠正自身代码中的错误。站长网2023-07-05 19:13:320001腾讯,游戏行业的「体验服」?
对腾讯游戏的质疑,总是时不时被捡起:错过二次元、错过开放世界……腾讯游戏是不是在几个新机会点上都慢人一步?他们到底把重点放在了哪里?其实对腾讯这种体量的厂商来说,想要回答这个问题,不能只看已经明牌的产品。站长网2023-11-14 18:13:500001微软把DALL-E 3集成到键盘,任何APP中都可生图!
微软发福利,DALL-E3可以和手机键盘绑定了!键盘区秒变生图区,在任何APP中都能使用。看,这是X(原Twitter),在键盘上输入提示词:点击Create等上几秒,DALL-E3生成的图片直接嵌入键盘中:然后就能点击任意图片发送出去:使用到的神器名为MicrosoftSwiftkey,是微软旗下的一款输入法,已集成了NewBing,这也是能够使用DALL-E3的关键。0001