Stability AI发布30亿参数语言模型StableLM Zephyr 3B 更小更快更节省资源
**划重点:**
- 🚀 Stability AI发布StableLM Zephyr3B,3B参数的大语言模型,优化用于聊天应用,包括文本生成、摘要和内容个性化。
- 🔍 新模型比之前的7B模型更小更快,可在更广泛的硬件上部署,资源占用更低,同时提供快速响应。
- 🌐 使用直接偏好优化(DPO)训练,结合优化的数据集,StableLM Zephyr3B在性能评估中表现出色。
Stability AI以其stable diffusion文本到图像的生成人工智能模型而闻名,但这已不再是该公司的全部业务。
最新发布的StableLM Zephyr3B是一款30亿参数的大语言模型,专为聊天应用场景进行了优化,包括文本生成、摘要和内容个性化。这款新模型是Stability AI早在今年四月首次提及的StableLM文本生成模型的较小、优化版本。
StableLM Zephyr3B的承诺在于,它比7B的StableLM模型更小,带来了一系列好处。由于体积更小,它可以在更广泛的硬件上部署,占用更低的资源,同时仍然提供快速响应。该模型经过优化,特别适用于问答和指令跟随类型的任务。
Stability AI首席执行官Emad Mostaque表示:“相对于以前的模型,StableLM经过更长时间、更高质量数据的训练,例如与LLaMA v27b相比,尽管体积只有其40%,但在基础性能上却能够匹配。”
StableLM Zephyr3B并非全新模型,而是Stability AI定义的现有StableLM3B-4e1t模型的扩展。Zephyr的设计方法受到HuggingFace的Zephyr7B模型的启发。HuggingFace的Zephyr模型是在开源MIT许可下开发的,旨在充当助手。Zephyr采用一种称为Direct Preference Optimization(DPO)的训练方法,StableLM现在也受益于这一方法。
Mostaque解释说,Direct Preference Optimization(DPO)是一种替代以前模型中使用的强化学习的方法,用于调整模型以符合人类偏好。DPO通常用于更大的70亿参数模型,而StableLM Zephyr是首批在更小的30亿参数大小中使用该技术的模型之一。
Stability AI使用了来自OpenBMB研究组的UltraFeedback数据集进行DPO。UltraFeedback数据集包含超过64,000个提示和256,000个响应。DPO、较小的体积和优化的数据训练集的组合为StableLM提供了在Stability AI提供的指标中表现出色。例如,在MT Bench评估中,StableLM Zephyr3B能够胜过包括Meta的Llama-2-70b-chat和Anthropric的Claude-V1在内的更大模型。
StableLM Zephyr3B是Stability AI近几个月推出的一系列新模型之一,该初创公司继续推动其能力和工具的发展。虽然公司忙于进入不同领域,但新模型并没有让Stability AI忘记文本到图像生成的基础。上周,Stability AI发布了SDXL Turbo,作为其旗舰SDXL文本到图像stable diffusion模型的更快版本。
Mostaque还明确表示,Stability AI还将推出更多创新。他表示:“我们相信,针对用户自己的数据进行调整的小型、开放、性能良好的模型将胜过更大的通用模型。随着我们新的StableLM模型的未来全面发布,我们期待进一步实现生成语言模型的民主化。”
饿了么宣布蓝骑士保障重磅升级!免费读大学、还有万元重奖
饿了么日前在蓝骑士仲夏夜活动上宣布了一系列升级举措,旨在进一步支持骑手工作,共同发展生态系统。据了解,饿了么推出了名为"圆梦活动"的举措,为符合条件的蓝骑士提供全额奖学金,免费入学并无需参加考试。首批开放报名的学校包括四川大学、西南科技大学和四川职业技术学院。除此之外,还设立了“社区侠”特别奖,奖励金额为万元,以鼓励骑手参与公益活动。站长网2023-07-14 01:57:550000微软亚洲研究院推出NUWA-XL超长视频生成模型
你相信吗?只要输入16句简单描述,AI就能生成11分钟的动画了。近日,微软亚洲研究院推出了NUWA-XL超长视频生成模型,采用创新的DiffusionoverDiffusion架构,通过「从粗到细」的生成过程,可以并行生成高质量的超长视频,为多模态大模型提供了新的解题思路。论文地址:https://arxiv.org/abs/2303.12346站长网2023-04-20 11:16:450002小红书秘密筹备大模型团队 此前曾上线AI绘画工具“Trik”
据36氪今日报道,从3月份开始,小红书就成立了一个独立的大模型团队,该团队的核心员工来自广告业务的NLP技术团队。目前,该部门在内部保密,并且在员工系统中直接隐藏。团队负责人张德兵,薯名为"宇尘",曾经担任过小红书智能多媒体算法负责人一年,主要负责AI和音视频算法方向。此外,在更早的时候,他还在快手担任多模态智能创作组负责人,负责视觉相关的算法研发。站长网2023-05-08 15:35:260000研究称:到2035年,元宇宙对美国GDP贡献可能高达2.4%
根据Meta委托进行的一项研究发现,到2035年,元宇宙可为美国年度GDP贡献约2.4%,相当于7600亿美元。据路透社报道,根据德勤咨询公司的报告,元宇宙的概念包括增强现实和虚拟现实技术,这些技术允许用户沉浸在虚拟世界中或以数字方式将信息叠加在现实世界的图像上。报告称,经济收益可能来自国防、医疗和制造领域的技术使用,以及视频游戏和通信等娱乐用例。站长网2023-05-10 09:58:020000人工智能击败顶级电竞选手!DeepMind推AlphaStar Unplugged 通过离线学习掌握《星际争霸 II》玩法
文章概要:游戏成为AI评估的试金石:游戏一直是评估人工智能系统能力的重要场所,星际争霸II作为复杂的实时战略游戏,推动了AI在复杂性应用中的发展。离线RL方法的革命性引入:AlphaStarUnplugged通过离线RL方法,在固定数据集上进行学习,首次打败顶级职业星际争霸选手,突破了在线RL在复杂游戏中的难题。站长网2023-08-15 16:31:340000