首页站长资讯Stability AI发布30亿参数语言模型StableLM Zephyr 3B 更小更快更节省资源

Stability AI发布30亿参数语言模型StableLM Zephyr 3B 更小更快更节省资源

站长网2023-12-08 10:32:381阅

**划重点:**

- 🚀 Stability AI发布StableLM Zephyr3B，3B参数的大语言模型，优化用于聊天应用，包括文本生成、摘要和内容个性化。

- 🔍 新模型比之前的7B模型更小更快，可在更广泛的硬件上部署，资源占用更低，同时提供快速响应。

- 🌐 使用直接偏好优化（DPO）训练，结合优化的数据集，StableLM Zephyr3B在性能评估中表现出色。

Stability AI以其stable diffusion文本到图像的生成人工智能模型而闻名，但这已不再是该公司的全部业务。

最新发布的StableLM Zephyr3B是一款30亿参数的大语言模型，专为聊天应用场景进行了优化，包括文本生成、摘要和内容个性化。这款新模型是Stability AI早在今年四月首次提及的StableLM文本生成模型的较小、优化版本。

StableLM Zephyr3B的承诺在于，它比7B的StableLM模型更小，带来了一系列好处。由于体积更小，它可以在更广泛的硬件上部署，占用更低的资源，同时仍然提供快速响应。该模型经过优化，特别适用于问答和指令跟随类型的任务。

Stability AI首席执行官Emad Mostaque表示:“相对于以前的模型，StableLM经过更长时间、更高质量数据的训练，例如与LLaMA v27b相比，尽管体积只有其40%，但在基础性能上却能够匹配。”

StableLM Zephyr3B并非全新模型，而是Stability AI定义的现有StableLM3B-4e1t模型的扩展。Zephyr的设计方法受到HuggingFace的Zephyr7B模型的启发。HuggingFace的Zephyr模型是在开源MIT许可下开发的，旨在充当助手。Zephyr采用一种称为Direct Preference Optimization（DPO）的训练方法，StableLM现在也受益于这一方法。

Mostaque解释说，Direct Preference Optimization（DPO）是一种替代以前模型中使用的强化学习的方法，用于调整模型以符合人类偏好。DPO通常用于更大的70亿参数模型，而StableLM Zephyr是首批在更小的30亿参数大小中使用该技术的模型之一。

Stability AI使用了来自OpenBMB研究组的UltraFeedback数据集进行DPO。UltraFeedback数据集包含超过64，000个提示和256，000个响应。DPO、较小的体积和优化的数据训练集的组合为StableLM提供了在Stability AI提供的指标中表现出色。例如，在MT Bench评估中，StableLM Zephyr3B能够胜过包括Meta的Llama-2-70b-chat和Anthropric的Claude-V1在内的更大模型。

StableLM Zephyr3B是Stability AI近几个月推出的一系列新模型之一，该初创公司继续推动其能力和工具的发展。虽然公司忙于进入不同领域，但新模型并没有让Stability AI忘记文本到图像生成的基础。上周，Stability AI发布了SDXL Turbo，作为其旗舰SDXL文本到图像stable diffusion模型的更快版本。

Mostaque还明确表示，Stability AI还将推出更多创新。他表示:“我们相信，针对用户自己的数据进行调整的小型、开放、性能良好的模型将胜过更大的通用模型。随着我们新的StableLM模型的未来全面发布，我们期待进一步实现生成语言模型的民主化。”

StabilityAI发布30亿参数语言模型StableLMZephyr3B 更小更快更节省资源

0001

评论列表

共(0)条

相关推荐

站长资讯
基于LLaMA!开源模型Giraffe将LLaMA上下文窗口扩大10倍达3万个token
文章概要:1.研究人员扩展了开源LLaMA模型的上下文窗口，创建了Giraffe，上下文窗口扩大10倍，达到约32，000个标记。2.Giraffe适合需要处理数十页文本的商业应用，为大上下文语言模型研究提供了重要见解。3.该研究还强调了当前技术的局限性以及定制测试的必要性，当前不足以衡量长上下文表现，需要定制测试。
站长网2023-08-26 16:14:33
0003
站长资讯
OpenAI联合创始人：GPT-4性能在 “有限的数据量” 下面临挑战
划重点:🔹OpenAI的JohnSchulman对GPT-4的性能进行了评估，指出其面临有限训练数据的挑战。🔹Schulman提到了GPT-4在不同类型的预训练数据上泛化的挑战，以及大型模型在使用较少数据量时的效率优势。🔹OpenAICEOSamAltman的言论和公司对人工智能发展的雄心也是该报道的重要内容。
站长网2024-05-16 17:24:06
0000
华为P70系列相机规格大升级：标配长焦潜望镜首发玻塑混合镜头
快科技12月3日消息，近日，天风国际证券分析师郭明錤发文爆料称，华为新款P70系列将持续带动2024年高端手机相机规格升级。预计，华为将在2024年上半年推出新款旗舰P70系列，包括P70、P70Pro、P70Art三款机型。他表示，P70系列的相机规格最大卖点如下：1、采用长焦潜望镜，P70为5P镜头（1/3.6英寸），P70Pro与P70Art均为6P镜头（1/2.5英寸）。
站长网站长资讯2023-12-03 09:53:17
0000
站长资讯
AI设计工具Stockimg.ai 可生成海报、徽标等高质量素材图片
StockimgAI是一款基于人工智能技术的图片生成工具，旨在为团队提供便捷的设计解决方案。无论是需要生成AI徽标、AI书籍封面、AI海报等，StockimgAI都能轻松满足您的需求。节省时间和金钱，提高设计流程效率。
站长网2023-10-24 23:23:16
0002
站长资讯
单月涨粉300万，短剧“带飞”剧情号
剧情号达人正在靠短剧疯狂吸粉。新榜编辑部观察到，随着爽文式小程序短剧的爆红，越来越多剧情号达人玩起“短剧梗”，用“穿越”到短剧中的人物视角，还原普通人对离谱剧情的反应，把荒诞与现实的碰撞拍成了段子。比如，“七颗猩猩”近期更新了12集《重生之我在爽剧当演员》系列视频，演绎了保姆、助理等短剧配角的心理活动，其中6条视频获赞超百万。
站长网2024-03-25 19:12:19
0000