阿拉伯语版ChatGPT“Jais Chat”问世 性能堪比英语商业模型
站长网2023-09-04 10:12:240阅
文章概要:
1. Jais是面向阿拉伯语的开源大模型,参数量达130亿
2. 在阿拉伯语任务上,Jais性能可匹敌ChatGPT
3. Jais在Cerebras专用芯片上训练,具有技术创新
阿拉伯联合酋长国的研究人员利用Cerebras公司的专用AI芯片,开发出了两个开源的大规模语言模型Jais和Jais Chat。这是业界首个面向阿拉伯语的、参数规模超过100亿的开源语言模型。
Jais拥有130亿个参数,使用了3950亿个训练样本,其中1160亿个是阿拉伯语样本。主要使用阿拉伯语网站、书籍、新闻和维基百科作为训练数据,所有数据在训练前进行过滤。

Jais Chat则通过额外的对话训练进行了优化。这两个模型在一系列阿拉伯语任务上的测试精度,明显超过了现有的阿拉伯语开源模型,在某些写作任务上甚至可匹敌商业化的英语模型ChatGPT。
该团队表示,在基准测试中,Jais 和 Jais-chat 的准确度比现有的免费阿拉伯语模型高出11到15个点,并且在英语方面与 Meta 的 LLaMa2具有竞争力。OpenAI 的ChatGPT或 Anthropic 的Claude等商业模型在基准测试中平均仍然领先,但规模也明显更大。
另外,Jais的训练没有使用Nvidia的GPU,而是在Cerebras专用的Wafer级芯片上完成。这种芯片专为AI工作负载而设计,使Jais的训练实现了技术创新。Jais的开源发布有助于推动阿拉伯语自然语言处理的进步。
0000
评论列表
共(0)条相关推荐
为10万法律学生,提供类ChatGPT服务!「律商联讯」与美国律师协会合作
全球法律服务巨头「律商联讯」在官网宣布,从2024年春季学期开始,为美国律师协会(ABA)认证的10万名法学院的学生,提供类ChatGPT助手——LexisAI。ABA旗下的官方期刊,已经确认了该消息。这是全球第一个将生成式AI,大规模应用在学校的案例,同时也开创了教育界的历史,生成式AI产品开始进入课堂。站长网2023-12-27 09:10:060000AI可以识别香气了 利用神经网络让你“看见”气味
要点:利用图神经网络建立了分子结构与气味描述之间的首个映射该模型可以根据分子的化学结构预测气味描述这可能是实现气味数字化的重要一步,但要落实共享气味等可能性还需更多工作近日,研究人员利用一种称为图神经网络的深度学习算法,建立了一种模型,能够将化合物的结构映射到气味描述。该模型已成功预测人类小组如何描述新的气味,最终实现气味的数字化。这项工作发表在8月31日的《科学》杂志上。站长网2023-09-06 17:45:210000西班牙和法国宣布对 ChatGPT 展开调查 欧洲数据保护委员会成立专门工作组
西班牙国家数据保护局当地时间4月13日发表声明,称该机构已经正式对ChatGPT可能的违反法律行为展开初步调查程序。同时法国国家信息自由委员会(CNIL)也决定对ChatGPT提出5项指控,并展开调查。站长网2023-04-14 09:02:290000支付宝五福节启动:AR扫福字赢5亿现金红包
支付宝“欢天喜地五福节”活动于1月29日正式启动。在活动期间,用户只需集齐五福福卡,即可在2月9日22:18参与拼手气,有机会瓜分5亿现金红包。今年的五福活动引入了一些新的玩法。除了可以通过AR扫描任意福字、找福字、找能量、摇一摇、观看视频等方式来集齐五福,还增加了以下玩法:1.活动期间,用户有机会获得天天福卡和品牌福卡,并参与抽奖,赢取奖品。站长网2024-01-29 10:01:060000FF宣布重获纳斯达克上市合规计划 继续推进中东战略融资
今日,FaradayFuture(FF)宣布重获纳斯达克上市合规的计划。其董事会已批准一系列提案,其中包括实施公司普通股反向股票分割,该提案将在即将召开的年度股东大会上提交给股东审批。根据提案,现有公司已发行普通股和被授权普通股总数按1:2至1:40范围内的进行同比例反向分割授权。最终比例将在股东批准后由董事会决定,董事会有权选择放弃、延迟或推迟反向股票分割。站长网2024-06-25 15:18:360000