阿拉伯语版ChatGPT“Jais Chat”问世 性能堪比英语商业模型
站长网2023-09-04 10:12:240阅
文章概要:
1. Jais是面向阿拉伯语的开源大模型,参数量达130亿
2. 在阿拉伯语任务上,Jais性能可匹敌ChatGPT
3. Jais在Cerebras专用芯片上训练,具有技术创新
阿拉伯联合酋长国的研究人员利用Cerebras公司的专用AI芯片,开发出了两个开源的大规模语言模型Jais和Jais Chat。这是业界首个面向阿拉伯语的、参数规模超过100亿的开源语言模型。
Jais拥有130亿个参数,使用了3950亿个训练样本,其中1160亿个是阿拉伯语样本。主要使用阿拉伯语网站、书籍、新闻和维基百科作为训练数据,所有数据在训练前进行过滤。
Jais Chat则通过额外的对话训练进行了优化。这两个模型在一系列阿拉伯语任务上的测试精度,明显超过了现有的阿拉伯语开源模型,在某些写作任务上甚至可匹敌商业化的英语模型ChatGPT。
该团队表示,在基准测试中,Jais 和 Jais-chat 的准确度比现有的免费阿拉伯语模型高出11到15个点,并且在英语方面与 Meta 的 LLaMa2具有竞争力。OpenAI 的ChatGPT或 Anthropic 的Claude等商业模型在基准测试中平均仍然领先,但规模也明显更大。
另外,Jais的训练没有使用Nvidia的GPU,而是在Cerebras专用的Wafer级芯片上完成。这种芯片专为AI工作负载而设计,使Jais的训练实现了技术创新。Jais的开源发布有助于推动阿拉伯语自然语言处理的进步。
0000
评论列表
共(0)条相关推荐
小红书爆品的5个思路,3亿+品牌都在用!
小红最近有小伙伴经常问我,如果我现在做一个产品能够快速打爆一个市场,那我应该要具备的一些因素是什么?以下罗列的5个点供大家参考。我之前的一个学生,他在大概在两年前,听过我的内容以后,自己去尝试了,现在一年大概能够做到3500万的一个GMV。根据这个体量,以及他自己实验出来的一个结果,我希望接下来的这五个点对大家会有帮助。—1—颜值高——吸引人群的第一张封面站长网2023-05-09 16:00:030000又一位阿里合伙人隐退
还差3个月,俞永福在阿里本地生活集团的管理生涯就满三年了,但他的任期却戛然而止。3月1日,阿里集团CEO吴泳铭通过内部信的方式宣告,本地生活集团董事长兼饿了么CEO俞永福一个月后将正式卸任,转战eWTP基金。接下来,他会以合伙人的身份,支持阿里巴巴集团的国际化探索。0000微软CEO:下一代AI将重塑每个软件类别和每个企业
微软CEO萨提亚·纳德拉在年度公开信中表示,我们正进入一个新的人工智能时代,这项技术将从根本上改变每个组织、每个行业的生产力,并帮助人类应对一些最迫切的挑战。纳德拉认为,下一代人工智能将重塑每个软件类别和每个企业,微软也不例外。他表示,有两个关键突破定义了这个新的人工智能时代:自然语言界面和强大的推理引擎。站长网2023-11-03 10:32:240000一个只发布AI生成内容的网站长啥样?充斥着标题党、奇怪的照片
人工智能生成的内容正在互联网泛滥,甚至可能让网络世界变成一个错误堆积、难以理解的信息场。不过也有纯粹用AI生成的内容给人类带来不少乐子,TheEnlightenedMindset网站就是其中一个。站长网2023-06-16 14:38:550000AI前哨 | 对话百度肖阳:谁是中国第一搜索引擎?
凤凰网科技讯《AI前哨》5月29日消息,前几天,“百度已不是中国第一大桌面搜索引擎”话题被顶上微博热搜。根据美国研究机构Statcounter的最新统计数据,今年4月微软必应搜索国内搜索市场份额创历史新高,而百度搜索市场份额降至27.01%,排名跌到第二。0000