Silo AI面向欧洲推新开源语言模型“Poro” 涵盖欧盟24种语言
**划重点:**
1. 🚀 Silo AI总部位于芬兰赫尔辛基,推出Poro,旨在提升欧洲语言的多语言人工智能能力。
2. 🤖 Poro是首个计划覆盖欧盟所有24种官方语言的开源模型,由Silo AI的SiloGen和图尔库大学的TurkuNLP研究小组开发。
3. 🌍 Poro使用跨语言训练方法,利用来自高资源语言(如英语)的数据,旨在解决为欧洲低资源语言训练性能卓越的核心挑战。
芬兰赫尔辛基的人工智能初创公司Silo AI本周发布了Poro,这是一个旨在提升欧洲语言多语言人工智能能力的新开源大型语言模型(LLM)。Poro是计划中的首个开源模型,旨在最终涵盖欧盟所有24种官方语言。这些模型由Silo AI的SiloGen生成人工智能部门和图尔库大学的TurkuNLP研究小组共同开发。
Silo AI的首席执行官Peter Sarlin在接受VentureBeat采访时表示:“这是数字主权的问题,你希望确保有模型捕捉到价值基础、文化和语言。最终,这是关于价值创造,确保不仅欧洲,而且任何公司都能创造价值,能够创建在欧洲内部和在组织内部保持的专有模型。”
Poro34B模型拥有34.2亿参数,以芬兰语中“驯鹿(reindeer)”一词命名,采用BLOOM变压器架构和ALiBi嵌入。它在覆盖英语、芬兰语以及编程语言如Python和Java的21万亿标记多语言数据集的分区上进行训练。Poro目前正在芬兰卡亚尼的LUMI,欧洲最快的超级计算机上进行训练,该计算机提供了512个AMD Instinct MI250X GPU,能够提供74拍千亿次的计算能力。
Sarlin表示,Poro的设计目的是解决为欧洲低资源语言(如芬兰语)训练性能卓越的核心挑战。通过利用跨语言训练方法,模型能够利用来自高资源语言(如英语)的数据。
作为对透明度的承诺的一部分,SiloGen将通过Poro Research Checkpoints计划记录Poro的训练进展。Sarlin解释说:“我们将在模型训练的各个阶段发布检查点,这是相当新颖的做法。目前还没有类似的倡议提供如此透明的模型训练信息。”根据Silo AI发布的基准数据,Poro在仅完成30%的训练时就取得了最先进的结果。
Sarlin相信像Poro这样的开源模型代表了人工智能的未来,为主要科技公司封闭的模型提供了透明和道德的替代方案。他说:“我个人认为最终会有很多开源替代品。未来最安全的道路是实际上走向开源,并完全了解这些模型是如何构建的以及架构是什么。”
Silo AI计划在整个训练过程中继续发布定期的Poro检查点。最终目标是创建一整套覆盖所有欧洲语言的开源模型家族。如果初步结果有任何迹象,Poro可能很快将对大科技公司构成竞争压力。
Poro代表了Silo AI与芬兰图尔库大学之间持续合作的一部分。该合作将Silo AI的应用人工智能专业知识和计算资源与图尔库大学在多语言语言建模研究方面的领导力相结合。Sarlin表示,这代表了行业和学术界如何共同推动人工智能能力发展,特别是对于低资源的欧洲语言。
Poro的发布标志着自然语言处理领域开放协作和透明度的新时代。Poro Research Checkpoints等倡议为整个社区提供了先前被科技巨头封锁的工具和见解的访问途径。Sarlin说:“我们与安联、劳斯莱斯、本田、飞利浦等大型品牌合作。我们听说这些大型企业对最终的法规会是什么样子以及他们可以使用哪些模型非常关切。”
如果Poro兑现其承诺,它可能使人们能够以民主的方式访问性能卓越的多语言模型,为欧洲提供了一个与美国科技公司系统相抗衡的本土替代方案。尽管仍处于早期阶段,但Poro在将语言人工智能从专有领域引入开源方面代表着一个重要的里程碑。
无网也能双向通话!小米15即将升级星辰无网通
快科技12月2日消息,小米澎湃OS官微预告,小米15系列星辰无网通功能将在本月推送。据悉,星辰无网通是小米星辰通信系统”内的功能之一,利用该无网通信功能,可以支持在最大半径3.5公里内的双向通话(不同环境下通话距离存在差异)。0000微软CEO纳德拉谈GPT-4:实现童年梦想,引领人工智能未来
近日,微软首席执行官萨蒂亚・纳德拉(SatyaNadella)在接受《连线》杂志的史蒂文・利维(StevenLevy)采访时,谈到了微软的人工智能计划以及他对生成式AI的看法。纳德拉表示,OpenAI的GPT-4帮助他们实现了童年梦想。站长网2023-06-17 23:47:300003董宇辉在永乐宫拍摄壁画引质疑 官方:经审批可拍
站长之家(ChinaZ.com)6月17日消息:近日,知名网红董宇辉在其直播中走进山西永乐宫,向观众介绍了这座历史悠久的道教宫观内的精美壁画。然而,这一行为却引发了网友的质疑和关注,因为永乐宫有规定禁止游客在殿内拍照摄像。对此,山西省永乐宫壁画保护研究院于6月16日发布了相关管理说明,对董宇辉在殿内拍摄直播一事进行了回应。站长网2024-06-17 11:41:430000吉比特:已开始实际应用AIGC技术 可提高游戏研发效率
吉比特在接受机构调研时表示,目前AI相关工具已经在实际工作中发挥了帮助作用。美术人员可以利用AI作画工具快速构造一些素材,然后根据素材进行创作;策划人员也可以使用AI作画工具快速构建原型,使美术人员更好地理解他们的意图,降低沟通成本。类似ChatGPT这样自然语言生成内容的工具也被应用于策划设计工作中,有效提高了生产效率。同时也在研究AI如何控制游戏角色,并探索其在产品中的实际应用。站长网2023-05-08 15:57:160000斯坦福大学研究人员发布新机器学习方法C3PO:根据上下文定制大型语言模型
划重点:1.C3PO是斯坦福大学研究人员推出的一种全新的机器学习方法,用于定制大型语言模型,使其能够根据上下文进行个性化适应。2.C3PO方法采用情境化批评(C3PO)策略微调语言模型,以在相关环境中应用反馈,同时避免过度泛化,确保模型在不同环境中表现稳健。3.该方法利用直接偏好优化(DPO)和监督微调(SFT)损失来调整模型,保持模型性能并避免不相关提示的负面影响。站长网2024-02-28 10:28:540000