马毅教授CRATE-α模型首次证实白盒Transformer可扩展性
马毅教授团队最近取得了显著的研究成果,他们开发的CRATE-α模型首次证实了白盒Transformer架构的可扩展性。这一进展对于自然语言处理(NLP)、图像处理和视觉计算领域的深度表征学习具有重要意义。
尽管Transformer架构及其变体在AI领域取得了巨大成功,但它们大多基于经验设计,缺乏严格的数学解释。CRATE模型通过数学推导得到每一层,提供了更好的可解释性。不过,CRATE的应用规模之前相对有限,与Vision Transformer的参数量相比有较大差距。

为了解决这一问题,研究团队提出了CRATE-α,它对稀疏编码块进行了策略性但最小化的修改,并设计了轻量级的训练方法,有效提高了CRATE的可扩展性。实验结果显示,CRATE-α的性能随着模型尺寸和训练数据集的增大而持续提升。在ImageNet分类任务上,CRATE-α-B和CRATE-α-L的准确率显著提高,同时保持了CRATE模型的可解释性。
研究人员使用了ImageNet-21K和ImageNet-1K数据集进行训练和微调,证明了CRATE-α在不同像素块大小下的性能。此外,他们还采用了多模态数据集DataComp1B,包含14亿图文对,通过对比学习的方法训练CRATE-α,并使用优化的CLIPA协议减少计算资源消耗。
CRATE-α模型的可扩展性通过在ImageNet-1K数据集上的零样本学习评估得到了证明,这为衡量模型的泛化能力提供了重要指标。研究人员还发现了节省计算资源的扩展策略,通过调整预训练阶段的图像token序列长度,在减少计算资源消耗的同时,保持了模型性能。
CRATE-α的语义可解释性也得到了提升,使用MaskCut评估模型捕获的丰富语义信息,CRATE-α在目标检测和分割方面比现有模型有所提高。这些研究成果不仅推动了Transformer模型的发展,也为未来的研究和应用开辟了新的道路。
论文:https://arxiv.org/pdf/2405.20299
项目地址:https://rayjryang.github.io/CRATE-alpha/
谷歌和微软联手培养AI未来:推出面向初学者的入门课程
要点:谷歌和微软近期发布了针对初学者的人工智能(AI)入门课程,分别与RaspberryPi基金会和OpenAI合作,致力于从儿童时期培养对AI的兴趣和理解。谷歌的课程名为「ExperienceAI」,与RaspberryPi基金会合作,面向11-14岁的学生,通过实际案例和互动课程传授基本的AI知识,包括模型分类和对数据集偏见的认知。站长网2023-11-27 14:22:430001不用二选一了!消息称微信将登陆纯血鸿蒙:有用户收到回访电话
快科技7月23日消息,据国内媒体报道称,微信适配鸿蒙系统成果越来越近了,有用户近日已经收到了相关通知。报道中提到,有HarmonyOSNEXT测试用户自称接到了华为终端回访的电话,对方询问NEXT使用体验,问有没有当主力机以及为什么还不能当主力机的原因。站长网2024-07-23 10:30:510001网易云会员上热搜 官方回应:错误发放的年卡将被收回
12月4日,网易云音乐旗舰店在淘宝上的积分兑换黑胶VIP月卡活动出现了系统错误,导致许多用户兑换到的会员天数是错误的。“网易云会员”也因此登上了微博热搜。网易云音乐在随后发布的《淘宝积分兑换会员问题公告》中表示,由于淘宝积分兑换网易云音乐会员活动正在升级维护中,活动暂时下线,上线时间以实际页面显示为准。站长网2023-12-04 16:57:100000Portkey AI Gateway:一个连接多种人工智能模型的开源工具
PortkeyAIGateway是一个开源工具,旨在连接多种人工智能模型。该工具允许开发者通过简单的API接口访问超过100种不同的大语言模型,包括OpenAI、Anthropic、Mistral、LLama2、Anyscale、GoogleGemini等。安装体积只有45kb,但处理速度提升了9.9倍,同时可以在多个不同的AI模型中来回切换,并且可以根据需求进行灵活配置。站长网2024-01-16 12:50:240000英伟达提出爆火智能体研究Humanoid Agents 逼真还原人类情感
要点:1.英伟达、华盛顿大学等机构合作研究的HumanoidAgents能够逼真模拟人类情感和行为,包括满足基本需求、情感反应和人际关系。2.这种智能体引入了系统1思维的元素,使其更贴近人类行为,例如根据情感和需求调整活动,以及影响互动方式。站长网2023-10-16 14:27:330003