苹果AIM自回归视觉模型验证性能与模型规模有关
要点:
1. 随着容量或预训练数据量的增加,模型性能不断提升。
2. 论文证实自回归训练对于图像模型学习表征能力具有扩展性。
3. 自回归目标足以满足视觉特征的训练要求,且没有饱和的迹象。
苹果公司的研究者通过自回归图像模型(AIM)验证了视觉模型“参数越多性能越强”的规律,进一步证明随着容量或预训练数据量的增加,模型能不断提升性能。AIM能有效利用大量未经整理的图像数据,训练方法和稳定性与最近的大型语言模型(LLM)类似。这一观察结果与之前关于扩展大型语言模型的研究结果是一致的。
虽然本文实验所使用的模型规模有限,还需进一步探索是否能在更大参数量级的模型上验证此规律。研究者使用的预训练目标遵循应用于图像 patch 序列的标准自回归模型,通过一系列实验和研究,验证了模型容量可以轻松扩展到数十亿个参数,同时对下游任务有很好的性能。
项目地址:https://top.aibase.com/tool/aim
此外,研究者对自回归目标训练 ViT 模型的多方面进行了探讨,并且重新审视了之前的工作。研究者的实验报告显示,在整个训练过程中,优化目标直接带来更好的下游性能,而随着模型容量的增加,损失值和下游任务的准确性都有所提高。这一观察结果与在 LLMs 中观察到的趋势一致,反映了优化目标会直接带来更好的下游性能。
在 AIM 的设计参数中,除了扩展宽度,研究者还特别采用了一种简单设计,使用多层感知机块,独立地对每个 patch 进行处理。研究者同时强调,研究的模型规模有限,对更大参数量级的模型上验证此规律还有待进一步探索。
论文的实验结果证明了视觉模型同样遵循「参数越多性能越强」的规律,自回归训练对图像模型具有很好的扩展性,并能够满足视觉特征的训练要求。对未来图像模型性能提升和优化提供了新的研究方向和思路。
立方数科推出AI模型训练平台立方PAI
近日,由立方数科自主研发的立方云PAI经国家版权局审核,符合《计算机软件保护条例》和《计算机软件著作权登记办法》的相关规定,认定为原始取得,成功获得《计算机软件著作权登记证书》。立方PAI提供完整的人工智能模型训练和资源管理能力平台,易于扩展,支持各种规模的on-premise、on-cloud和混合环境,并且提供诸多AI用户友好功能,使最终用户和管理员更容易完成日常的AI任务。站长网2023-07-15 01:59:000001售价2.5万元!只有150多个应用适配了苹果Vision Pro
快科技1月23日消息,据媒体报道,市场机构Appfigures公布的数据显示,目前有150多个应用对苹果VisionPro进行了适配。理论上iPadOS应用都能支持VisionPro,但开发者拥有权限,可以选择自己的应用不支持VisionPro。0000快手治理作弊搬运行为 7月处罚违规账号400余个
快手发布《关于作弊搬运行为的处罚公告》称,近期,平台在巡检中发现,部分账号存在“借助作弊搬运手段,不当获取平台流量”的行为,此类行为与平台鼓励原创理念相悖。针对此类违规行为,平台开展了专项治理。2023年7月,平台已处罚违规账号400余个。快手称,违规行为包含但不限于以下类型:1、将搬运的他人视频与自己视频拼接,以达成变现目的;站长网2023-08-04 08:32:130000数字人直播热度未减,真人模仿AI也火了!
近年来,AI技术高速发展,以数字人直播为代表的AIGC相关话题热度一直高居不下。而另一边,真人模仿AI的视频和直播近期也在短视频平台上刷屏,悄悄走红。达人@Barbin.ili芭比是一位舞蹈博主,11月25日,她发布了一条在西湖边模仿芭比娃娃跳舞的视频,浓厚的AI气息不仅在西湖吸引了很多游客驻足观看,也在抖音上爆火,获赞596万,评论32万。图片来自抖音站长网2023-12-07 18:10:170004品牌如何有效接住小红书的搜索流量?
和美国搜索市场谷歌一家独大近乎垄断不同,中国搜索市场在客观上更加分散,产品形态的多样性让搜索这件事被不同的细分产品占据着各自的心智。小红书经过多年的沉淀,今天已经在某种程度上已经成为一个重要的“生活决策搜索入口”。对于品牌和商家而言,"遇事不决小红书"强心智的背后,其实蕴藏着规模巨大的、未被充分挖掘的商业价值和结构化红利。站长网2024-01-23 09:17:500000