Human or Not游戏测试:三分之一的人分不清人和AI
站长网2023-06-01 16:16:440阅
日前,OpenAI 的竞争对手AI21Labs发布了一项名为“ Human or Not ”的网络游戏社交实验的结果,该游戏发现高达32% 的人无法区分人类和 AI 机器人。
该公司称这款游戏是迄今为止规模最大的图灵测试,它使用基于领先的大型语言模型 (LLM)(例如 OpenAI 的 GPT-4和 AI21Labs的Jurassic-2、最终分析了超过一百万次的对话和猜测。
结果令人诧异:一方面,测试表明,人们发现更容易识别对象是不是同类(即人类),参与者猜对率73% 。但在与机器人交谈时,参与者只猜对率只有60% 。
但除了这些数字之外,研究人员还指出,参与者使用了几种流行的方法和策略来确定他们是在与人交谈还是与机器人交谈。例如,他们假设机器人不会犯拼写错误、语法错误或使用俚语,而在游戏中的大多数模型都经过训练可以犯这些类型的错误并使用俚语。
参与者还经常问一些个人问题,例如“你来自哪里?”、“你在做什么?” 或“你叫什么名字?”,相信人工智能机器人不会有个人历史或背景,而且他们的回答将仅限于某些主题或提示。然而,机器人大多能够回答这些类型的问题,因为它们接受过很多个人故事的训练。
在两分钟的对话之后,用户被要求猜测他们一直在人还是机器人对话。经过一个多月的游戏和数百万次对话,结果表明32% 的人无法区分人类和人工智能。
些参与者认为,如果他们的讨论伙伴过于礼貌,他们可能是一个机器人。
0000
评论列表
共(0)条相关推荐
YouTube称只是减缓广告拦截器的使用 Firefox加载速度不受影响
据TheVerge报道,YouTube表示其不会减缓Firefox的速度,只是会减缓广告拦截器的使用。一些用户抱怨在Firefox上加载YouTube视频需要更长的时间,YouTube表示这是为了保持广告流畅而采取的措施。站长网2023-11-22 09:59:110000荷兰将立即实施《欧盟人工智能法案》 投资2.22亿美元
1月18日周四荷兰政府表示,将“立即”开始遵守欧洲具有里程碑意义的《人工智能法案》,荷兰已拨出2.045亿欧元(2.2207亿美元)用于促进当地对人工智能的投资。图源备注:图片由AI生成,图片授权服务商Midjourney这些公告是在一份文件中发布的,该文件概述了政府在防范风险的同时利用ChatGPT等生成式人工智能系统的战略。站长网2024-01-19 12:01:460000谷歌更新Android标志 采用3D机器人头部和新文字标记
2019年,谷歌宣布了其移动操作系统的新品牌标识。大约四年后,Android正在更新其徽标,使用新的文字标记和标志性机器人头部的3D版本。这个新单词标志的开头是大写的“A”,而Android多年来一直选择完全小写。这款新字体将“n”和“r”完美地圆润起来,回归了2008年的未来主义风格,并淡化了2014年的字体风格。站长网2023-06-28 15:42:590000“盗窃”而来的 3000 亿单词?ChatGPT 摊上事了,遭索赔 30 亿美元!
2016年10月19日,英国剑桥大学理论物理学教授StephenHawking曾预言:“强大AI的崛起,可能将是人类遇到的最好的事情,也可能是最坏的事情。”0002潞晨科技旗下Colossal-AI开源650亿参数大模型预训练方案
AI创业公司潞晨科技宣布,旗下Colossal-AI首个开源了650亿参数LLaMA低成本预训练方案。据介绍,相比业界其他主流选择,该预训练方案可提升预训练速度38%,仅需32张A100/A800即可使用,并且不限制商业使用。开源地址:https://github.com/hpcaitech/ColossalAI站长网2023-07-20 15:26:490000