
编者按:本文来自微信大众号“大数据文摘”(ID:BigDataDigest),编译 啤酒泡泡、橡树_Hiangsug,36氪经授权发布。
一只名叫亚里士多德的人工智能刚刚经过了美国八年级的科学检验,上星期,这条新闻占有了美国多家新闻网站的首版。
美国八年级大约相当于国内初二,初二小朋友的科学检验有多难呢?
要答复这个问题,咱们先来一同看两道美国八年级的科学检验多选题。
1、人体中能够协同完结某一项详细机能的安排被称为:
A.an organ
B.an organism
C.a system
D.a cell
2、以下哪一种改变最有或许导致某一区域的松鼠数量削减?
A.捕食者的数量削减
B.松鼠内部的竞赛削减
C.可获取的食物削减
D.森林火灾数量的添加
很显然,这两道题分属两类不同类型。第一题归于常识点题,只需仔细背过就能答得上来;第二道则归于逻辑推理题。
大都小朋友或许更乐意答复第二题这种逻辑揣度的标题,但关于人工智能来说,状况或许恰恰相反。
人工智能做八年级卷子,挑选题正确率超90%
上星期三,坐落于西雅图的闻名实验室“艾伦人工智能研究所”全新发布了一款名为“亚里士多德(Aristo)“的人工智能体系,它正确地答复了逾越90%的八年级的科学检验题,并在十二年级的考试中获得了80%以上的准确率。
这款能够经过检验才干的人工智能标明,研究人员在几个月中便获得了巨大的开展,人工智能体系能够了解言语并能模仿人类的决议计划逻辑。
Aristo的设定是只用来作答多项挑选题。它参加了几场纽约考生的规范考试,只不过艾伦研究所去除了那些包含图片和图表的标题,答复这些问题需求额定的技能——将言语了解和计算机视觉逻辑相结合的才干。
有些检验问题只需求一些信息提取的才干,比方上文中的第一题,这种标题是人工智能拿手的。
可是科学检验不是那种只靠记住规矩就能完结的作业,它需求运用逻辑来树立联络。比方第二题,森林火灾数量的添加会直接导致松鼠的逝世,或食物来历的削减使它们无法繁殖。人工智能需求了解这样的逻辑,才干答复正确这道标题。
其实在Aristo成功之前,AI现已挂过无数次科。
2016年,700多名计算机科学家参加了一场设有80,000美金(折合人民币约57万元)的挑战赛,标题是“八年级科学检验”——不过答题人不是这些科学家,而是他们树立的人工智能体系。
作用出人意料,考生全盘“挂科”,就连最老练的人工智能体系都无法答对超60%的标题,其言语水平缓逻辑水平远远赶不上八年级的学生。
学霸Aristo的背面是Bert
2016年,当AlphaGo打败人类作业围棋选手李世石后,许多人以为人工智能的转折点降临。
可是,华盛顿大学前教授、现任艾伦人工智能研究所的技能总监的Oren Etzioni博士的振奋之情很快停息了。他说,人工智能并没有它看上去那么先进。他提到了艾伦研究所之前参加的那场竞赛,一个八年级的科学检验就难住了人工智能体系。
艾伦研究所敏捷改进了之前的作业,着手于打造Aristo,其速度超出了包含Etzioni博士在内的许多专家的预期。
Aristo的应试才干来自于神经网络,近几年以来,国际顶尖的人工智能实验室,如Google,Facebook等企业的实验室都使用神经网络进行自然言语处理(NLP),它能够经过剖析人类的文章和书本来习得言语的杂乱改变。
上一年年末,谷歌AI团队发布了BERT模型,在机器阅览了解尖端水平检验SQuAD1.1中表现出惊人的作用:悉数两个衡量指标上全面逾越人类,而且还在11种不同NLP检验中创出最佳作用,包含将GLUE基准推至80.4%,MultiNLI准确度到达86.7%等。
BERT的全称是Bidirectional Encoder Representation from Transformers,即双向Transformer的Encoder,模型的首要立异点在于模型的预练习,用Masked LM和Next Sentence Prediction两种办法别离捕捉句子的表述。
Bert模型架构
Etzioni博士很快就意识到,能够在Bert根底之上树立Aristo体系,他们使用Bert模型对覆盖面极广的问题和答案数据进行练习。
Aristo依据标题的不同类型采用了八种类型的agent来答复问题——包含数据库中查找答案的agent、查看相关概念列表的agent、履行定性推理的agent等。
每个agent都会对多项挑选答案发生正确与否的概率,而Aristo会对不同的选项的概率进行加权以挑选最或许的一项或多项,该模型经过多轮练习和校准进行优化。
例如,有一个问题是:当块体熔化时,铁块中的铁原子是怎么受到影响的?
A.铁原子添加质量。
B.铁原子含有较少的能量。
C.铁原子移动得更频频。
D.铁原子体积添加。
为了答复这个问题,Aristo先查找出“铁原子跟着热量添加而运动加速”的常识,将术语“消融”与“热量”联络起来,将术语“快”与“频频”联络起来,并将C评定为正确挑选。
结合不同的处理问题的办法为Aristo将检验分数从2016年的大约60%提高到本年的91.6%扫清了路途。在12年级考试中,该模型得分率为83.5%。
Aristo不断提高的答题准确率
究竟是学霸仍是学渣?能用就好!
部分科学家对Aristo获得的开展并没有抱以太大热心,他们以为机器离彻底把握自然言语还有很长一段路要走,更不用说真实像一个人类学生那样考虑了。
“咱们不能拿这项技能和真实的学生以及他们的逻辑推理才干比较。”已在微软参加多项相似技能研制的研究员Jingjing Liu讲道。
Liu和她的微软搭档曾检验树立一个能够经过GRE考试的体系——GRE是美国研究生入学的必考检验。
Liu表明,处理言语部分是可行的,可是树立可用于处理数学问题的逻辑推理才干便是别的一回事了。“这实在是一项太有挑战性的作业了。”
但从商业视点来看,从互联网搜索引擎到医院的文档记载体系,Aristo的这一开展将对许多产品和服务发生广泛影响。
依据纽约时报的报导,Etzioni博士表明:“这项技能会带来重要的商业作用。现在我能自傲的说,你们将会看到这一开展带来的新一代产品,或许来自创业公司,也或许来自大公司。”
“这项技能仍处于初级阶段,”Fast.ai的技能总监Jeremy Howard说道,“可是其技能的潜能是无限的,咱们离充沛开掘这项技能的潜能还很悠远。”
OMT,Aristo也是艾伦研究所创始人的遗愿
艾伦研究所命名自微软的联合创始人保罗•艾伦(Paul Allen),他在2013年景立了艾伦人工智能研究所,期望能够着手处理人工智能开展的重大问题。
把“八年级科学检验”作为标题的人工智能科学挑战赛,其实源自于这位西雅图亿万富翁的一个私心:他期望研究人员规划出一个满足聪明、能够经过八年级科学考试的人工智能程序。
自创建后,艾伦研究所的研究人员便一向致力于制作这只聪明的人工智能程序——Aristo。
这不是一件简单的事,五年来研究者们检验了无数次,可是一向没有到达艾伦期望的作用。
可是上一年10月份,还没有来得及见证Aristo的诞生,享年65岁的艾伦逝世了。
在不同的电子邮件中,Aristo的作者Etzioni和Clark都对保罗·艾伦表明了敬意。当被问到这样的体系艾伦是否就能够满足的时分,两人都表明:“不会。”
Etzioni和Clark在艾伦人工智能研究所
“保罗会非常高兴,但不会让咱们满足于现有的荣誉,”Etzioni说, “他会问:NLP的下一个重要阶段是什么?”
“我能够幻想他会说‘祝贺你!但下一步是什么?”
相关报导:
https:///2019/09/04/technology/artificial-intelligence-aristo-passed-test.html
https:///2019/allen-institutes-aristo-ai-program-finally-passes-8th-grade-science-test/



