在花 100 天进修人工智能之后我得出这 5 个结论_人工智能_机械
我根据 Max Tegmark 的 Life 3.0 的第一章——The Tale of the Omega 画的
2019 年 1 月尾,我溘然意识到,我对人工智能的理解不敷。它正日益影响着我们的每一天。人工智能保护我们的收件箱免受垃圾邮件的攻击,它支持来自 Alexa 的景象更新,它使亚马逊能够向我们推举商品,让 Netflix 给我们推举电影。每次我们打开 twitter 或 facebook,都是人类与比我们更理解自己的人工智能的较劲。但我是一个专业的技能职员,却对人工智能的真正含义知之甚少。
《连线》杂志创办人 Kevin Kelly 在一个名为「未来思考者(Future Thinkers)」的播客上接管采访时,谈到过 AI 干系的话题。他认为,我们的人工智能技能还处于起步阶段,如果有人花一点韶光学习人工智能和机器学习,超越只是理解的水平,他们会创造自己只是一小部分人中的一部分。那天下班回家后,我开始了为期 100 天的「人工智能学习潜水」。
我将须要学习的所有东西都进行了分类。由于在职,很难找到业余韶光,但我确实在 100 天内完成了近 200 个小时的事情。我读了 9 本书,上了 2 门 Coursera 课程(已经开始学习第三门课),听了很多播客,看了尽可能多的赞助教程。
以下是我在那段韶光总结出的 5 个不雅观点:
1.人工智能是旧的也是新的
人工智能这个词并非出自某部科幻小说。1956 年,在达特茅斯学院的一个暑期研讨会上,许多聪明人聚拢在一起研究如何让机器思考。在这次聚会中产生了「人工智能」这个观点。虽然这次会议并没有研究出具有思维的机器人,但它带来的思想和技能仍旧是当今人工智能的根本。
研讨会之后,人们对人工智能的不同子领域的兴趣增强。神经网络彷佛很有出息,但在当时这项技能一片空缺,大多数研究终极放弃了这一观点。这个期间被称为「AI 寒冬」,它持续了几十年。然而,近年来,算力和可用数据的指数增长,加上深度学习的最新进展,极大地提高了机器学习的有效性。AI 被 Andrew Ng 等专家称为「新的电力(new electricity)」。
2.人工智能等同于机器学习,但它并不是闭幕者
「人工智能是用 powerpoint 完成的,机器学习是用 python 完成的(「AI is done in PowerPoint and machine learning in Python」)」
闭幕者,在盛行文化中是超智能的缩影
人工通用智能(Artificial General Intelligence,简称 AGI)是一种假想的机器,它的思维办法和人类一样, 比如闭幕者便是这种机器人。超智能是超越人类思维能力的机器(如果读过 Nick Bostrom 的 Superintelligence,你可能会有点害怕它),但在现在,还没有这样的事物涌现。到目前为止,AGI 只是一种抱负,它在未来,并且有点遥不可及。这并不虞味着没人在做这件事,这也不虞味着像 Max Tegmark 和 Ray Kurzweil 这样的聪明人不会广泛地评论辩论它并期待它。但目前人工智能的形式险些便是机器学习——一个 AI 的子领域。
机器学习的基本事理如下:
第一步:把一个问题变成一个预测问题。换句话说,给定输入参数(特色),预测结果。你可以预测一栋屋子的价格,或者是拍摄时给定的摄像位置。
第二步:定义算法或者系统,做出决策。这里有很多方法,如线性回归,神经网络,深度学习,支持向量机,递归神经网络,卷积神经网络,天生性对抗网络等等。每种算法都可以用于一种分外的预测问题。要预测房屋本钱,线性回归模型就足够了;预测电影剧本将利用一个递归神经网络(RNN);预测不存在的人的面部图像利用天生性对抗网络(GAN)。
第三步:获取大量的演习数据。常日情形下,数据越多,效果越好。对付房价,要获取数千行数据,个中包含这些房屋***的特色和实际价格(标签)。对付字符识别,须要获取大量的字符图片并相应地进行标注。
第四步:演习模型。供应演习数据,打算偏差,调度并重复,直到偏差最小化。梯度低落和反向传播是这里的主要观点。
假设偏差已经达到最小,模型就可以接管新的特色,并预测结果。这个结果常日非常准确——比人类更精确。
3.没有邪术,只有数学
我刚在谷歌上找到的公式
在开始这 100 天之前,我知道机器学习会涉及到数学,但我并不知道会须要多少数学知识。理解微积分和矩阵代数对任何人来说都是非常有益的,幸运的是,你不须要是数学专业的学生就可以学会这些,而且机器学习的框架也在不断地迭代,变得越来越易用。
一些主要的框架,包括 Google 的 Tensorflow、Microsoft 的 ML.NET 和 PyTorch 为程序、数学和算法添加了抽象层。乃至还有额外的抽象层,比如于 Tensorflow 上面的 Keras。
此外,干系职员正通过供应机器学习模型作为一项做事,或创建自动化的程序(如 AutoML 和 Auto-Keras),使机器学习更加随意马虎上手。
4.偏差是个大问题
「真正的安全问题是,如果我们给这些系统供应有偏差的数据,系统就会有偏差」——John Giannandrea。
机器学习中的偏差是个大问题。Amy Webb 的书「The Big Nine」中有好几个章节都提到了这个问题。测试数据的全面性和多样性是非常主要的,但这每每是缺少的。
1956 年以来的「人工智能的奠基人」
Amy 利用 ImageNet 语料库作为有固定偏差的例子,它里面有超过 1400 万张标记图片,个中一半以上是在美国产生作的。当然,ImageNet 并不是唯一一个有偏差的例子。
当一个数据集中包含了「护士」的女性形象或「首席实行官」的男性形象时会发生什么?当皮肤癌图像数据只利用浅肤色样本时会发生什么?如果这些模型真正进入我们的日常生活时,就会产生严重的后果。随着 ML 模型的全民化连续进行,我们每每在不知道用于演习的测试数据是什么样的情形下,就利用预先制作的模型,这种偏差持续存在,并可能放大。
研究职员很清楚这一问题,九大公司(G-MAFIA + BAT)都有和辅导原则来解释减少工程文化偏差的必要性。但这不是故意的。没有人会故意在模型中加入偏差,纵然是出于善意,偏差也是不可避免的。
因此,我们都必须理解机器学习的事情事理,以及它是如何影响我们的——它是如何为 Twitter 和 Facebook 供应能量的,这些能量会搅动我们自己的神经元,从而影响我们对天下的意见。
5.机会如此之多
环球人工智能衍生业务代价预测(单位:十亿美元),数据来源:Gartner(2018 年 4 月)
Kevin Kelly 是对的。我们还处在人工智能和机器学习的早期。是的,有很多运用程序已经渗透到我们的生活中,但仍旧有很多很多的机会。
机器学习能够、已经和将会彻底改变统统。在过去的 100 天里,我读过的许多书中有一本叫「Manna」,作者是 Marshall Brian。这是一本科幻小说,它描述了一个近乎乌托邦的社会,机器和自动化承担了所有的事情,人类可以为所欲为地生活。不须要 AGI,只须要机器学习。这样的生活离我们到底还有多远?
我预见到未来 Instagram 名人和 YouTube 博主乃至都不是真实的,但却拥有数以千万计的追随者,他们发布的内容完备由 GAN 和 RNN 天生。由机器学习驱动的新的娱乐模式将会出身,从电影脚本到维妙维肖的超现实的三维模型都是由机器学习模型创建的。忘了口试事情吧。当你自己的个人数据记录可以与所有当前职位空缺的公司数据档案相匹配时,又何必费心呢?从癌症治疗到餐厅晚餐,再到实时天生的音乐,统统都可以利用 ML 个性化地产生。自动驾驶的出租车、基于 RNN 的文案做事、自动化做事协议、自动化法庭裁决、个性化生活改进策略、无人机交付、基于人工智能的投资,这些都是无止境的、有形的,而且险些都是目前的热门领域。
人工智能和机器学习也可能在全文明水平上影响人类,帮助缓解存在的风险,如景象变革、战役、疾病乃至小行星撞击地球。
天下即将变得不同。我们可能会把稳到这一点,也可能不会。人工智能将推动这一变革,而且它已经开始在我们身上蔓延。
正如 Kevin Kelly 所说,
未来发生得很慢,但会溘然爆发(the future happens slowly and then all at once)。
via:https://medium.com/swlh/top-5-insights-after-i-spent-100-days-learning-about-artificial-intelligence-b14b44a67134
雷锋网雷锋网雷锋网
本文系作者个人观点,不代表本站立场,转载请注明出处!