自动驾驶时代来临,隐私时代结束
编者按:现代社会,似乎不论我们在哪里,做什么,都会被连续记录并上传到互联网上。 从人口密集的城市地区开始,随着时间的推移,这个地球的每一个角落都将被互联网记录下来。
计算机视觉和人工智能的飞速进步意味着这些数据可以被大规模的使用。这一现象将彻底改变广告业,改变法律,并将我们带到一个没有隐私可言的世界。
视频无处不在
这是我们所面对的现状:卫星和无人机用视频记录着世界上每一个角落的点点滴滴。这就是为什么像Terra Bella这样的公司(Google子公司)可以向世界上每一个国家销售为商业利用的高清视频。在大多数情况下,这些视频的分辨率都非常粗糙。 举个例子,你可以很清楚的从这些视频中辩认出一辆车被停在了什么位置,但是你无法看清车牌号码。
闭路电视和家庭相机系统的使用率正在逐步增长,由于传感器成本的下降,再加上国家安全以及个人安全级别对监控系统的要求越来越高(家庭安全摄像头、婴儿监控摄像头等的迅速发展)。只在英国,闭路电视(来源)就已经高达600多万个。
普通用户每天拍摄上传的视频数量也在疯狂的增长。用一组具体的数据来说明这个事实:超过4百万小时的视频正在每天被上传到YouTube。这个速度丝毫没有要减缓的趋势,因为智能手机还在被进一步普及。而Facebook Live、Twitter的Periscope和Snapchat(美国社交媒体上的直播系统)等产品正在推动着当前的智能手机用户采取进行直播的方式记录生活。
但所有的这些,和新媒体界接下来所要发生的改变来说,都是不足挂齿的,
Google 的增强现实(Augmented Reality)将会逐步面向大众市场。为了进一步发展这项软件技术,Google 需要将用户眼中的世界用视频记录下来。今天,微软Hololens和Snapchat的眼镜是行业内部最领先的,并且目前这两种实时记录眼镜在市场中所占份额还很小 。 但许多有头脑又资金充裕的投资人正在积极开展AR技术。Magic Leap,一个拥有超过50亿美元的资金和700多名员工的初创公司,成为了这个行业的带头者。
自主驾驶汽车(AV)也在努力面向大众市场,并将拍摄连续、高清晰度、高帧速率、360°的视频。这将会对整个行业产生巨大的影响。试想一下,如果当今世界上所有的汽车都变成了自动驾驶汽车。这还不是所有,自主驾驶汽车正在被大规模设计运用到物流系统当中。 随着市场对于即期货品的需求越来越大(亚马逊现在提供1小时交货系统),自主驾驶汽车(包括无人机)将是公司满足这种需求最有效的途径。 如果所驾驶车辆是免费的,并为其供电也几乎是免费的(随着电动发动机效率的提升和太阳能发电的进步)。也许以后网购衣服就变成了,通过图片选择10件衣服,然后被即时送到手边,全部试穿一遍,再将不满意的9件即时退回。
随着科技日新月异的发展,我们越来越接近将地球上每一平方米都用连续不断的视频都记录下来的“目标”。
但是好笑的是,尽管许多这些视频资源非常有价值,又有谁会真的坐在那里看呢?
在这种爆炸性的视频数据的驱使下,在过去的20年里,计算机视觉已经取得了令人难以置信的进步。
让我们从你可能不知道的事情开始说起:
麦克风也能录“视频”:具有非常高清晰度的无声视频现在可以运用计算机算法,仅仅通过声音就可以重建画面。这是计算机通过识别音频中周围物体上的声音(和心电图中通过画面识别声音频率的道理一样)。在下面这张图片所展示的例子当中我们可以看到,研究人员能够通过从隔音玻璃后面拍摄一包薯片来恢复屋内的一场谈话。在完全没有记录音频的情况下,如果效果足够好,我们可以了解到屋内对话的整个内容。虽然现在的所有监控系统都会多多少少的记录声音,但是这些技术的发展可以帮我们提高声音的清晰度,尤其是在记录远距离物体以及在嘈杂的地方进行拍摄时。
自然语言处理:已经被大众广泛使用的Google now和siri很多时候会曲解我们所表达的话。但在专业的研究实验室当中,我们已经研发出了几乎百分之百准确的声音识别系统。 与面部识别一样,用于训练NLP算法所得到的数据(来自智能手机、漫游器和亚马逊Alexa / Google Home扬声器的会话界面)所激发的这一大创新。 在2016年微软击败以人类作为基准的语音识别。 不久之后,Google向世界展示了8种语言进行实时翻译的新科技,进一步表明科学技术的智能程度已经追赶并且超过了大部分从前只有人类能做到的事情。
面部识别可以被当成已经攻破的一项技术。 2015年6月,Facebook的人工智能负责人Yann LeCun宣布,在Flickr的一组40,000张照片中,Facebook的算法能够在83%的情况下正确识别脸部。 更有趣的是,人们的脸并不需要总是在画面中—有足够的关于用户的数据时,计算机可以使用其他线索,如服装来识别他们(“Mark似乎穿了很多灰色的T恤...”)。随着照片数量的爆炸式增长,再加上Facebook和Google不断的反馈, 通过视频和照片记录、计算机记录着每个用户的使用习惯、服装风格和常去位置,计算机将很容易超越人类识别人类的速度去识别谁是谁。 还记得上次你记不清站在你面前的老朋友的名字的时候吗?你的电脑也许能够给你一个满意答复。
从草垛当中找一根针
人工智能系统能够从原始数据当中推断出更高级别的数据(或“特征”)。 例如,某人的面部是从形成原始视频当中的特征之一。这一个线索就给了我们搜索原始视频中的所有声音和其他画面的机会。 Clarify.io作为一个提供该服务的公司就是一个很好的例子:
人工智能的功能还有很多。它不仅能起到搜索的功能,它还能即时找到数据中产生的规律或异常。
它也能同时跨越可用的不同数据源,在它们之间的公共标识符上加入数据集。 所以并不是说它只能识别“这个视频中的某一个面孔”,它可以记录有关这张面孔所代表的这个人的一切(包括这个人所去过的地方,所有浏览活动、所有的信息、所有的社会网络意见等)以及可用的任何其他数据集。
这些人工智能系统将继续改进,每个改进的版本将重新处理原始数据。比如说昨天英国某警察从监控录像中找到了犯罪分子的脸,今天再找的时候就不见了,但当明天所有数据被重新处理后,这张脸会再次出现。但是这些进步的影响是什么呢?
商业意义
广告商、保险商、零售商、银行会毫不吝啬的运用这些新的数据,正如他们如今运用所有其他互联网数据一样。他们的目标仍然是为你建立一个详细的个人资料,从而向你出售更多的东西,量化你所代表的风险或责任。
无处不在的视频结合着不断改进的人工智能系统将为这些商家提供:
你的社会经济地位:你住在哪里,你在哪里工作和多少,你的孩子几年级了,你身边都有什么样的朋友。
你的购物习惯:你在哪里购物,你穿什么,你的朋友穿什么,你在工作时要穿什么。
你的健康状况:你是否锻炼,是否吸烟/喝酒,你通常光顾的餐厅,你去看医生的次数。
它还在更加宏观的层面带来了一些有趣的预测机会:
对于时装业来说,当六个静态相机可以告诉你某个城市所有人一年以来都穿了什么衣服,你就可以轻而易举的通过这些照片和视频资源来预测下一个风靡整个地区的潮流风向。
但不可避免的是,这些资源将被人工智能公司转手卖掉。就像Google和Facebook喜欢根据浏览历史定位人群一样, 这里的商业机会是巨大的。所以不管这些视频资源是在有监管的情况下被光天化日之下卖掉的,还是一些我们看不到背后交易,到最后这些数据总是会被作为商业契机所利用的。
隐私的含义
正如格雷戈里·弗伦斯坦在隐私的诞生和死亡中阐述的一样,完全透明的状态才是人类的自然状态。隐私作为一个概念只有大约150岁的寿命。
很长一段时间以来,许多我们今天拥有的隐私都是不可能被实现的。当这个部落都住在洞穴里,当古罗马人都住在拥有一间屋子的房子里,当中世纪的家庭和仆人都睡在同一张床上,何谈隐私和个人空间?
随着隐私和个人空间一步步成为可能 -—物理上与独立的房子、房间、床,人们开始有了拥有某种隐私的欲望。美国的第一个以隐私为主的法律是1710年邮政法,禁止邮政员工通过邮件类别将其分类。
然而,对于方便性和成本价值来说,隐私永远被排在了第二位。这就很好的解释了为什么当今科技虽然很大程度上侵犯了我们的隐私但是还在被大力提倡。
今天,自主驾驶汽车是这些新技术之一。仔细想想看,我们让人类驾驶汽车其实是一件很疯狂的事情,这件疯狂的事情导致着美国每年被车祸夺取生命的人数量高达30,000(每17分钟一次)。但是如果使用自动驾驶汽车,这个数字将显著减少,这本身使得这项技术具有很大的吸引力。但是这对于我们的隐私有何影响呢?
这一次,您不能选择退出
智能手机和互联网是如今社会的最大革命,但你可以选择不使用智能手机或不使用Facebook、Google或任何其他收集和销售您的数据的服务。
但是在一个“视频无处不在”世界中,这种跟踪完全处于一个“离线”的状态。当你走出家门,你所有的动作都会流向一个数据库,你的样子、当下的时间、地理定位都会被记录下来并被添加到你的数字配置文件中。你无法选择退出。(要想尽可能延迟这一天的到来,你可以(1)确保你的照片不在互联网上,(2)住在一个例如朝鲜的地方(3)住在一个多云的地方,这样无人机和卫星很难从更远的地方看到你,而且我打赌你的房租会很便宜)
视频无处不在意味有一个源数据的存在,从这个数据库当中可以发现任何异常的公民行为。这将被情报机构用于国防目的,但它直接影响你和我的生活。
当检察官可以在视频处理算法中编码出所有违规行为时,法律将具有100%可执行性。
我认为最重要的是要记住,在美国历史上的很多时候,正确的并不一定是合法的。—爱德华斯诺登
今天,关于自主驾驶汽车和人工智能的公开辩论中最紧迫的问题就是:自动化实现后,美国的经济以及就业率将会受到很大影响(例如卡车司机,这是美国最受欢迎的工作之一)。这是民众最关心的事件之一。
然而,自动驾驶汽车对隐私的影响也需要来自民众更多的注意力。
自主驾驶汽车应该是在慎重权衡利弊后再决定是否要真正投入使用,这其中需要讨论的问题就应该包括对于隐私的影响。
这场讨论的结果应该对以下问题进行明确的规定:
哪些数据可以从自主驾驶汽车的摄像机收集,以哪种格式?如何匿名?
这些数据在哪里存储、共享和保护?
这些视频寿命有多长时间,以及公众对它有什么控制?
谁将控制处理视频信息的算法,我们将如何评估其有效性和法规遵从性? (法官需要学习代码吗?法律会变成代码吗?)
随着技术的应用(Elon Musk期望到2018年发售第一个完全自主驾驶的Telsa),所以现在是时间研究出这些问题的答案了。
到目前为止,在我所做的研究范围当中,我在美国看到了两个民主党参议员提出的一个称为“汽车法案中的安全和隐私”的法案。
本法案目的旨在:
防止未经授权的访问:
(1)电子控制或驾驶数据,包括关于车辆位置、速度、所有者、驾驶员或乘客的信息;
(2)由内置于车辆中的电子系统收集的驾驶数据。
正如这里所提到的,这个法案是在2015年7月推出的。早在2015年3月15日,自谷歌、通用汽车、德尔福和Lyft的高管出席美国参议院委员会讨论。当高管被问到自主驾驶汽车是否应该有隐私和网络安全的最低标准时,除一个参与者外,所有人都拒绝发表明确意见。至此,法案没有被进一步颁布。
自主驾驶汽车的应用将会把所有的一切都以视频的形式连续的记录下来。我很想被证明是错的,但是这次,我们的隐私将真的会被暴露在光天化日之下。
翻译来自:虫洞翻翻 译者ID:赵书绮















