数据这种新石油 ― 监控与优势
二十一世纪的战略资源,不是沉睡在地下的石油,而是从人们手机中不断流出的数据。十亿人的生活所产生的海量数据带给中国的优势、其背后与监控社会之间的张力,以及在算法和人才上更胜一筹的美国之间的对照——这是力量之源转向「数据」的时代故事。
2026年6月11日
二十世纪,左右国家命运的资源是石油。拥有那从地下喷涌而出的黑色液体的国家变得富裕,没有它的国家则为之争夺。那么在二十一世纪、人工智能的时代,担任同样角色的资源是什么?它不在地底,而在人们的掌心之中——是从智能手机里源源不断流出、肉眼看不见的海量「数据」。
为什么说「数据是新的石油」
正如上一篇所见,以2016年 AlphaGo 的震撼为契机,中国把人工智能置于国家战略的核心。支撑这份自信的,是一种信念:今后决定人工智能强弱的,不只是天才的灵感,更是用来锤炼它的海量数据——这就是制胜的关键。
为什么数据如此重要?第二篇里看到的深度学习,是一种「看的例子越多就越聪明」的机制。一个只看过一百张猫照片的人工智能,远不如看过一亿张的那个分辨得更准。换句话说,拥有更多数据的人,就能造出更出色的人工智能。正如石油越多就能驱动越多机器,数据越多就能驱动越多、越聪明的人工智能。正因如此,有一句话成了象征这个时代的标语。
不过,这个比喻并不完美。石油烧掉就没了,数据却能反复使用,被人用过也不会减少。反而是越收集越增值——这一性质,使围绕数据的竞争比石油更加激烈。
十亿人造就的「油田」
那么,谁拥有最丰沛的这种新资源呢?人工智能研究者李开复在著作《AI·未来》中有一个令人印象深刻的说法:如果数据是新的石油,那么中国就是新的沙特阿拉伯。
理由就在于中国的社会结构本身。第一,是压倒性的人口。超过十亿的人使用手机、搜索、购物、出行,每一桩每一件都化作数据。第二,是生活数字化的速度。在中国,不用现金、只需用手机一扫便可付款的「无现金支付」以惊人的速度普及。从路边摊几十块钱的买卖到大额交易,生活的绝大部分都化作数字记录留存下来。
就这样,中国在一座世所罕见、巨大无比的「数据油田」之上,构筑起了自己的人工智能产业。
在便利与监控之间
然而,这份丰沛的数据也有它阴影的一面。一个能大量汇集数据的社会,反过来说,也是一个大量记录着人们行为的社会。
在中国,街头无数的摄像头与人脸识别技术,捕捉着人流的轨迹。只需刷一下脸就能付款的机制,也在许多城市铺开。在换取便利的同时,谁在何时、何地、做了什么,都有可能以前所未有的精度被记录下来——这样一种社会逐渐成形。据说这类机制不仅用于提升便利,也被用作社会治理与维持治安的手段,围绕其是非,国际上的评价存在很大分歧。
- 2012
深度学习在图像识别上夺魁,海量数据的价值一举攀升。
- 2016
AlphaGo 的震撼,使中国把人工智能纳入国家战略。
- 2017
《新一代人工智能发展规划》,把数据、人才、基础设施的强化定为国家目标。
- 2018
李开复出版《AI·未来》,论述中美的数据优势。
这里显现出人工智能时代各国都面临的根本张力。要让人工智能变强就需要数据,但大量收集数据,又可能与个人的隐私和自由相冲突。便利、安全、效率,与个人的尊严——如何在这二者之间取得平衡,各国给出的答案大相径庭。容易收集数据的环境固然是人工智能开发的东风,而收集数据的方式本身,也成了映照一个国家价值观的镜子。
量的中国,质的美国
那么,隔海相望的美国又如何呢?相对于中国在数据的量上抢得先机,美国所握有的是另一种优势。
其一,是算法与基础研究的积累。构成人工智能根基的诸多理论与方法,大多源自美国的大学、研究所与巨型科技企业。其二,是人才。全世界最优秀的研究者汇聚于此,最前沿的发现不断累积。第二篇里看到的深度学习革命,其中心也同样在美国。
就这样,中美各自手握不同的资源与强项,在人工智能这片新的霸权主战场上彼此相向。数据这种新石油的所在,开始重绘力量的版图。
然而,有一个事实在此不容忽视。无论拥有多么丰富的数据,如果没有处理它、驱动人工智能的「装置」,一切都无从谈起。把海量数据转化为学习的那颗计算的心脏——它,是在一枚由砂粒诞生的小小半导体之上跳动的。下一篇,是围绕人工智能心脏部位的、另一场霸权之争的故事。
这篇文章对你有帮助吗?
感谢你的反馈!