APP下载

数据折叠与AI民工

2018-09-20咖啡猫

商界 2018年9期

咖啡猫

为推动智能时代的巨轮滚滚向前,AI行业需要庞大的、标注好的数据作为养分。这些数据大多出自一些拿着微薄收入、对AI一头雾水的年轻人,他们是人工智能背后的“人工”。

AI暗角

在科幻小说《北京折叠》中。城市里的上流、中产、底层三个阶层分别生活在三个空间,作者将这种阶层分化割裂喻作“折叠”。如今的AI的世界也存在着类似的折叠:

一边是炫醋的科技、神奇的智能应用;一边是大量人工每天重复地生产机器学习的“食物”——标注好的数据。

北京和贵阳,是数据标注世界里的两座“双子星”城市。北京聚集了大量AI公司:贵阳近年来着力发展“大数据战略”,已拥有相对完整的数据服务产业生态。

2017年,仅北京中关村大数据产业规模就超过700亿元;贵阳2017年的大数据产业及其关联产业规模总量超过1500亿元。

但标注数据的人,生活在这些巨额数字之外,拿着不高的工资,活动在“第二空间”。

从三里屯驱车1小时,行驶30千米,就到了北京邮电大学宏福校区。这里有北邮和华腾硕博合办的电子商务培训班,学生总数300多人,高峰时期,有120多人参与数据标注的兼职项目。

他们多是18岁左右的学生,每天盯着电脑屏幕给图片做标注。他们服务于一个炫醋的无人驾驶项目。

他们一个月的收入在2000元左右,如果全职做,收入能有4000-5000元。他们参与的标注项目多是培训班从上游的AI公司承包过来的。

为什么是承包?

因为能够供机器使用的数据必须是经过标注的数据,这意味着需要大量人力去完成标注工作。……

登录APP查看全文