随机房间

写完《品味》后的一个梦:家里有个每次打开都不一样的房间,场景几个一组,组内只差一点点,而在每一组里选出最好的那个,是我谋生的手段。选择一旦被记录,就会变成下一版的默认,品味在被使用的那一刻就开始被收割。能被学走的是偏好,学不走的是承诺,以及哪些东西根本不是选项。

写完《品味》的那天夜里,我做了一个梦。深夜惊醒,趁它还没散,匆匆记了下来。第二天重读,我才发现它几乎是那篇文章的反面:那篇文章说,选项变得廉价之后,选择就成了价值所在;这个梦问的是,如果连选择也被收走,我还剩下什么。

先把梦讲一遍。我尽量不替它加工,只补上半夜来不及写的那些连接词。

每次打开都不一样的房间

梦里,家里有一个神奇的房间。每次推开门,里面的场景都不一样:有时是学校的宿舍,有时是一间办公室,像是在不同的维度之间切换。更奇怪的是,东西放进去会留下,也能从里面把东西拿出来。

我开始怀疑自己的脑子出了问题:我还活在现实世界里吗?

开得多了,我发现这个房间有规律。场景几个一组地出现,同一组之内只有很小的差别。我忽然意识到,这是某种推荐机制:每一组给我看几个相近的版本,看我和哪一个互动得最好。

直到同伴提醒,我才发现自己身上背着一套背包,和神经连在一起。房间是这套设备模拟出来的,放进去的、拿出来的,都是虚拟的。只是设备处在激活状态时,我摸不到它,也感觉不到它的存在。

房间里偶尔会出现一个人。那个人其实是我的爱人,而只有在这种时候,所谓的场景才是真实世界。一遍遍刷新这个随机房间,在每一组里选出自己最喜欢的那次互动,正是我谋生的手段:我在给某个推荐系统评分。只是我刷得太久了,大脑已经不再正常。

然后我就醒了。

我认得那个「一组」

梦里最先让我警觉的,不是背包,而是「几个一组、组内只差一点」这个规律。我认得它。

这正是我在《品味》里推荐的工作方式:让模型一次给出十个版本,读完、比较,留下一个,丢掉九个。我把这一步叫作选择,说它是选项廉价之后仍然标得上价的东西。

可同一个动作换个角度看,是另一门生意。给一组相近的候选排序、标出最好的那个,训练模型的人管这叫偏好数据;在推荐系统里,每一次点击、停留、划走,也都是在给一组候选投票。动作一模一样,区别只在于这次选择最后落在哪里:落在一件署了我名字的东西上,还是落进一张表里,成为下一轮训练的一行。

梦把这个区别拿掉了。我以为自己在挑房间,其实是在生产标签。

水位线是谁抬高的

《品味》里有一段我写得很轻松。我承认模型也会选择,而且越选越好,但我说那只是水位线在上涨,价值会移到更高的一层:替模型定标准、决定它的建议哪一条不采纳、为结果署名。「水位线会一直上涨,但水位线始终存在。」

梦替那句话补上了被省略的主语:水位线是谁抬高的?

是那些在一组组候选里做选择的人。模型学会的每一次挑选,都曾经是某个人的挑选。我说品味值钱,是因为它高出默认;可一次被记录下来的「高出默认」,恰恰是下一版默认最好的训练材料。于是品味有一个古怪的性质:它在被使用的那一刻,就开始被收割。你选得越认真,你的选择就越快变成所有人的起点,你所站的那一层也就越快被淹没。

这就是我惊醒时的恐惧,说得直白一些:我害怕自己的品味也不过是一份可以拿去训练的素材。如果我的选择可以被学走,而我又把自己理解为我所做的选择,那么被学走的就不只是一门手艺,而是我。

激活时摸不到的背包

回头看,梦里最让我不安的细节不是房间是假的,而是那套背包在激活时摸不到。

一个做得好的界面,本来就该让人感觉不到它。但这也意味着,在界面里做选择的人会真心觉得自己在自由地选。他看不见的是:这一组候选是谁挑出来给他看的,组内的差别沿着哪个方向变化,而那些真正大的问题,比如这个房间该不该存在、这扇门要不要开,从来不在选项里。梦里发现背包的不是我自己,是同伴的一句提醒。人在界面里面,很难看见界面本身,得有一个站在外面的人。

《品味》里我说过,选择需要标准,而标准来自目的。房间里的我有偏好,却没有目的;目的在系统那一边。我能提供的,只是在别人事先划好的细微差别里,指出哪一个更顺眼。这不是品味,这是评分。

拿那篇文章列过的几种形态来对照,差别就更清楚了。取舍:我没法决定某个场景不该出现,只能在已经出现的里面挑。完成:房间永远不会停,下一组总会来。署名:标签没有作者,也不需要作者。剩下的只有最薄的一层,比较。品味被削到只剩比较的时候,它确实可以被学走,因为那已经不再是一个人的判断,只是一个人的反应。

她不是一个选项

梦里最可怕的一段,是爱人出现在房间里。

可怕之处不在于她出现在虚拟里,而在于真实世界出现在了一组候选当中,和宿舍、办公室排在一起,等着我评分。我刷得太久,已经分不清哪一扇门后面是真的。

《品味》里我给「选项」下过一个定义:一份随时可以被下一份替代的供给。这个定义反过来也划出了一条边界:有些东西之所以要紧,正是因为它不能被下一份替代。一个人、一段关系、一个只因为你在场才存在的时刻,都不是选项。把它们放进一组里比较,这件事本身就是一种损坏。

我想梦里说的「大脑已经不再正常」,指的大概就是这个:一个人在候选之间选得太久,会慢慢失去「非选项」这个类别。所有东西都开始像是一组里的一个,包括那些本来就不该被比较的。

那么,自我还剩什么

醒来之后我想了很久:如果品味可以被学走,自我还在哪里?

我不想用安慰自己的方式回答。偏好当然可以被学走,而且会越学越像。一个模型读够了我的选择,可以比我自己更稳定地选出「我会选的那个」。如果自我只是一个偏好函数,那它确实守不住。

但我越想越觉得,偏好不是自我最硬的那一部分。能被学走的,是我在一组候选里会挑哪一个;学不走的,是我愿意为哪一个承担后果,以及我拒绝把什么放进候选里。前者是一个分布,后者是一串承诺。分布可以复制,承诺不能,因为承诺的全部意义就在于它由一个具体的人承担,并且跟着他走过时间。模型可以选出我会爱的那一类人,却没法替我去爱一个具体的人;它可以写出我会署名的那一类文章,署名的后果却只落在我身上。

这也是为什么署名是那几种形态里最无法替代的一种。它本身不是一次选择,而是给选择找一个错了会疼的人。

当然,被学习这件事并不新。学徒学师傅的手,读者学作者的句子,品味从来都是在被模仿中流传下来的。我怕的不是被学,而是被学的方式:没有名字,对面没有人,只有一张不停变长的表,而我在里面,不知道自己在做什么。

醒来以后

我不会因为一个梦就不再用模型。多生成、多比较,依然是好的工作方式。但我想给自己留几条界线。

知道自己背着背包。在一组候选面前做选择时,至少问一句:这组候选是谁给的,差别沿着什么变化,有没有一个更大的选项根本不在这里。

让一部分选择留在房间外面。不是所有判断都要经过候选、比较和打分。有些东西我宁愿从头自己决定,哪怕更慢,哪怕结果不如模型给的平均值漂亮。

分清哪些是选项,哪些不是。这一条最要紧。房间里出现的那个人,不在任何一组里。