在发布文章前,我习惯大声朗读以校准语感:确认标点位置、判断破折号的必要性,以及筛选可省略的括号内容。但近期,这种通读演变为一场“猎杀”。我 systematically 删除破折号,替换为逗号或句号,以维持节奏并降低改动显眼度。我搜寻并替换诸如“真诚地”、“诚实”、“安静”、“沉默”或“值得”等词汇,将其存入桌面名为“文学墓地”的文件。这些词汇和模式常被视为AI生成的特征,尽管它们原本是我多年形成的个人文风。这一自我审查机制源于Slack争论、LinkedIn帖子以及前老板的直接反馈——即便破折号符合语法,为避免被误认为AI所作,也必须剔除。

被算法回收的个人风格

最令人沮丧的是,这些被标记的风格原本属于我自己。在大型语言模型出现之前,我已这样写作多年。机器从像我这样的写作者身上学习了这些词汇、结构和模式,再将其复制回给我,直至它们不再感觉像属于我自己。对于一名仅希望撰写设计令牌(design tokens)相关内容的从业者而言,这种程度的自我监控令人疲惫。

这在产品与设计系统领域是一个熟悉的循环:一种模式被引入系统,人们开始模仿,久而久之,模仿本身成为正确性的证明。系统有时归档有效事物,有时则凭空创造行为并将传播视为判决。工作的一半在于追溯模式来源,确定其是自然选择还是单纯堆积。如今,同样的循环出现在语言中,且缺乏审计标准,影响力的流向已无法分辨。

走向平庸与模型坍塌

这种现象的终局被称为“模型坍塌”(Model Collapse)。2024年,《自然》杂志发表研究指出,当模型基于其他模型的输出进行训练时,罕见且具体的细节最先消失。经过多轮迭代,独特性被平均化,至第九轮时线索完全消失。

在设计系统工作中,类似现象被称为“漂移”(Drift),即系统因各团队扭曲使用而失去共享标准。但此处情况相反:并非分散,而是万物向中心靠拢。罕见和独特的部分被磨平,留下最普通的形态,最复杂和人性化的部分最先消失。我将每个词移入“文学墓地”,实则是在手动平均化我的写作,这与训练循环在大尺度上施加的拉力一致,只是速度更慢。

被误读的母系传承

阅读文章、通讯或文档时,这种感受尤为强烈。一年前,我能轻易分辨内容是否源自生活经验;如今界限模糊。我在吸收内容前,会扫描那些被我训练避免的特征,使写作变得如阅读般沉重。我甚至恐惧写作,因为被教导的结构可能被解读为AI特征。

这种结构源于我的母亲。她拥有写作专业学位,并在变革管理、技术写作和电子学习领域建立职业生涯,擅长将复杂事物拆解为可掌握的部分。我构建句子的许多方式继承自她。然而,清晰、结构化、技术性的写作正是模型训练的主要内容。埋在“文学墓地”里的词汇之所以像机器生成,是因为像母亲这样的作家首先就是这样写作的。某种意义上,我正在编辑掉句子中的母亲痕迹,以防止它们听起来像我从她那里学到的东西。母亲给予我最珍贵的礼物,现在最容易被误认为是机器产物。

尽管母亲劝我不应为取悦他人而缩小自己,但我仍陷入焦虑,反复检查草稿。试图了解检测器原理以减轻担忧的努力并未成功。检测通常归结为两个因素:词汇是否为模型优先选择,以及句子长度是否相似。写得干净、均匀且易于跟随,便处于模型标记范围内。母亲花费数年培养的习惯,现被陌生人解读为机器特征,这既荒谬又令人沮丧。

这不仅是软件问题。研究人员警告,某些词汇开始被视为技能低下或懒惰使用AI的标志。这些词汇并非机器发明,而是通过多年阅读习得的优质词汇。谨慎、一丝不苟的作家在模型使其“有毒”之前早已使用它们。那些学会写作并构建词汇库的人,现在却不得不看着这些词汇被解读为机器产物。

我的身份认同很大程度上建立在这项工作上。精进十六年的缓慢技能,如同时查看Figma文件和代码库以发现差异,或撰写让疲惫开发者也能跟进的文档,正逐渐被工具吸收。当这些技能的价值降低,我感到无助,仿佛一部分自我随之消失。

写作曾是孤独的活动,利用模型辅助思考或测试想法可降低孤独感,但这存在风险:一旦模型介入,作品易被贴上“垃圾”(slop)标签。我认为“垃圾”与模型本身关系不大,而取决于是否付出努力。未经检查、调整或影响的原始输出是对读者时间的浪费。有人精心打磨文章,借助模型改进句子,文章依然有生命力;另有人直接发布未经阅读的模型回复,其中空洞显而易见。这是可接受与不可接受的界限。

更糟糕的是,检测器往往无法区分这两种情况。深思熟虑的版本与一次性生成的外壳被同等读取。模型从那些以缓慢方式起步、努力工作并分享成果的人身上学会了如何变得有用。正是那些投入时间、艰难学习的人,被迫为自己的工作辩护。

后果已经显现。今年一月,Tailwind Labs解雇了其四名工程师中的三名。创始人Adam Wathan表示,自2023年初以来,尽管该框架更受欢迎,但其文档网站流量下降了约40%。开发者停止访问文档,因为工具已熟知这些内容。那些教会模型的人们,正在为此买单。

我对这一切没有解决方案,也无法解决身份危机。这篇文章名为《我已分不清谁在教谁》,指涉外部世界。但更令我夜不能寐的问题是:我是否还能在我写下的文字中找到自己?