张逸骅
文章
随记
我感觉,我们正在遭受一场来自于AI的文化入侵,是 AI 对于整个人类的文化入侵。现在AI的训练语料几乎全都来自于,所有存在过的人类的文化积累、写作、和历史,但是真正参与过大模型训练的人都知道,人类历史上所产生的所有语料(低价值的和高价值的),对于训练下一代大模型训练而言,(早就)已经不够用了。但是,AI 却在源源不断得产生文字(甚至是书籍)、图片、视频、音频。过不了多久,互联网上的文字信息中,AI 产生的内容将和人类产生的一样多;再过不了多久,整个互联网的文字语料中,人类产生的文字,就数量而言,将会变成九牛身上的一毛上的毛尖尖(不知道这里会不会也有个摩尔定律,。AI 看似在提供选择,但其实在培养人的习惯。对于人类的大多数而言,在不久的将来,遇到任何正式的书写场合,大家就会从现在的不想写、到不会写、到最后的不敢写。不会写是因为 AI 在无形中吞噬人类组织(复杂)语言的能力、当你只需要给出关键词,AI 就能将大量看起来精心雕琢的段落送到你面前的时候,你是不会再去想遣词造句、因果逻辑、起承转合等等细节的。不敢写是因为害怕出丑或者害怕无法与其他使用AI的人竞争。如果别人用AI半天能写完100页,你自己写一天才能写 2 页,可能出于外部压力,你不得不用 AI,也不敢不用 AI。
我还记得 2022 年我刚开始读博的时候,写一篇论文需要非常大的前期准备工作,主要是一点一点得整理思路的过程。当时,写论文就像拍电影一样,在真正开写之前,我们对论文的章节先做规划(大概几个章节,每个章节是做什么的),然后对章节里边的段落进行规划(每个章节分别有几个段落),最后可能大家没想到的是,作为一个非英文母语者,我甚至会对每个段落里边有几句话,每句话分别什么作用进行设计。其实也没有很夸张,一个标准的学术论文里,一个中等长度的自然段,可能也就是五六句话。这里主要进行规划的是“每句话是每句话有什么功能”,就像排兵布阵一样,这里甚至还会有很多写作上的小巧思。比如如果我需要用到欲扬先抑,那么我可能在第一句话就狠狠把之后要贬低(通常是baseline,LoL)的对象先夸上一通、然后设置一个埋伏(通常是第二句话),最后论证这个埋伏,然后引出我们想讨论的问题。这里可能涉及到跨章节的对偶,一些双关语的引用,一些夹杂了个人偏执和情感宣泄的语句(虽然夹带私货并不好),在开始写之前,整个过程可能会修改好几轮。这就和拍电影写脚本、设计分镜一样。但是说这些,这并没有让我当时写的文章,就一定比现在有了 AI 以后写的文章要更好。说实话,可能很大程度上是没有的。但是不同之处在于,我留下来的是创造的过程、逻辑的演化以及自己经过思考以后的独有意思的表达。“我”究竟是谁呢?我现在慢慢觉得,文字表达是一种体现“我”的方式。如果我的每一次发声,都需要经过一次代理,那么“我”还是“我”吗?如果我到最后甚至无法构思一个完整的观点并把它论述出来,那么这个观点还是“我的意思”吗?无论世界哪个国家的人,都对中央权力下的文字审查抱有深深的敌意,但是在未来我们会不会心甘情愿得让 AI 对我们的每一次发声进行审查甚至是改写呢?
我自认写作能力是比较差的,这主要源于阅读量太低。非常惭愧,在上大学之前,我真正从头到尾读完的“课外书”可能不超过五本,唯一有印象的是高中期间读过的林语堂的《京华烟云》、钱钟书的《围城》以及路遥的《平凡的世界》(初中、小学完全没读过其他的)。我现在都觉得不可思议,我甚至在大学前连通俗小说都没正经看几本。这也就导致,我的写作是非常差的,每次高中语文考试,写作文就和便秘一样。但是现在我会强迫自己保持写作的习惯,因为写作和说话不同的地方在于,它能更真实得体现出一个人活过的印记。在 2023 年 ChatGPT 刚刚发布之时,用 AI 其实是一种时髦,我也在不断用 AI 改写我的内容,对于英语不好、中文也不太 OK 的我来说,AI 简直是救星。但是现在回过头再去读当时经由 AI 润色过的博客,还是会时不时尬出一身冷汗。现在,对于没有用过 AI 的人来说,AI 的产出同样自带一种滤镜:AI 是优秀的、是完备的、是先进的、甚至是比人类更不会犯错误的。我当时也这么深深地认为,以至于我经常有了一个完成度很高的文本后,依然会坚定不移得让“AI”帮我“润色”。然后AI不负众望得把我的文章改得面目全非,我才会满意地点击发布。当时的我甚至倍感欣慰,因为我对自己的否认反而造成了一种畸形的期待:这个文本的被 AI 改得越多,质量就一定越好。仔细想想,当时的我已经放弃了完整表达自己观点的权力。所以,如果这件事也发生在了大多数人身上,人类该如何找回文化自信,是我正在思考的问题。我们能否相信,相比于 AI,由人类创造的语言,人类其实能用更好的、更体现个体特点的、也更造福人类未来发展的方式进行表达和传播。当所有人都在使用 AI,都认为 AI 的输出更胜一筹的时候,我们是否还能够勇敢得对 AI 文化霸权说不。
最近越来越多的数学猜想被 AI 证明或证伪,我个人对待此现象的看法是略显悲观的。我个人认为,无论在什么领域、无论 AI 取得何等令人骄傲的成绩,我们都不应该由否定纯人工带来的(AI-Free)进步的意义。或者换句话说,如果在一个行业里,再也没有人“古法手搓”,长期来看这对于这个行业绝对是一个不好的事情。而 AI 对于数学的问题在于,在未来如果有人能“古法手搓”取得重大数学进步,你将再也无法自证“我是没有用AI完成这件事的”;那么当你没法自证的时候,最好的办法就是“同流合污”,反正你也无法取得“AI-Free”这样的credit;那么数学界的“古法手搓派”就会消失,这件事情对于数学界会有什么影响,我不好判断,但是我认为很显然是负面的影响。虽然这么说不合适,但是隐约有一种“劣币驱逐良币”的感觉。另外需要说明的是,不同领域“古法手搓派”的定义和他们的消失给行业带来的都是不同的。因此,你不能用“AI 加速了软件行业的发展,IT 行业再也没有人纯手写代码了,IT 行业还不是一样欣欣向荣” 来反驳我上边的话。况且,IT 行业真的像大家想想的那样欣欣向荣嘛?我们可能也不知道。
我已经受够了AI写的文字,画的图和做的视频了,我几乎在每一个平台上都能看见:小红书、知乎、X、微信公众号甚至是朋友圈???不是,我不懂你们这些分享 paper 的账号,直接把markdown语法的ChatGPT直出的回答粘贴在小红书上是要干嘛?帮我省去一次 call ChatGPT 的额度嘛?你们甚至有看过自己发的东西吗?为什么发朋友圈也要 AI 润色?你是怕你的朋友们看不懂吗?还是害怕觉得在“年度最佳朋友圈评审大会”上评不上奖?