登录

科学网—从检查四百六十条参考文献,到审计整部书稿:我正在亲历一场技术变化


速读:检查同一个理论概念在不同章节中的定义有没有发生变化; 可是仅仅过了一个月,当我再次面对这部书稿时,突然发现自己思考的问题已经完全不同了。 下一分钟,它已经开始指出某个地方多了一个空格,某个地方的分号格式不统一,某处大小写与其他章节不同,某个连字符和破折号使用得不一致,某个标题层级似乎出现了异常。 现在,我却可以在同一次书稿审计中不断改变观察尺度,从一个理论概念跨越全书的一致性,一直下降到一个标点符号或者一个空格。 检查同一个数据在不同地方出现时是否一致;
从检查四百六十条参考文献,到审计整部书稿:我正在亲历一场技术变化 精选

已有 436 次阅读

2026-8-30 09:01

| 个人分类: 科普常识 | 系统分类: 生活其它

有时候,技术变化真正让人感到震动的,并不是看到一条新闻说某个新的人工智能模型发布了,也不是看到各种令人眼花缭乱的能力演示,而是在某个很普通的下午,突然意识到:一个月前自己还在认真做的事情,现在已经不需要那样做了。上个月,我还在使用程序检查书稿中的文内引用和参考文献是否一致。整部书大约有四百六十条参考文献,如果完全依靠人工一条一条核对,不仅费时,而且很容易因为疲劳而遗漏。所以当时我专门用程序帮助自己检查,看看正文里出现的引用能不能在书末的参考文献表中找到,参考文献表里的条目是不是确实在正文中出现过。那时候,我觉得这种方法已经相当高效了。毕竟原本需要长时间机械核对的工作,可以交给程序自动完成,人只需要处理最后发现的问题。可是仅仅过了一个月,当我再次面对这部书稿时,突然发现自己思考的问题已经完全不同了。我不再只是问:“能不能帮我检查这四百六十条参考文献?”而是开始问:“能不能帮我审计整部书?”

这两个问题看起来只是范围扩大了一点,实际上背后的工作方式已经发生了很大的变化。上个月使用程序的时候,我仍然需要自己想清楚每一条规则。什么算正文引用,什么算参考文献,作者姓名怎样匹配,年份怎样匹配,同一个作者同一年发表多篇文章时怎样处理,哪些情况属于错误,哪些情况只是格式差异。程序当然非常勤奋,只要规则写对了,它可以一遍又一遍地检查,而且不会疲劳。但问题在于,所有判断标准首先必须由人转化成机器能够执行的规则。现在再使用人工智能处理同一部书稿,我发现自己越来越少考虑“这个检查应该怎样编程实现”,而是越来越直接地描述我要检查的问题。我可以告诉它:检查整部书中所有文内引用和参考文献是否对应;检查同一个理论概念在不同章节中的定义有没有发生变化;检查同一个数据在不同地方出现时是否一致;检查引用的文献是不是真的支持我写下的那句话;甚至检查全书那些细小到令人头疼的编辑问题。过去我首先考虑的是怎样设计工具,现在我越来越多考虑的是:我究竟还想检查什么?

这种感觉很奇妙,因为变化并不是发生在一个与自己无关的遥远领域,而是直接发生在自己的书桌上。还是同一部书稿,还是那些章节,还是那四百六十条左右的参考文献,甚至还是我自己在做同一件事情,可是人与工具之间的分工已经悄悄改变了。以前我要先把问题拆解成一个个明确的小任务,再想办法让计算机执行;现在我开始可以把一个相对完整的问题直接交给人工智能,让它先理解我的意图,再去寻找可能存在的问题。这种变化让我第一次非常具体地体会到,所谓人工智能能力的提高,并不只是回答问题更准确了、写文章更流畅了,而是我们与计算机合作时所使用的“语言”正在改变。过去,我们要学习机器的语言,把人的问题翻译成程序;现在,机器开始越来越能够理解人的语言,把我们真正关心的问题转化成它自己的工作过程。

最明显的例子当然还是引用。四百六十条左右的参考文献,如果只是检查“有没有”,其实已经是一个相对明确的机械任务。正文引用了某位作者某一年的文章,参考文献表里有没有;参考文献表列出了一篇文章,正文究竟有没有使用;作者姓名和年份是不是一致;同一作者同一年发表的几篇文章,字母标记有没有前后混乱。这些问题过去通过程序也可以解决。但当人工智能开始进一步追问“这篇文献究竟支不支持这句话”的时候,事情就完全不同了。比如书稿中写道某项研究发现某个比例是百分之三十,那么真正重要的问题已经不只是参考文献表里有没有这篇文章,而是原始文献中的数字究竟是不是百分之三十;如果正文说一项研究“证明”了某种关系,而原文其实只是发现两个变量存在相关性,那么引用虽然形式上完全正确,学术意义上却可能并不准确。过去的程序可以告诉我“引用存在”,却很难告诉我“引用是否恰当”。而现在,这种原本需要人打开文献、重新阅读、理解上下文之后才能进行的核查,也开始进入人工智能可以协助完成的范围。

再往前一步,我发现真正让我感到兴奋的,甚至还不是引用,而是整部书内部的一致性。一本书写到一定长度之后,作者面对的一个现实问题就是:你不可能始终清楚地记得几个月以前自己究竟怎样定义过某个概念。也许第二章说一个理论包含三个核心要素,到了第九章,因为写作环境和上下文发生变化,不知不觉又用了稍微不同的表述;也许前半部一直采用某个术语,后半部换成了另一个意思相近的译法;也许某个缩写已经在前面定义过,隔了几章之后又被当作第一次出现重新解释;甚至同一个数字,在不同章节中因为资料版本不同,出现了百分之三十七和百分之三十八这样的细微差异。写每一个章节的时候,这些句子单独看可能都没有问题。真正的问题只有把整部书放在一起比较时才会显现出来。可是对于一个已经对自己的文字熟悉到几乎会自动补全意思的作者来说,这种全书范围的比较恰恰非常困难。人工智能在这里突然变成了一双很特别的眼睛:它既读局部,也可以比较整体。

更有意思的是,这双眼睛有时候看得非常宏观,有时候又突然变得异常细致。前一分钟,我可能还在让它检查某个理论概念在十几个章节中的含义是不是保持一致;下一分钟,它已经开始指出某个地方多了一个空格,某个地方的分号格式不统一,某处大小写与其他章节不同,某个连字符和破折号使用得不一致,某个标题层级似乎出现了异常。这种尺度之间的跳跃让我印象很深。过去这些工作通常属于完全不同的层次:理论问题由作者或者专业审阅者判断,引用由作者和研究助理核对,语言和格式问题交给编辑处理,最后还有校对人员寻找那些隐藏在几十万字中的微小错误。现在,我却可以在同一次书稿审计中不断改变观察尺度,从一个理论概念跨越全书的一致性,一直下降到一个标点符号或者一个空格。这并不意味着人工智能已经能够替代这些不同角色,更准确地说,它第一次让一个普通作者拥有了一种过去很难获得的能力:在正式进入人工审阅之前,先对自己的整部作品进行一次极其广泛而且不知疲倦的扫描。

这种体验也让我越来越意识到,人工智能真正改变的可能并不是“写作”本身,而是写作周围那一大片过去很少被人注意的工作。写一本书当然需要思考、研究和表达,但真正经历过长篇写作以后就会知道,大量时间其实消耗在写作之外:寻找资料、核对数据、检查引用、统一术语、回头确认前面有没有说过相反的话、检查章节之间有没有重复、修改参考文献格式、核对图表编号、寻找各种细小的不一致。过去这些事情没有哪一件特别困难,但数量一多,就会消耗大量注意力。而人的注意力恰恰是写作中最宝贵的资源。当这些工作能够越来越多地交给人工智能进行第一轮检查时,真正被释放出来的并不只是时间,而是注意力。作者终于有可能把更多精力留给那些机器很难替自己决定的问题:这个理论解释得是否足够清楚?这个论证是否真正成立?这一章究竟有没有存在的必要?这句话是不是我真正想说的话?

当然,我并没有因此觉得以后可以把书稿完全交给人工智能,然后安心接受它给出的所有判断。恰恰因为使用得越来越深入,我反而越来越清楚它的边界。它会误解文献,会把合理的理论差异误认为前后矛盾,也可能因为掌握的资料不完整而对一个数据来源作出错误判断。尤其是涉及专业理论、复杂研究方法和学术争议时,最终判断仍然必须由作者完成。所以我现在越来越愿意把人工智能看成一个极其勤奋的审计者,而不是一个拥有最终决定权的裁判。它最有价值的地方,并不是替我决定什么是对的,而是帮助我把那些“可能有问题”的地方尽可能找出来。如果几十万字的书稿中隐藏着几百个值得重新看一眼的地方,它可以先把这些地方标记出来,而我真正需要做的,是集中精力判断其中哪些确实需要修改,哪些可以保留,以及为什么。

也正是在这个过程中,我开始重新理解“效率提高”这几个字。以前想到技术提高效率,很容易理解成原来需要十个小时的事情,现在两个小时做完。但这一次给我的感觉并不完全是这样。真正的变化是,以前根本不会去做的检查,现在开始变得值得做了。过去如果有人告诉我,为了保证一本书的内部一致性,最好把几十万字从头到尾重新扫描一遍,逐一检查每一个重要理论概念在不同章节中的定义是否发生漂移,再把所有重要数据重新追溯到原始文献,同时检查几百条引用是否真正支持正文中的具体论述,我大概首先会计算这需要多少时间,然后不得不放弃其中相当一部分。并不是因为这些检查没有价值,而是因为人的时间和注意力有限。现在,当这种审计的成本突然大幅下降以后,问题就从“值不值得花这么多时间检查”变成了“既然可以检查,为什么不检查”。这可能才是技术进步最深刻的影响之一:它不只是让原来的事情做得更快,还会让一些过去因为成本太高而根本不会做的事情,逐渐成为新的常规。

回头想想,最让我感慨的仍然是时间。不是十年前,也不是三年前,甚至不是去年。就是上个月,我还在认真使用程序检查这部书的引用,并且觉得这种方式已经很好。一个月之后,我已经开始让人工智能帮助我审计整部书稿,从四百六十条左右的参考文献,到理论概念的一致性,从数据准确性和文献匹配程度,到一个空格、一个分号、一处大小写或者一个破折号。真正让我震动的不是某一项具体能力,而是这些原本分散在完全不同层次上的任务,正在迅速汇聚到同一种工具之中。更重要的是,我自己的思维方式也跟着发生了变化。一个月前遇到问题,我还会本能地想:“这个能不能写一个程序检查?”现在,我越来越自然地问:“这个能不能让人工智能把整部书检查一遍?”

身处技术变化之中的一个奇妙之处,就是我们往往感觉不到变化发生的速度。每天只是多一个功能,模型好像聪明一点,能够处理的内容再多一点,昨天不能做的事情今天勉强可以做,今天觉得麻烦的事情下个月可能已经变得普通。只有偶尔停下来,回头看看自己不久以前究竟是怎样工作的,时间的尺度才会突然显现出来。对我来说,那四百六十条参考文献恰好成了这样一个小小的时间坐标。它让我能够非常具体地比较:一个月以前,我怎样使用机器;一个月以后,我又怎样使用机器。书稿没有变,作者没有变,需要解决的问题也没有完全改变,改变的是我们解决问题的方法,以及我们开始认为“机器可以帮助做到什么”的边界。

我甚至有些好奇,再过一年回头看今天,自己会是什么感觉。也许到了那个时候,今天这种“把整部书稿交给人工智能,让它审计,然后自己逐项复核”的方式都会显得笨拙。也许未来的写作过程中,人工智能从第一章开始就会持续维护整部书的概念体系、数据来源和引用关系。当我写到第十二章某一句话时,它已经知道第二章曾经怎样定义这个概念;当我输入一个数字时,它会提醒这个数字与第四章的版本不同;当我引用一篇文章支持某个判断时,它会立刻告诉我原文的结论其实更加谨慎;当一个术语在几个月的写作过程中悄悄改变含义时,它可能在变化刚刚发生的时候就提醒我,而不必等到全书完成以后再进行审计。到了那个时候,我们今天觉得不可思议的“全书检查”,或许就像今天的拼写检查一样普通。

所以,现在再看人工智能的发展,我越来越不愿意只用“它又多会了一项什么功能”来理解。真正值得记录的,也许是我们自己的工作方式正在怎样改变。技术史写在新闻里,是一个个模型、一次次发布和一项项指标;但技术变化真正进入一个人的生活,却可能只是这样一个非常具体的瞬间:上个月,我还在写程序检查四百六十条参考文献;这个月,我已经在让人工智能审计整部书稿。两件事情之间没有隆重的分界线,没有哪一天早晨醒来世界突然变了。只是某一天坐在电脑前,我忽然意识到,自己已经不再按照一个月以前的方式工作了。

也许所谓亲历一个技术迅速变化的时代,就是这种感觉。变化发生得如此快,以至于我们甚至来不及为一种新的工作方式建立习惯,下一种方式已经出现。今天让我感叹的,是人工智能可以从四百六十条参考文献一直检查到整部书的理论、数据、引用和编辑细节;而真正让我期待的,则是几个月以后,当我再次回头读到这篇文字时,会不会又觉得:原来那个时候,我们还需要这样使用人工智能。

转载本文请联系原作者获取授权,同时请注明本文来自傅平科学网博客。 链接地址: https://blog.sciencenet.cn/blog-3316383-1550152.html

上一篇: 家谱之外:关于我祖父母和父母的一些口述记忆 欢迎参加科学网十佳博文评选活动! 主办单位: 支持单位:

主题:问题|参考文献|人工智能|四百六十条左右|到审计整部书稿