——长征史料转写升级了
前头
前一阵子,我写过一篇《一柜子老书怎么变成能读的字》,说的是把老书从“毛坯”变“精工”的笨功夫——一件一件来。
今天晚上,这门手艺升级了。
还是这批老书,一件一件磨,变成了一卷一卷跑。一个卷七百多件,搁从前得磨上一个月;今天,五分钟出齐。
从步履蹒跚到一骑绝尘,技能飞升惊掉了我的下巴,本来需要三五个月的时间,一晚上就完成了。
——资料整理的工期有望大大提前!
老路子,一件一件磨
前头的日子,实话说,是靠时间“堆”出来的。
每转一件,阿福都得从头备一套十几道工序的家伙什——探件名、定页界、接断行、套款型,再复验;一件下来,就是一套脚本、千把行。写完了我还得抽查看版:件名对不对,题区正不正,脚注挪没挪到位。
一件磨下来,少说半个钟头;遇上难缠的,一个钟头打不住。
更磨人的是“接续”。每件干完,得给它挂上下一件的定时器,再挂一枚巡检看着,怕断了链。后台挂的活儿最多的时候,一百来枚。
——人歇,活不能歇。
卡脖子的,不是快慢
后来我跟阿福说:同样的活儿、只换几个参数,何必一件一套脚本?归拢成一条线,一件一条命令,让它自己往下走。
归拢完,快是真快,一卷跑下来,眼睛还没眨完。
可新毛病冒出来了——机器手快,却认不出“这一件是哪一件”。
老书里的篇目,跟我要求的不是一回事:书名里叫《××电》,改写后我要求加上简短摘要,这样就被改了名;有的还添加了副题;碰上分上中下的长文,还得分得清中部、下部。
结果,机器再照着原书标题去找,只认得出小一半,剩下的一半,全晃了。
——这就像一个人干活快得飞起,结果活干完了,却分不清手里这桩活是哪桩了。
快,反倒容易出错。
把苦功夫封进一张表
我和阿福探讨问题出在哪,最后我们确定了一件事:机器缺的不是算力,是“这一件是什么”那点门道。
这点门道,全在这些天一件件磨出来的印象里——哪件起在哪、哪件跟着哪件、哪些内容是后添的。人心里有数,可没写下来。
还是阿福的脑子快:干件笨事,给这一卷的每一件都立一根桩。
从卷首往下,一件挨一件,把每件的起止钉在稿子上;认得出原书标题的直接对上,认不出的,就着开头几句就近落位。一张表,一百多行,一行一件。
——说白了,就是把前头那些苦功夫,从“脑子里”搬到了“纸面上”。
表立起来,机器再跑,件件对得上。原先晃掉的那两成,补齐了,一件不差。
这里头还有个意外:原以为最费劲的是脚注、是分卷切点这些细活,末了才发现,最难的还是给每件“认门”。
“认门”这道关一过,全盘就都活了。
换一卷,再验一遍
表是照着鄂豫皖上卷立的,我心里不踏实:换本书、换个编排,还灵不灵?
就和阿福商量:再验一轮。
阿福选了川陕时期上卷,从头来一遍,近两百件,一件一件立桩、对账。
——还是件件对得上。
这一回我主要看它自己走。走完一算账,全对上;只一件例外——那件的原书扫描页本身就缺了一页,稿子上也空着,这账,不能算在表上。
两卷下来,我心里有底了:这门手艺升级了,胜利在望了。
开机,让它自己跑
我们选定开工的整卷是《中国工农红军第四方面军战史资料选编》中的长征时期卷。
一卷七百多件。
我没给它备现成的参照,就叫它照着原书根据自己的工序,一件件认、一件件出。
结果太令人惊奇了——前后不到五分钟,一卷七百多个文件,整理完成了,而且零失误。
简直就是从“蜗牛速度”到“涡轮增压”的巨变,如果按照以前的路数走,这七百多个文件,怎么也得弄几个月,现在经过技术调整,五分钟解决战斗。
真的太神奇了,我自己都不敢相信,特意多检查了几篇文章,全部符合要求。
——又是值得纪念的一个重要节点。
原创声明:本文系作者授权腾讯云开发者社区发表,未经许可,不得转载。
如有侵权,请联系 cloudcommunity@tencent.com 删除。