指南
表格是先对不上,才慢下来的
表格会不声不响地改掉值
Excel 不会把你输入的东西原样放着。微软自己的文档里列了四种自动转换:把看起来像数字的文本前面的零去掉并转成数值,把超过15位的数值截到15位并用科学计数法显示,把字母 E 前后的数字读成科学计数法,把字母和数字连在一起的字符串转成日期。同一家公司还写明了精度上限:精度到15位为止,所以16位以上的数字,第15位之后的部分会被抹成零。
会中招的值,每家公司其实是固定的那几类。以零开头的手机号和邮编、为了对齐位数在前面补零的订单号、16位的卡号、字母和数字混着编的物料号。打开 CSV 的时候、从别的界面复制粘贴的时候、做查找替换的时候,这些转换都会跟着跑一遍。
麻烦的地方在于它不像错误。单元格里的数字规规矩矩,合计也算得出来。几个月后把这个文件搬进系统,被改过的值原封不动地跟着搬过去,然后被说有问题的反而是新做的那一套。所以迁移的第一步不是搬,是核对:凡是别处还留着原始值的字段,各抽几行用眼睛对一遍。
撞到上限才搬家的公司很少
Google 官方帮助写明,一个表格文件最多1,000万个单元格或18,278列。Excel 的一张工作表是1,048,576行、16,384列。一天接100单、一单一行地堆,要够到这两个数字得几十年。因为容量而离开表格的情况,比想象中少得多。
真正卡住的位置不在一个文件里面,而在几个文件之间。判断方法很短:同一个问题,两个文件给的答案一样吗。上个月的营业额、此刻货架上还剩多少、这位客人的联系方式。三件里只要有一件是打开哪个文件答案就不同,那就是该搬的时候了。
副本不是因为偷懒才出现的。一起改的时候丢过一行,之后每个人就都留一份自己的。要给某个人只看一部分却没有办法只给一部分,就把他那块单独切出来。表格是按文件打开的,藏不掉其中一列。副本一堆的公司,多半是先遇上了这两件事里的一件。
原样搬过去,规则会掉在半路
表格能转起来,靠的是经手人用眼睛补的那些缝。看到两行名字相近就知道是同一个人,看到空格就知道是还没到的值还是压根不适用。系统补不了这些缝,它的做法是在动手之前先问,问不出答案,开发就起不了步。
- 一行是什么。一笔订单,还是这笔订单里的一件商品。
- 靠哪一栏认出同一位客人。名字会重,电话会换。
- 哪些格可以空着,哪些不能。
- 过去的记录能不能改。改了之后,是谁、什么时候改的会不会留下。
- 谁负责录入,谁只能看。
这五件定下来,剩下的就是挑工具的事。没定就动手,两个月后副本照样长回来。大家退回表格,不是因为系统慢,是因为每天都会冒出一个系统不肯接收的输入。
分清哪些该搬、哪些该留
几个人一起改、而且需要留痕的东西要搬。订单、库存、客户、预约,这类数据的重点是昨天谁改了什么。一个人自己算一算的地方,留在表格里更好:价格这样调会怎样,按这个条件筛出来有几条。把这类计算也做成界面,开发范围翻一倍,经手人却还是没法按自己想要的角度看。
所以搬完之后导出功能要留着。在系统里加好条件导出 CSV,再拿这份文件到表格里算。目的从来不是消灭表格,而是让表格不再当原本。
切换那天也别只安排一天。中间会有一段两边都在录的时期,这段时间要写清楚哪一边是原本,带上日期。两边都是原本,就等于回到搬家之前。
手上的表格照用,我们从这里开始
把你现在在用的两三个文件发过来,第一次沟通就成立了。Weple 的数据采集与整理,是先把这几个文件并排摆开,从对齐列名做起。哪些值已经被改过、一行的单位在各个文件里是不是同一个、现在哪个文件在充当原本,这些我们先理清楚交给你。工作按什么单位计,写在价格说明里。如果在搬之前你还在权衡要不要先做自动化,挑要自动化的活儿之前,先划掉不该自动化的那一篇的顺序值得先看。
如果你也是这种情况
把现在的情况发给我们,我们在 24 小时内回复范围和价格。