审计师 · 任务逐条
分析单位是任务,不是职位名称。下面每一条都带着它的方向、这条判断是有证据还是平台推断、判断的理由,以及它没有确立什么。
这一页上的每一项任务#
抽样与测试
正在自动化✓ 有证据支撑抽一批交易出来,拿凭证逐笔核对。
抽样之所以存在,是因为全查太贵。一旦全查变便宜,样本就失去了存在的理由 —— 而全量测试在大型审计里已经平常十年,远早于任何叫「AI」的东西。生成式工具加上的是「能读凭证本身,而不只是读账上那一条」的能力,它把同一个趋势延伸到了过去必须靠眼睛的那一半。
它没有说审计工时实际是怎么计费的 —— 在很多事务所里,这里省下的工时是被更多的测试吸收掉的,而不是变成更少的人。它也没有说小型审计,那里这类工具常常根本没被买。
决定该往哪儿看
仍由人主导≈ 平台推断风险评估:哪些科目、哪些估计、这门生意的哪一块可能藏着东西。
异常检测确实有用,而且能找到人会漏掉的东西。它做不到的是判断「在这门生意、这一年、面对这一层管理的激励下,哪个异常值得追下去」—— 那需要一个关于「为什么有人会想把账做错」的模型,而那个动机长在数据之外。
这是一条关于工作性质的判断,不是测量。它也没有声称审计师擅长这件事 —— 漏掉那个真正要紧的风险,正是这个行业标志性的失效,而公开记录里这样的例子很多。
问出能得到真话的那个问题
仍由人主导≈ 平台推断坐在财务总监对面,弄清楚有什么是没被说出来的。
审计里的证据不只是书面的;其中很大一部分,是某个人在被直接问到时说了什么、以及没说什么。那是一次现场的社会行为,对面那个人可能有理由误导你 —— 而审计师的职业怀疑是在那个房间里用的,不是在底稿里用的。
这里没有量一次现代审计里有多少是询问、有多少是文件测试 —— 在很多项目里,询问只是一次用邮件走完的形式。而在它只是形式的地方,这项任务不是「由人主导」,它只是没有在做。
底稿与意见
正在被增强✓ 有证据支撑把做过的事记录下来,并起草那段最终会摆在股东面前的措辞。
工作底稿有结构、重复、模板化程度高 —— 接近生成的理想场景,而事务所宣称的时间节省大部分也来自这里。意见本身性质不同:它的措辞是被规定的,而出具一份非无保留意见是一次公开行为,对客户有后果 —— 那个签字的人必须愿意造成这个后果。
公开范围内没有任何东西测量过审计底稿节省的时间,而事务所关于它的说法来自一个在卖这场转型的一方。能把它定下来的是:监管机构对使用这类工具编制的底稿所做的检查结论。
签下那个字
仍由人主导≈ 平台推断成为那个具名的人 —— 用执照为这份意见站台,并在它错了的时候答复。
这不是一条关于难度的判断。在每一个有法定审计的市场里,法律都要求一个持证的个人或事务所签字,并把责任挂在那个签名上。而那就是全部产品:审计之所以有价值,恰恰是因为有人可以为它被告。 自动化够不到一个「为了能被追责而存在」的位置。
它保护的是那个签名,不是签名背后的人数。一家事务所可以用更少的人签出同样多的意见,而那个签名不说明为了走到那一步需要多少初级人手 —— 而那恰恰是读这一页的人真正关心的数字。
对机器起草的东西负责
新出现的任务✓ 有证据支撑在机器起草的专业成果挂着事务所的名字发出去之前,把它检查一遍 —— 引用、引文,以及那些「看起来对」的东西。
这是工具造出来的新工作,而它的失效方式很具体:生成的专业文本在它最自信的地方最危险 —— 一条虚构的引用,在一个快速扫读的复核者眼里,和一条真的长得一模一样。本站有一条记录:一家四大事务所在一份用生成式工具起草的报告里被发现虚构文献与错误归属的法院引语之后,退还了部分政府费用。
那条记录是一家事务所的一个咨询项目,不是法定审计,而且它确立的是「这种失效发生过」,不是「它多常发生」。新工作出现同样不等于新增编制:在一个按工时计费的生意里,一项不能计费的检查职责是被吸收掉的 —— 而那正是它会被跳过的条件。